API LLM gratuite · Compatible OpenAI · 27 fournisseurs

Tous les LLM gratuits. Une API.

Obtenez une clé gratuite et appelez Llama, Gemini, DeepSeek, Qwen et plus encore via un endpoint compatible OpenAI. Lorsqu'un fournisseur est occupé, le routeur bascule vers le suivant. Votre requête reçoit simplement une réponse.

Obtenir votre clé gratuite Lire la documentation

Connectez-vous avec Google, copiez votre clé, première requête en moins d'une minute. Ou copiez le prompt et laissez ChatGPT, Claude ou Cursor l'intégrer à votre projet.

dreamprompting-router · POST /api/v1/chat/completions demo


        
        
Trace simulée. Vos requêtes s'exécutent en temps réel. obtenir une clé →
Compatible OpenAI Aucune carte de crédit Basculement automatique

Une clé suffit pour tous ces services

Groq Mistral NVIDIA NIM NVIDIA NIM Vision Cohere Google AI Studio OpenRouter Cloudflare Workers AI Cloudflare Workers AI Vision Hugging Face ch.at

12 sur 27 fournisseurs configurés servent du trafic actuellement. Le routeur bascule entre eux à chaque requête.

27

fournisseurs en amont derrière un seul endpoint

12

fournisseurs actifs et opérationnels actuellement

43,343

requêtes traitées via le routeur

$0

par requête, par clé, par mois

Créé avec DreamPrompting

Produits utilisant cette API en production.

Démarrage rapide

Pointez votre SDK ici.

Tout ce qui parle l'OpenAI Chat Completions API fonctionne. Configurez le base_url, collez votre clé, terminé. Obtenir une clé →

curl https://dreamprompting.com/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role":"user","content":"Hello!"}]
  }'

Épingler un modèle avec "model": "groq/openai/gpt-oss-120b", ou utilisez "auto" pour laisser le router choisir et basculer. Streaming fonctionne : passez "stream": true ou celui du SDK stream=True. Listez tout à /api/v1/models.

Routage

Table de routage

Les requêtes essaient les fournisseurs en direct dans l'ordre et basculent en cas d'erreurs ou de limites de taux. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.

Fournisseur Statut Modèles par défaut
Groq live openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini
Mistral (La Plateforme) live mistral-small-latest · open-mistral-nemo · mistral-large-latest
NVIDIA NIM live nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b
NVIDIA NIM Vision live meta/llama-3.2-11b-vision-instruct
Cohere live command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025
Google AI Studio (Gemini) live gemini-3.1-flash-lite · gemini-2.5-flash
OpenRouter (Ox Alpha preview) live stealth/ox-alpha
OpenRouter live nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free
Cloudflare Workers AI live @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b
Cloudflare Workers AI Vision live @cf/meta/llama-4-scout-17b-16e-instruct
Hugging Face live meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Mistral (Codestral) live codestral-latest
ch.at live ch.at
+ 14 fournisseurs supplémentaires en cours d'activation
Cerebras bientôt gpt-oss-120b · zai-glm-4.7 · gemma-4-31b
GitHub Models bientôt openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324
Vercel AI Gateway bientôt openai/gpt-4o-mini · meta/llama-3.3-70b
Scaleway bientôt llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506
SambaNova Cloud bientôt Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it
Hyperbolic bientôt meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3
Fireworks bientôt accounts/fireworks/models/llama-v3p3-70b-instruct
Nebius bientôt meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Novita bientôt meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3
Together AI bientôt meta-llama/Llama-3.3-70B-Instruct-Turbo
DeepInfra bientôt meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Alibaba (Qwen) bientôt qwen-plus · qwen2.5-72b-instruct
Upstage (Solar) bientôt solar-pro2 · solar-mini
AI21 (Jamba) bientôt jamba-large · jamba-mini

Modèles

Modèles populaires à 0 $

DreamPrompting est une API LLM gratuite compatible OpenAI et une alternative gratuite prête à l'emploi aux API ChatGPT et OpenAI. Comme elle utilise le format standard chat completions, vous pouvez appeler gratuitement des modèles open source et de classe GPT populaires : chat, codage, résumé, extraction et génération de contenu, le tout depuis un seul endpoint avec une seule clé gratuite.

Alternative gratuite à ChatGPT / GPT

Modèles de classe GPT et GPT-OSS via un endpoint compatible OpenAI. Remplacez une base URL, gardez votre code.

openai/gpt-oss-120b

API Llama 3.3 gratuite

Meta Llama 3.3 70B et Llama 3.1, servis via NVIDIA NIM et Cloudflare Workers AI

nvidia/meta/llama-3.3-70b-instruct

API Gemini gratuite

Google Gemini Flash et Gemma via le niveau gratuit Google AI Studio, avec contrôle du raisonnement.

google/gemini-3.1-flash-lite

API DeepSeek gratuite

DeepSeek V3 et modèles de raisonnement pour le codage et les tâches complexes, sans frais.

nvidia/deepseek-ai/deepseek-v4-pro

API Qwen & Mistral gratuite

Qwen 2.5, Mistral et Codestral pour le chat multilingue et la génération de code.

mistral-small-latest · qwen2.5-72b

Une seule clé, basculement automatique

Si un fournisseur est occupé ou limité en débit, le routeur passe au suivant. Votre application continue de fonctionner.

"model": "auto"

Parcourez et testez tout sur la page des modèles, ou consultez tous les modèles d'IA jamais publiés.

Annoncé Anthropic, août 2026

Claude marque désormais son contenu généré par IA

Anthropic a commencé à intégrer un filigrane imperceptible dans le texte généré par Claude et à joindre des métadonnées de provenance C2PA signées aux fichiers tels que .svg, .png et .jpg. Cela s'applique partout où Claude est utilisé, y compris via l'API et Claude Code. Les modèles lancés dans l'UE à partir du 2 août 2026 le prennent en charge dès leur sortie, et les modèles existants sont en cours de mise à jour.

Source: Comment Claude marque le contenu généré par l'IA

Ce que notre API supprime

  • Caractères de largeur nulle et jonctions
  • Substitutions bidirectionnelles (CVE-2021-42574)
  • Charges utiles de balises Unicode, décodées en ASCII
  • Espaces insécables et autres espaces exotiques
  • Sélecteurs de variante, traits d'union conditionnels, BOM

Chaque suppression est signalée par point de code et par ligne, sur la sortie de n'importe quel modèle.

Ce qu'il ne supprime pas

Le filigrane textuel de Claude. Anthropic ne publie pas l'algorithme, mais le comportement qu'il décrit, survivant à la copie et au collage tout en s'estompant lorsque le texte est fortement modifié, paraphrasé ou traduit, est caractéristique d'un schéma token-level plutôt que de caractères cachés.

Rien n'est inséré, donc rien ne peut être supprimé. Notre scanner indiquera qu'un fichier est propre alors que la marque sera toujours présente. Il en va de même pour les métadonnées C2PA sur les images, que cet outil ne modifie pas du tout.

Nous préférons vous le dire ici plutôt que de vous faire créer un compte.

Il reste beaucoup de choses à détecter

Collez un fichier pour voir les caractères de largeur nulle, les substitutions bidirectionnelles et les charges utiles de balises dissimulées qu'il contient réellement, chacun étant signalé par point de code et par ligne. Gratuit, et fonctionne sur la sortie de n'importe quel modèle.

Outil gratuit, connectez-vous pour scanner

Découvrez ce qui se cache dans votre code

Caractères de largeur nulle, substitutions bidirectionnelles qui font que le code source s'affiche dans un ordre et se compile dans un autre, et caractères de balise Unicode transportant une charge utile invisible. Chaque suppression est signalée par point de code et par ligne, afin que vous puissiez vérifier la modification au lieu de simplement lui faire confiance.

Suppresseur de filigrane

Fonctionne avec tous les modèles

Le scan lit les caractères, pas les fournisseurs. Ainsi, ChatGPT, Claude, Gemini, Copilot et tous les autres passent par une analyse unique sans aucune configuration requise. Les charges utiles de balises Unicode dissimulées sont décodées en ASCII lisible plutôt que simplement comptées.

Scanner votre code →

We measured it, 2026-08-12

appels de génération de code 68
modèles cibles 17
contenait un caractère masqué 0

La sortie brute du modèle est propre. Les caractères sont ajoutés par le chemin que parcourt votre code, généralement un navigateur.

Outils gratuits, sans inscription

Calculez le coût avant de payer

Quatre calculateurs basés sur des données réelles, pas sur des approximations : un tokenizer BPE en temps réel, ainsi que des chiffres d'architecture pour 63 modèles à poids ouverts et 34 cartes. Rien à installer, aucun compte requis.

Calculateur de tokens

Ce qu'une requête coûte réellement

Collez n'importe quel texte et voyez comment il est divisé en tokens réels. Découvrez pourquoi la sortie coûte environ cinq fois plus cher que l'entrée, pourquoi le 20e tour d'une conversation coûte trois fois plus que le premier, et pourquoi la même phrase coûte presque deux fois plus cher en swahili.

Tokeniser un texte →
Anglais 8
Swahili 15

Même phrase, même sens. 1.9x plus de tokens.

Ou exécutez-le sur votre propre GPU

Dans la nature

Produits utilisant cette API en production

Logiciels réels, livrés par d'autres personnes, répondant à de vrais utilisateurs via cette passerelle.

Voulez-vous que votre application soit répertoriée ici ?

Rien n'est répertorié pour le moment, donc le premier bénéficie d'un grand espace. Si vous avez livré quelque chose qui utilise cette API, dites-le-nous et nous l'ajouterons.

Atteint directement un humain. Rien n'est publié avant que nous l'ayons examiné.

FAQ

Questions

Existe-t-il une API LLM réellement gratuite ?

Oui. DreamPrompting est gratuit au démarrage, sans carte bancaire. Créez un compte gratuit, obtenez une clé API, et le service route vos requêtes via les niveaux gratuits de nombreux fournisseurs, en retournant une complétion de chat au format standard OpenAI.

Puis-je l'utiliser comme alternative gratuite à ChatGPT ou à l'API GPT ?

Oui. L'endpoint est compatible avec OpenAI, ce qui en fait une alternative gratuite prête à l'emploi pour ChatGPT et l'API OpenAI. Pointez le SDK OpenAI vers notre base URL pour accéder aux modèles de classe GPT et aux modèles open comme Llama 3.3, Gemini, DeepSeek, Qwen et Mistral.

Quels modèles LLM gratuits sont pris en charge ?

Modèles populaires incluant Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command et GPT-OSS, servis via Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio et plus encore.

Guides

Aller plus loin

Tous les guides →