API LLM gratuite · Compatible OpenAI · 27 fournisseurs
Tous les LLM gratuits.
Une API.
Obtenez une clé gratuite et appelez Llama, Gemini, DeepSeek, Qwen et plus encore via un endpoint compatible OpenAI. Lorsqu'un fournisseur est occupé, le routeur bascule vers le suivant. Votre requête reçoit simplement une réponse.
Connectez-vous avec Google, copiez votre clé, première requête en moins d'une minute. Ou copiez le prompt et laissez ChatGPT, Claude ou Cursor l'intégrer à votre projet.
Une clé suffit pour tous ces services
12 sur 27 fournisseurs configurés servent du trafic actuellement. Le routeur bascule entre eux à chaque requête.
27
fournisseurs en amont derrière un seul endpoint
12
fournisseurs actifs et opérationnels actuellement
43,343
requêtes traitées via le routeur
$0
par requête, par clé, par mois
Démarrage rapide
Pointez votre SDK ici.
Tout ce qui parle l'OpenAI Chat Completions API fonctionne. Configurez le
base_url, collez votre clé, terminé.
Obtenir une clé →
curl https://dreamprompting.com/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "auto",
"messages": [{"role":"user","content":"Hello!"}]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://dreamprompting.com/api/v1",
api_key="YOUR_API_KEY",
)
r = client.chat.completions.create(
model="auto",
messages=[{"role": "user", "content": "Hi"}],
)
print(r.choices[0].message.content)
const r = await fetch("https://dreamprompting.com/api/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
"Authorization": "Bearer YOUR_API_KEY",
},
body: JSON.stringify({
model: "auto",
messages: [{ role: "user", content: "Hi" }],
}),
});
const d = await r.json();
console.log(d.choices[0].message.content);
Épingler un modèle avec "model": "groq/openai/gpt-oss-120b", ou utilisez "auto" pour laisser le router choisir et basculer. Streaming fonctionne : passez "stream": true ou celui du SDK stream=True. Listez tout à /api/v1/models.
Routage
Table de routage
Les requêtes essaient les fournisseurs en direct dans l'ordre et basculent en cas d'erreurs ou de limites de taux. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.
| Fournisseur | Statut | Modèles par défaut |
|---|---|---|
| Groq | live | openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini |
| Mistral (La Plateforme) | live | mistral-small-latest · open-mistral-nemo · mistral-large-latest |
| NVIDIA NIM | live | nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b |
| NVIDIA NIM Vision | live | meta/llama-3.2-11b-vision-instruct |
| Cohere | live | command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025 |
| Google AI Studio (Gemini) | live | gemini-3.1-flash-lite · gemini-2.5-flash |
| OpenRouter (Ox Alpha preview) | live | stealth/ox-alpha |
| OpenRouter | live | nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free |
| Cloudflare Workers AI | live | @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b |
| Cloudflare Workers AI Vision | live | @cf/meta/llama-4-scout-17b-16e-instruct |
| Hugging Face | live | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Mistral (Codestral) | live | codestral-latest |
| ch.at | live | ch.at |
+ 14 fournisseurs supplémentaires en cours d'activation
| Cerebras | bientôt | gpt-oss-120b · zai-glm-4.7 · gemma-4-31b |
| GitHub Models | bientôt | openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324 |
| Vercel AI Gateway | bientôt | openai/gpt-4o-mini · meta/llama-3.3-70b |
| Scaleway | bientôt | llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506 |
| SambaNova Cloud | bientôt | Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it |
| Hyperbolic | bientôt | meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3 |
| Fireworks | bientôt | accounts/fireworks/models/llama-v3p3-70b-instruct |
| Nebius | bientôt | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Novita | bientôt | meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3 |
| Together AI | bientôt | meta-llama/Llama-3.3-70B-Instruct-Turbo |
| DeepInfra | bientôt | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Alibaba (Qwen) | bientôt | qwen-plus · qwen2.5-72b-instruct |
| Upstage (Solar) | bientôt | solar-pro2 · solar-mini |
| AI21 (Jamba) | bientôt | jamba-large · jamba-mini |
Modèles
Modèles populaires à 0 $
DreamPrompting est une API LLM gratuite compatible OpenAI et une alternative gratuite prête à l'emploi aux API ChatGPT et OpenAI. Comme elle utilise le format standard chat completions, vous pouvez appeler gratuitement des modèles open source et de classe GPT populaires : chat, codage, résumé, extraction et génération de contenu, le tout depuis un seul endpoint avec une seule clé gratuite.
Alternative gratuite à ChatGPT / GPT
Modèles de classe GPT et GPT-OSS via un endpoint compatible OpenAI. Remplacez une base URL, gardez votre code.
openai/gpt-oss-120b
API Llama 3.3 gratuite
Meta Llama 3.3 70B et Llama 3.1, servis via NVIDIA NIM et Cloudflare Workers AI
nvidia/meta/llama-3.3-70b-instruct
API Gemini gratuite
Google Gemini Flash et Gemma via le niveau gratuit Google AI Studio, avec contrôle du raisonnement.
google/gemini-3.1-flash-lite
API DeepSeek gratuite
DeepSeek V3 et modèles de raisonnement pour le codage et les tâches complexes, sans frais.
nvidia/deepseek-ai/deepseek-v4-pro
API Qwen & Mistral gratuite
Qwen 2.5, Mistral et Codestral pour le chat multilingue et la génération de code.
mistral-small-latest · qwen2.5-72b
Une seule clé, basculement automatique
Si un fournisseur est occupé ou limité en débit, le routeur passe au suivant. Votre application continue de fonctionner.
"model": "auto"
Parcourez et testez tout sur la page des modèles, ou consultez tous les modèles d'IA jamais publiés.
Claude marque désormais son contenu généré par IA
Anthropic a commencé à intégrer un filigrane imperceptible dans le texte généré par Claude et à joindre des métadonnées de provenance C2PA signées aux fichiers tels que .svg, .png et .jpg. Cela s'applique partout où Claude est utilisé, y compris via l'API et Claude Code. Les modèles lancés dans l'UE à partir du 2 août 2026 le prennent en charge dès leur sortie, et les modèles existants sont en cours de mise à jour.
Ce que notre API supprime
- Caractères de largeur nulle et jonctions
- Substitutions bidirectionnelles (CVE-2021-42574)
- Charges utiles de balises Unicode, décodées en ASCII
- Espaces insécables et autres espaces exotiques
- Sélecteurs de variante, traits d'union conditionnels, BOM
Chaque suppression est signalée par point de code et par ligne, sur la sortie de n'importe quel modèle.
Ce qu'il ne supprime pas
Le filigrane textuel de Claude. Anthropic ne publie pas l'algorithme, mais le comportement qu'il décrit, survivant à la copie et au collage tout en s'estompant lorsque le texte est fortement modifié, paraphrasé ou traduit, est caractéristique d'un schéma token-level plutôt que de caractères cachés.
Rien n'est inséré, donc rien ne peut être supprimé. Notre scanner indiquera qu'un fichier est propre alors que la marque sera toujours présente. Il en va de même pour les métadonnées C2PA sur les images, que cet outil ne modifie pas du tout.
Nous préférons vous le dire ici plutôt que de vous faire créer un compte.
Il reste beaucoup de choses à détecter
Collez un fichier pour voir les caractères de largeur nulle, les substitutions bidirectionnelles et les charges utiles de balises dissimulées qu'il contient réellement, chacun étant signalé par point de code et par ligne. Gratuit, et fonctionne sur la sortie de n'importe quel modèle.
Outil gratuit, connectez-vous pour scanner
Découvrez ce qui se cache dans votre code
Caractères de largeur nulle, substitutions bidirectionnelles qui font que le code source s'affiche dans un ordre et se compile dans un autre, et caractères de balise Unicode transportant une charge utile invisible. Chaque suppression est signalée par point de code et par ligne, afin que vous puissiez vérifier la modification au lieu de simplement lui faire confiance.
Suppresseur de filigrane
Fonctionne avec tous les modèles
Le scan lit les caractères, pas les fournisseurs. Ainsi, ChatGPT, Claude, Gemini, Copilot et tous les autres passent par une analyse unique sans aucune configuration requise. Les charges utiles de balises Unicode dissimulées sont décodées en ASCII lisible plutôt que simplement comptées.
Scanner votre code →We measured it, 2026-08-12
La sortie brute du modèle est propre. Les caractères sont ajoutés par le chemin que parcourt votre code, généralement un navigateur.
Outils gratuits, sans inscription
Calculez le coût avant de payer
Quatre calculateurs basés sur des données réelles, pas sur des approximations : un tokenizer BPE en temps réel, ainsi que des chiffres d'architecture pour 63 modèles à poids ouverts et 34 cartes. Rien à installer, aucun compte requis.
Calculateur de tokens
Ce qu'une requête coûte réellement
Collez n'importe quel texte et voyez comment il est divisé en tokens réels. Découvrez pourquoi la sortie coûte environ cinq fois plus cher que l'entrée, pourquoi le 20e tour d'une conversation coûte trois fois plus que le premier, et pourquoi la même phrase coûte presque deux fois plus cher en swahili.
Tokeniser un texte →Même phrase, même sens. 1.9x plus de tokens.
Ou exécutez-le sur votre propre GPU
Calculateur de VRAM
De combien de VRAM ce modèle a-t-il besoin et qu'est-ce qui tient sur ma carte ? Poids, KV cache et surcharge d'exécution détaillés, avec un curseur à ajuster selon la capacité de votre carte.
Dimensionner un modèle →Recherche de modèle
Quel modèle open-weight exécuter ? Recherchez parmi 63 modèles par taille, licence, capacité, longueur de contexte et mémoire réellement requise.
Trouver un modèle →Recherche de GPU
Quels GPU peuvent exécuter ce modèle ? Classement de 34 cartes selon leur compatibilité, avec estimation des tokens par seconde et prix approximatif, du T4 gratuit sur Colab jusqu'au nœud 8x H100.
Comparer les cartes →Dans la nature
Produits utilisant cette API en production
Logiciels réels, livrés par d'autres personnes, répondant à de vrais utilisateurs via cette passerelle.
Voulez-vous que votre application soit répertoriée ici ?
Rien n'est répertorié pour le moment, donc le premier bénéficie d'un grand espace. Si vous avez livré quelque chose qui utilise cette API, dites-le-nous et nous l'ajouterons.
FAQ
Questions
Existe-t-il une API LLM réellement gratuite ?
Oui. DreamPrompting est gratuit au démarrage, sans carte bancaire. Créez un compte gratuit, obtenez une clé API, et le service route vos requêtes via les niveaux gratuits de nombreux fournisseurs, en retournant une complétion de chat au format standard OpenAI.
Puis-je l'utiliser comme alternative gratuite à ChatGPT ou à l'API GPT ?
Oui. L'endpoint est compatible avec OpenAI, ce qui en fait une alternative gratuite prête à l'emploi pour ChatGPT et l'API OpenAI. Pointez le SDK OpenAI vers notre base URL pour accéder aux modèles de classe GPT et aux modèles open comme Llama 3.3, Gemini, DeepSeek, Qwen et Mistral.
Quels modèles LLM gratuits sont pris en charge ?
Modèles populaires incluant Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command et GPT-OSS, servis via Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio et plus encore.
Guides