API de LLM gratuita · Compatível com OpenAI · 27 provedores
Todos os LLMs gratuitos.
Uma API.
Pegue uma chave gratuita e chame Llama, Gemini, DeepSeek, Qwen e outros através de um único endpoint compatível com OpenAI. Quando um provedor está ocupado, o roteador faz failover para o próximo. Sua solicitação simplesmente responde.
Faça login com Google, copie sua chave, primeira solicitação em menos de um minuto. Ou copie o prompt e deixe o ChatGPT, Claude ou Cursor integrá-lo ao seu projeto para você.
Uma chave alcança todos estes
12 de 27 provedores configurados estão servindo tráfego agora. O roteador alternar entre eles a cada requisição.
27
provedores upstream atrás de um endpoint
12
provedores ativos e servindo agora
43,344
solicitações atendidas pelo roteador
$0
por solicitação, por chave, por mês
Início rápido
Aponte seu SDK para cá.
Qualquer coisa que fale a API OpenAI Chat Completions funciona. Defina o
base_url, cole sua chave, pronto.
Obter uma chave →
curl https://dreamprompting.com/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "auto",
"messages": [{"role":"user","content":"Hello!"}]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://dreamprompting.com/api/v1",
api_key="YOUR_API_KEY",
)
r = client.chat.completions.create(
model="auto",
messages=[{"role": "user", "content": "Hi"}],
)
print(r.choices[0].message.content)
const r = await fetch("https://dreamprompting.com/api/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
"Authorization": "Bearer YOUR_API_KEY",
},
body: JSON.stringify({
model: "auto",
messages: [{ role: "user", content: "Hi" }],
}),
});
const d = await r.json();
console.log(d.choices[0].message.content);
Fixar um modelo com "model": "groq/openai/gpt-oss-120b", ou use "auto" para deixar o roteador escolher e fazer failover. Streaming funciona: passe "stream": true ou o SDK's stream=True. Liste tudo em /api/v1/models.
Roteamento
A tabela de rotas
As solicitações tentam os provedores ativos em ordem e fazem failover em caso de erros ou limites de taxa. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.
| Provedor | Status | Modelos padrão |
|---|---|---|
| Groq | live | openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini |
| Mistral (La Plateforme) | live | mistral-small-latest · open-mistral-nemo · mistral-large-latest |
| NVIDIA NIM | live | nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b |
| NVIDIA NIM Vision | live | meta/llama-3.2-11b-vision-instruct |
| Cohere | live | command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025 |
| Google AI Studio (Gemini) | live | gemini-3.1-flash-lite · gemini-2.5-flash |
| OpenRouter (Ox Alpha preview) | live | stealth/ox-alpha |
| OpenRouter | live | nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free |
| Cloudflare Workers AI | live | @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b |
| Cloudflare Workers AI Vision | live | @cf/meta/llama-4-scout-17b-16e-instruct |
| Hugging Face | live | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Mistral (Codestral) | live | codestral-latest |
| ch.at | live | ch.at |
+ 14 mais provedores sendo habilitados
| Cerebras | em breve | gpt-oss-120b · zai-glm-4.7 · gemma-4-31b |
| GitHub Models | em breve | openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324 |
| Vercel AI Gateway | em breve | openai/gpt-4o-mini · meta/llama-3.3-70b |
| Scaleway | em breve | llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506 |
| SambaNova Cloud | em breve | Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it |
| Hyperbolic | em breve | meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3 |
| Fireworks | em breve | accounts/fireworks/models/llama-v3p3-70b-instruct |
| Nebius | em breve | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Novita | em breve | meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3 |
| Together AI | em breve | meta-llama/Llama-3.3-70B-Instruct-Turbo |
| DeepInfra | em breve | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Alibaba (Qwen) | em breve | qwen-plus · qwen2.5-72b-instruct |
| Upstage (Solar) | em breve | solar-pro2 · solar-mini |
| AI21 (Jamba) | em breve | jamba-large · jamba-mini |
Modelos
Modelos populares a $0
DreamPrompting é uma API de LLM gratuita e compatível com OpenAI, servindo como uma alternativa gratuita e de fácil integração à API do ChatGPT e da OpenAI. Como utiliza o formato padrão de chat completions, você pode chamar modelos populares open source e de classe GPT gratuitamente: chat, codificação, sumarização, extração e geração de conteúdo, tudo a partir de um único endpoint com uma chave gratuita.
Alternativa gratuita ao ChatGPT / GPT
Modelos de classe GPT e GPT-OSS através de um endpoint compatível com OpenAI. Troque apenas a base URL e mantenha seu código.
openai/gpt-oss-120b
API gratuita para Llama 3.3
Meta Llama 3.3 70B e Llama 3.1, servidos através da NVIDIA NIM e Cloudflare Workers AI.
nvidia/meta/llama-3.3-70b-instruct
API gratuita para Gemini
Google Gemini Flash e Gemma através do nível gratuito do Google AI Studio, com controle de raciocínio.
google/gemini-3.1-flash-lite
API gratuita para DeepSeek
DeepSeek V3 e modelos de raciocínio para codificação e tarefas complexas, sem custo.
nvidia/deepseek-ai/deepseek-v4-pro
API gratuita para Qwen & Mistral
Qwen 2.5, Mistral e Codestral para chat multilíngue e geração de código.
mistral-small-latest · qwen2.5-72b
Uma chave, failover automático
Se um provedor estiver ocupado ou com limite de taxa excedido, o roteador muda para o próximo. Seu aplicativo continua funcionando.
"model": "auto"
Navegue e teste tudo na página de modelos, ou veja todos os modelos de IA já lançados.
Claude agora marca seu conteúdo gerado por IA
A Anthropic começou a incorporar uma marca d'água imperceptível no texto gerado pelo Claude e a anexar metadados de proveniência C2PA assinados a arquivos como .svg, .png e .jpg. Isso se aplica a todos os locais onde o Claude é usado, incluindo a API e o Claude Code. Modelos lançados na UE em ou após 2 de agosto de 2026 suportam isso desde o lançamento, e os modelos existentes estão em processo de implementação.
O que nossa API remove
- Caracteres de largura zero e joiners
- Substituições bidirecionais (CVE-2021-42574)
- Payloads de tags Unicode, decodificados de volta para ASCII
- Espaços não separáveis e outros espaços em branco exóticos
- Seletores de variação, hifens opcionais, BOMs
Cada remoção é relatada por codepoint e linha, na saída de qualquer modelo.
O que ela não remove
Marca d'água de texto do Claude. A Anthropic não publica o algoritmo, mas o comportamento que descreve, que sobrevive a cópia e colagem enquanto desaparece quando o texto é muito editado, parfraseado ou traduzido, é característico de um esquema em nível de token, em vez de caracteres ocultos.
Nada é inserido, portanto nada pode ser excluído. Nosso scanner relatará um arquivo como limpo e a marca ainda estará lá. O mesmo vale para metadados C2PA em imagens, que esta ferramenta não altera de forma alguma.
Preferimos informar isso aqui do que solicitar seu cadastro.
Ainda há muito que vale a pena detectar
Cole um arquivo e veja os caracteres de largura zero, substituições bidirecionais e payloads de tags ocultos que realmente estão nele, cada um relatado por codepoint e linha. Gratuito, e funciona na saída de qualquer modelo.
Ferramenta gratuita, faça login para escanear
Veja o que está escondido no seu código
Caracteres de largura zero, substituições bidirecionais que fazem o código-fonte ser exibido em uma ordem e compilado em outra, e caracteres de tag Unicode carregando um payload que não é renderizado. Cada remoção é relatada por codepoint e linha, para que você possa verificar a alteração em vez de apenas confiar nela.
Removedor de marca d'água
Funciona com todos os modelos
O escaneamento lê caracteres, não provedores, então ChatGPT, Claude, Gemini, Copilot e qualquer outro passam por uma única verificação sem necessidade de configuração. Payloads de tags Unicode ocultos são decodificados de volta para ASCII legível em vez de apenas contados.
Escanear seu código →We measured it, 2026-08-12
A saída bruta do modelo está limpa. Os caracteres são adicionados pelo caminho que seu código percorre, que geralmente é um navegador.
Ferramentas gratuitas, sem cadastro
Calcule o custo antes de pagar
Quatro calculadoras baseadas em dados reais, não em estimativas: um tokenizer BPE em tempo real, além de dados de arquitetura para 63 modelos de pesos abertos e 34 placas. Nada para instalar, sem necessidade de conta.
Calculadora de tokens
Quanto uma requisição realmente custa
Cole qualquer texto e veja-o ser dividido em tokens reais. Entenda por que a saída custa cerca de cinco vezes a entrada, por que o turno 20 de uma conversa custa três vezes o turno 1, e por que a mesma frase custa quase o dobro em suaíli.
Tokenizar algo →Mesma frase, mesmo significado. 1.9x os tokens.
Ou execute em sua própria GPU
Calculadora de VRAM
Quanta VRAM este modelo precisa e o que cabe na minha? Pesos, KV cache e overhead de runtime detalhados, com um slider que você arrasta para a capacidade da sua placa.
Dimensionar um modelo →Localizador de modelos
Qual modelo de pesos abertos devo executar? Pesquise 63 modelos por tamanho, licença, capacidade, tamanho de contexto e a memória que eles realmente exigem.
Encontrar um modelo →Localizador de GPU
Quais GPUs podem executar este modelo? Cada uma das 34 placas classificadas por compatibilidade, com estimativa de tokens por segundo e preço aproximado, desde uma T4 gratuita no Colab até um nó 8x H100.
Comparar placas →No ambiente selvagem
Produtos em execução neste API em produção
Software real, enviado por outras pessoas, respondendo a usuários reais por meio deste gateway.
Deseja que seu aplicativo seja listado aqui?
Nada está listado ainda, então o primeiro recebe muito espaço. Se você enviou algo que executa nesta API, informe-nos e adicionaremos.
FAQ
Perguntas
Existe uma API de LLM verdadeiramente gratuita?
Sim. O DreamPrompting é gratuito para começar, sem necessidade de cartão de crédito. Crie uma conta gratuita, obtenha uma API key e ele roteia sua requisição pelos níveis gratuitos de vários provedores, retornando uma chat completion no padrão OpenAI.
Posso usar isto como uma alternativa gratuita ao ChatGPT ou à API GPT?
Sim. O endpoint é compatível com OpenAI, portanto é uma alternativa gratuita de substituição para o ChatGPT e a API OpenAI. Aponte o SDK da OpenAI para nossa base URL para acessar modelos de classe GPT e modelos abertos como Llama 3.3, Gemini, DeepSeek, Qwen e Mistral.
Quais modelos de LLM gratuitos são suportados?
Modelos populares incluindo Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command e GPT-OSS, servidos através de Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio e outros.
Guias