API de LLM gratuita · Compatível com OpenAI · 27 provedores

Todos os LLMs gratuitos. Uma API.

Pegue uma chave gratuita e chame Llama, Gemini, DeepSeek, Qwen e outros através de um único endpoint compatível com OpenAI. Quando um provedor está ocupado, o roteador faz failover para o próximo. Sua solicitação simplesmente responde.

Obter sua chave gratuita Ler a documentação

Faça login com Google, copie sua chave, primeira solicitação em menos de um minuto. Ou copie o prompt e deixe o ChatGPT, Claude ou Cursor integrá-lo ao seu projeto para você.

dreamprompting-router · POST /api/v1/chat/completions demo


        
        
Rastreamento simulado. Suas solicitações são executadas ao vivo. obter uma chave →
OpenAI-compatible Sem cartão de crédito Failover automático

Uma chave alcança todos estes

Groq Mistral NVIDIA NIM NVIDIA NIM Vision Cohere Google AI Studio OpenRouter Cloudflare Workers AI Cloudflare Workers AI Vision Hugging Face ch.at

12 de 27 provedores configurados estão servindo tráfego agora. O roteador alternar entre eles a cada requisição.

27

provedores upstream atrás de um endpoint

12

provedores ativos e servindo agora

43,344

solicitações atendidas pelo roteador

$0

por solicitação, por chave, por mês

Desenvolvido com DreamPrompting

Produtos em execução nesta API em produção.

Início rápido

Aponte seu SDK para cá.

Qualquer coisa que fale a API OpenAI Chat Completions funciona. Defina o base_url, cole sua chave, pronto. Obter uma chave →

curl https://dreamprompting.com/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role":"user","content":"Hello!"}]
  }'

Fixar um modelo com "model": "groq/openai/gpt-oss-120b", ou use "auto" para deixar o roteador escolher e fazer failover. Streaming funciona: passe "stream": true ou o SDK's stream=True. Liste tudo em /api/v1/models.

Roteamento

A tabela de rotas

As solicitações tentam os provedores ativos em ordem e fazem failover em caso de erros ou limites de taxa. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.

Provedor Status Modelos padrão
Groq live openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini
Mistral (La Plateforme) live mistral-small-latest · open-mistral-nemo · mistral-large-latest
NVIDIA NIM live nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b
NVIDIA NIM Vision live meta/llama-3.2-11b-vision-instruct
Cohere live command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025
Google AI Studio (Gemini) live gemini-3.1-flash-lite · gemini-2.5-flash
OpenRouter (Ox Alpha preview) live stealth/ox-alpha
OpenRouter live nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free
Cloudflare Workers AI live @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b
Cloudflare Workers AI Vision live @cf/meta/llama-4-scout-17b-16e-instruct
Hugging Face live meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Mistral (Codestral) live codestral-latest
ch.at live ch.at
+ 14 mais provedores sendo habilitados
Cerebras em breve gpt-oss-120b · zai-glm-4.7 · gemma-4-31b
GitHub Models em breve openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324
Vercel AI Gateway em breve openai/gpt-4o-mini · meta/llama-3.3-70b
Scaleway em breve llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506
SambaNova Cloud em breve Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it
Hyperbolic em breve meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3
Fireworks em breve accounts/fireworks/models/llama-v3p3-70b-instruct
Nebius em breve meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Novita em breve meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3
Together AI em breve meta-llama/Llama-3.3-70B-Instruct-Turbo
DeepInfra em breve meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Alibaba (Qwen) em breve qwen-plus · qwen2.5-72b-instruct
Upstage (Solar) em breve solar-pro2 · solar-mini
AI21 (Jamba) em breve jamba-large · jamba-mini

Modelos

Modelos populares a $0

DreamPrompting é uma API de LLM gratuita e compatível com OpenAI, servindo como uma alternativa gratuita e de fácil integração à API do ChatGPT e da OpenAI. Como utiliza o formato padrão de chat completions, você pode chamar modelos populares open source e de classe GPT gratuitamente: chat, codificação, sumarização, extração e geração de conteúdo, tudo a partir de um único endpoint com uma chave gratuita.

Alternativa gratuita ao ChatGPT / GPT

Modelos de classe GPT e GPT-OSS através de um endpoint compatível com OpenAI. Troque apenas a base URL e mantenha seu código.

openai/gpt-oss-120b

API gratuita para Llama 3.3

Meta Llama 3.3 70B e Llama 3.1, servidos através da NVIDIA NIM e Cloudflare Workers AI.

nvidia/meta/llama-3.3-70b-instruct

API gratuita para Gemini

Google Gemini Flash e Gemma através do nível gratuito do Google AI Studio, com controle de raciocínio.

google/gemini-3.1-flash-lite

API gratuita para DeepSeek

DeepSeek V3 e modelos de raciocínio para codificação e tarefas complexas, sem custo.

nvidia/deepseek-ai/deepseek-v4-pro

API gratuita para Qwen & Mistral

Qwen 2.5, Mistral e Codestral para chat multilíngue e geração de código.

mistral-small-latest · qwen2.5-72b

Uma chave, failover automático

Se um provedor estiver ocupado ou com limite de taxa excedido, o roteador muda para o próximo. Seu aplicativo continua funcionando.

"model": "auto"

Navegue e teste tudo na página de modelos, ou veja todos os modelos de IA já lançados.

Anunciado Anthropic, agosto de 2026

Claude agora marca seu conteúdo gerado por IA

A Anthropic começou a incorporar uma marca d'água imperceptível no texto gerado pelo Claude e a anexar metadados de proveniência C2PA assinados a arquivos como .svg, .png e .jpg. Isso se aplica a todos os locais onde o Claude é usado, incluindo a API e o Claude Code. Modelos lançados na UE em ou após 2 de agosto de 2026 suportam isso desde o lançamento, e os modelos existentes estão em processo de implementação.

Fonte: Como o Claude marca o conteúdo gerado por IA

O que nossa API remove

  • Caracteres de largura zero e joiners
  • Substituições bidirecionais (CVE-2021-42574)
  • Payloads de tags Unicode, decodificados de volta para ASCII
  • Espaços não separáveis e outros espaços em branco exóticos
  • Seletores de variação, hifens opcionais, BOMs

Cada remoção é relatada por codepoint e linha, na saída de qualquer modelo.

O que ela não remove

Marca d'água de texto do Claude. A Anthropic não publica o algoritmo, mas o comportamento que descreve, que sobrevive a cópia e colagem enquanto desaparece quando o texto é muito editado, parfraseado ou traduzido, é característico de um esquema em nível de token, em vez de caracteres ocultos.

Nada é inserido, portanto nada pode ser excluído. Nosso scanner relatará um arquivo como limpo e a marca ainda estará lá. O mesmo vale para metadados C2PA em imagens, que esta ferramenta não altera de forma alguma.

Preferimos informar isso aqui do que solicitar seu cadastro.

Ainda há muito que vale a pena detectar

Cole um arquivo e veja os caracteres de largura zero, substituições bidirecionais e payloads de tags ocultos que realmente estão nele, cada um relatado por codepoint e linha. Gratuito, e funciona na saída de qualquer modelo.

Ferramenta gratuita, faça login para escanear

Veja o que está escondido no seu código

Caracteres de largura zero, substituições bidirecionais que fazem o código-fonte ser exibido em uma ordem e compilado em outra, e caracteres de tag Unicode carregando um payload que não é renderizado. Cada remoção é relatada por codepoint e linha, para que você possa verificar a alteração em vez de apenas confiar nela.

Removedor de marca d'água

Funciona com todos os modelos

O escaneamento lê caracteres, não provedores, então ChatGPT, Claude, Gemini, Copilot e qualquer outro passam por uma única verificação sem necessidade de configuração. Payloads de tags Unicode ocultos são decodificados de volta para ASCII legível em vez de apenas contados.

Escanear seu código →

We measured it, 2026-08-12

chamadas de geração de código 68
modelos alvo 17
continha um caractere oculto 0

A saída bruta do modelo está limpa. Os caracteres são adicionados pelo caminho que seu código percorre, que geralmente é um navegador.

Ferramentas gratuitas, sem cadastro

Calcule o custo antes de pagar

Quatro calculadoras baseadas em dados reais, não em estimativas: um tokenizer BPE em tempo real, além de dados de arquitetura para 63 modelos de pesos abertos e 34 placas. Nada para instalar, sem necessidade de conta.

Calculadora de tokens

Quanto uma requisição realmente custa

Cole qualquer texto e veja-o ser dividido em tokens reais. Entenda por que a saída custa cerca de cinco vezes a entrada, por que o turno 20 de uma conversa custa três vezes o turno 1, e por que a mesma frase custa quase o dobro em suaíli.

Tokenizar algo →
Inglês 8
Suaíli 15

Mesma frase, mesmo significado. 1.9x os tokens.

Ou execute em sua própria GPU

No ambiente selvagem

Produtos em execução neste API em produção

Software real, enviado por outras pessoas, respondendo a usuários reais por meio deste gateway.

Deseja que seu aplicativo seja listado aqui?

Nada está listado ainda, então o primeiro recebe muito espaço. Se você enviou algo que executa nesta API, informe-nos e adicionaremos.

Vai direto para um humano. Nada é publicado até que tenhamos analisado.

FAQ

Perguntas

Existe uma API de LLM verdadeiramente gratuita?

Sim. O DreamPrompting é gratuito para começar, sem necessidade de cartão de crédito. Crie uma conta gratuita, obtenha uma API key e ele roteia sua requisição pelos níveis gratuitos de vários provedores, retornando uma chat completion no padrão OpenAI.

Posso usar isto como uma alternativa gratuita ao ChatGPT ou à API GPT?

Sim. O endpoint é compatível com OpenAI, portanto é uma alternativa gratuita de substituição para o ChatGPT e a API OpenAI. Aponte o SDK da OpenAI para nossa base URL para acessar modelos de classe GPT e modelos abertos como Llama 3.3, Gemini, DeepSeek, Qwen e Mistral.

Quais modelos de LLM gratuitos são suportados?

Modelos populares incluindo Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command e GPT-OSS, servidos através de Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio e outros.

Guias

Aprofundar

Todos os guias →