API de LLM gratuita · Compatible con OpenAI · 27 proveedores
Todos los LLM gratuitos.
Una API.
Obtén una clave gratuita y llama a Llama, Gemini, DeepSeek, Qwen y otros a través de un único endpoint compatible con OpenAI. Cuando un proveedor está ocupado, el router redirige al siguiente. Tu solicitud simplemente responde.
Inicia sesión con Google, copia tu clave y realiza tu primera solicitud en menos de un minuto. O copia el prompt y deja que ChatGPT, Claude o Cursor lo integren en tu proyecto.
Una clave llega a todos estos
12 de 27 proveedores configurados están sirviendo tráfico ahora. El router se mueve entre ellos por solicitud.
27
proveedores upstream detrás de un único endpoint
12
proveedores activos y operativos en este momento
43,339
solicitudes servidas a través del router
$0
por solicitud, por clave, por mes
Inicio rápido
Apunta tu SDK aquí.
Cualquier cosa que hable el API de complementos de chat de OpenAI funciona. Establece el
base_url, pega tu clave, listo.
Obtener una clave →
curl https://dreamprompting.com/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "auto",
"messages": [{"role":"user","content":"Hello!"}]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://dreamprompting.com/api/v1",
api_key="YOUR_API_KEY",
)
r = client.chat.completions.create(
model="auto",
messages=[{"role": "user", "content": "Hi"}],
)
print(r.choices[0].message.content)
const r = await fetch("https://dreamprompting.com/api/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
"Authorization": "Bearer YOUR_API_KEY",
},
body: JSON.stringify({
model: "auto",
messages: [{ role: "user", content: "Hi" }],
}),
});
const d = await r.json();
console.log(d.choices[0].message.content);
Fija un modelo con "model": "groq/openai/gpt-oss-120b", o usa "auto" para dejar que el enrutador elija y conmute por error. El streaming funciona: pasa "stream": true o el SDK stream=True. Enumera todo en /api/v1/models.
Enrutamiento
Tabla de rutas
Las solicitudes intentan proveedores en vivo en orden y conmutan por error en caso de errores o límites de velocidad. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.
| Proveedor | Estado | Modelos predeterminados |
|---|---|---|
| Groq | live | openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini |
| Mistral (La Plateforme) | live | mistral-small-latest · open-mistral-nemo · mistral-large-latest |
| NVIDIA NIM | live | nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b |
| NVIDIA NIM Vision | live | meta/llama-3.2-11b-vision-instruct |
| Cohere | live | command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025 |
| Google AI Studio (Gemini) | live | gemini-3.1-flash-lite · gemini-2.5-flash |
| OpenRouter (Ox Alpha preview) | live | stealth/ox-alpha |
| OpenRouter | live | nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free |
| Cloudflare Workers AI | live | @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b |
| Cloudflare Workers AI Vision | live | @cf/meta/llama-4-scout-17b-16e-instruct |
| Hugging Face | live | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Mistral (Codestral) | live | codestral-latest |
| ch.at | live | ch.at |
+ 14 proveedores adicionales en proceso de activación
| Cerebras | próximamente | gpt-oss-120b · zai-glm-4.7 · gemma-4-31b |
| GitHub Models | próximamente | openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324 |
| Vercel AI Gateway | próximamente | openai/gpt-4o-mini · meta/llama-3.3-70b |
| Scaleway | próximamente | llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506 |
| SambaNova Cloud | próximamente | Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it |
| Hyperbolic | próximamente | meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3 |
| Fireworks | próximamente | accounts/fireworks/models/llama-v3p3-70b-instruct |
| Nebius | próximamente | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Novita | próximamente | meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3 |
| Together AI | próximamente | meta-llama/Llama-3.3-70B-Instruct-Turbo |
| DeepInfra | próximamente | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Alibaba (Qwen) | próximamente | qwen-plus · qwen2.5-72b-instruct |
| Upstage (Solar) | próximamente | solar-pro2 · solar-mini |
| AI21 (Jamba) | próximamente | jamba-large · jamba-mini |
Modelos
Modelos populares a $0
DreamPrompting es una API de LLM gratuita compatible con OpenAI y una alternativa directa y gratuita a la API de ChatGPT y OpenAI. Dado que utiliza el formato estándar de chat completions, puede llamar a modelos populares abiertos y de clase GPT de forma gratuita: chat, programación, resumen, extracción y generación de contenido, todo desde un único endpoint con una clave gratuita.
Alternativa gratuita a ChatGPT / GPT
Modelos de clase GPT y GPT-OSS a través de un endpoint compatible con OpenAI. Cambie una base URL y mantenga su código.
openai/gpt-oss-120b
API gratuita de Llama 3.3
Meta Llama 3.3 70B y Llama 3.1, servido a través de NVIDIA NIM y Cloudflare Workers AI.
nvidia/meta/llama-3.3-70b-instruct
API gratuita de Gemini
Google Gemini Flash y Gemma a través del nivel gratuito de Google AI Studio, con control de razonamiento (thinking).
google/gemini-3.1-flash-lite
API gratuita de DeepSeek
DeepSeek V3 y modelos de razonamiento para programación y tareas complejas, sin coste alguno.
nvidia/deepseek-ai/deepseek-v4-pro
API gratuita de Qwen y Mistral
Qwen 2.5, Mistral y Codestral para chat multilingüe y generación de código.
mistral-small-latest · qwen2.5-72b
Una clave, conmutación por error automática
Si un proveedor está ocupado o limitado por tasa, el router pasa al siguiente. Su aplicación sigue funcionando.
"model": "auto"
Explore y pruebe todo en la página de modelos, o vea todos los modelos de IA lanzados hasta la fecha.
Claude ahora marca su contenido generado por IA
Anthropic ha comenzado a incrustar una marca de agua imperceptible en el texto que genera Claude y a adjuntar metadatos de procedencia C2PA firmados a archivos como .svg, .png y .jpg. Se aplica en todas partes donde se utiliza Claude, incluyendo la API y Claude Code. Los modelos lanzados en la UE a partir del 2 de agosto de 2026 lo admiten desde su lanzamiento, y los modelos existentes se describen como en proceso.
Lo que nuestra API elimina
- Caracteres de ancho cero y uniones (joiners)
- Anulaciones bidireccionales (CVE-2021-42574)
- Payloads de etiquetas Unicode, decodificados a ASCII
- Espacios de no separación y otros espacios en blanco exóticos
- Selectores de variación, guiones opcionales, BOMs
Cada eliminación se reporta por codepoint y línea, en la salida de cualquier modelo.
Lo que no elimina
La marca de agua de texto de Claude. Anthropic no publica el algoritmo, pero el comportamiento que describe, que sobrevive a la copia y pegado mientras se desvanece cuando el texto se edita, parafrasea o traduce en gran medida, es característico de un esquema a nivel de token en lugar de caracteres ocultos.
No se inserta nada, por lo que no se puede eliminar nada. Nuestro escáner reportará un archivo como limpio y la marca seguirá ahí. Lo mismo ocurre con los metadatos C2PA en imágenes, que esta herramienta no toca en absoluto.
Preferimos decírselo aquí antes que pedirle que se registre.
Todavía hay mucho que merece la pena detectar
Pegue un archivo y vea los caracteres de ancho cero, las anulaciones bidireccionales y los payloads de etiquetas ocultos que realmente contiene, cada uno reportado por codepoint y línea. Es gratuito y funciona con la salida de cualquier modelo.
Herramienta gratuita, inicie sesión para escanear
Vea lo que se esconde en su código
Caracteres de ancho cero, anulaciones bidireccionales que hacen que el código fuente se muestre en un orden y se compile en otro, y caracteres de etiqueta Unicode que transportan un payload que no se renderiza. Cada eliminación se reporta por codepoint y línea, para que pueda verificar el cambio en lugar de confiar ciegamente.
Eliminador de marcas de agua
Funciona con todos los modelos
El escaneo lee caracteres, no proveedores, por lo que ChatGPT, Claude, Gemini, Copilot y cualquier modelo posterior pasan por un único proceso sin necesidad de configuración. Los payloads de etiquetas Unicode ocultos se decodifican a ASCII legible en lugar de simplemente contarse.
Analizar código →We measured it, 2026-08-12
La salida original del modelo está limpia. Los caracteres se añaden durante el trayecto que sigue el código, generalmente a través del navegador.
Herramientas gratuitas, sin registro
Calcula el coste antes de pagar
Cuatro calculadoras basadas en datos reales, no en estimaciones: un tokenizador BPE en tiempo real, además de datos de arquitectura para 63 modelos de pesos abiertos y 34 tarjetas. Sin instalaciones ni necesidad de cuenta.
Calculadora de tokens
Lo que cuesta realmente una solicitud
Pega cualquier texto y observa cómo se divide en tokens reales. Descubre por qué la salida cuesta unas cinco veces más que la entrada, por qué el turno 20 de una conversación cuesta tres veces más que el primero, y por qué la misma frase cuesta casi el doble en suajili.
Tokenizar texto →Misma frase, mismo significado. 1.9x tokens.
O ejecútalo en tu propia GPU
Calculadora de VRAM
¿Cuánta VRAM necesita este modelo y qué cabe en la mía? Desglose de pesos, KV cache y sobrecarga de ejecución, con un control deslizante para ajustar a la capacidad de tu tarjeta.
Dimensionar modelo →Buscador de modelos
¿Qué modelo de pesos abiertos debería ejecutar? Busca entre 63 modelos por tamaño, licencia, capacidad, longitud de contexto y la memoria que realmente requieren.
Buscar modelo →Buscador de GPU
¿Qué GPUs pueden ejecutar este modelo? Clasificación de 34 tarjetas según compatibilidad, con estimación de tokens por segundo y precio aproximado, desde una T4 gratuita en Colab hasta un nodo de 8x H100.
Comparar tarjetas →En producción
Productos que ejecutan esta API en producción
Software real, enviado por otras personas, que responde a usuarios reales a través de esta puerta de enlace.
¿Quieres que tu aplicación aparezca aquí?
Aún no hay nada listado, así que el primero tendrá mucho espacio. Si has enviado algo que se ejecuta con esta API, dinos y lo añadiremos.
Preguntas frecuentes
Preguntas
¿Existe una API de LLM realmente gratuita?
Sí. DreamPrompting es gratuito para empezar y no requiere tarjeta de crédito. Crea una cuenta gratuita, obtén una API key y el sistema enrutará tu solicitud a través de los niveles gratuitos de varios proveedores, devolviendo una respuesta de chat en formato estándar OpenAI.
¿Puedo usar esto como una alternativa gratuita a ChatGPT o a la API de GPT?
Sí. El endpoint es compatible con OpenAI, por lo que es una alternativa gratuita de sustitución directa para ChatGPT y la API de OpenAI. Configura el SDK de OpenAI con nuestra base URL para acceder a modelos de clase GPT y modelos abiertos como Llama 3.3, Gemini, DeepSeek, Qwen y Mistral.
¿Qué modelos LLM gratuitos son compatibles?
Modelos populares incluyendo Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command y GPT-OSS, servidos a través de Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio y más.
Guías