API LLM gratuita · Compatibile con OpenAI · 27 provider
Tutti i LLM gratuiti.
Un'unica API.
Prendi una chiave gratuita e chiama Llama, Gemini, DeepSeek, Qwen e altri tramite un unico endpoint compatibile con OpenAI. Quando un provider è occupato, il router esegue il failover su quello successivo. La tua richiesta riceve semplicemente risposta.
Accedi con Google, copia la tua chiave, prima richiesta in meno di un minuto. Oppure copia il prompt e lascia che ChatGPT, Claude o Cursor lo integrino nel tuo progetto.
Una chiave raggiunge tutti questi
12 di 27 provider configurati stanno servendo traffico in questo momento. Il router passa da uno all'altro per ogni richiesta.
27
provider upstream dietro un unico endpoint
12
provider attivi e operativi in questo momento
43,343
richieste servite tramite il router
$0
per richiesta, per chiave, al mese
Guida rapida
Punta il tuo SDK qui.
Qualsiasi cosa che parli l'API Chat Completions di OpenAI funziona. Imposta il
base_url, incolla la tua chiave, fatto.
Ottieni una chiave →
curl https://dreamprompting.com/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "auto",
"messages": [{"role":"user","content":"Hello!"}]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://dreamprompting.com/api/v1",
api_key="YOUR_API_KEY",
)
r = client.chat.completions.create(
model="auto",
messages=[{"role": "user", "content": "Hi"}],
)
print(r.choices[0].message.content)
const r = await fetch("https://dreamprompting.com/api/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
"Authorization": "Bearer YOUR_API_KEY",
},
body: JSON.stringify({
model: "auto",
messages: [{ role: "user", content: "Hi" }],
}),
});
const d = await r.json();
console.log(d.choices[0].message.content);
Fissa un modello con "model": "groq/openai/gpt-oss-120b", oppure usa "auto" per lasciare che il router scelga e faccia il failover. Streaming funziona: passa "stream": true o dell'SDK stream=True. Elenca tutto in /api/v1/models.
Routing
Tabella di routing
Le richieste provano i provider live in ordine e fanno il failover in caso di errori o limiti di velocità. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.
| Provider | Stato | Modelli predefiniti |
|---|---|---|
| Groq | live | openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini |
| Mistral (La Plateforme) | live | mistral-small-latest · open-mistral-nemo · mistral-large-latest |
| NVIDIA NIM | live | nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b |
| NVIDIA NIM Vision | live | meta/llama-3.2-11b-vision-instruct |
| Cohere | live | command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025 |
| Google AI Studio (Gemini) | live | gemini-3.1-flash-lite · gemini-2.5-flash |
| OpenRouter (Ox Alpha preview) | live | stealth/ox-alpha |
| OpenRouter | live | nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free |
| Cloudflare Workers AI | live | @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b |
| Cloudflare Workers AI Vision | live | @cf/meta/llama-4-scout-17b-16e-instruct |
| Hugging Face | live | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Mistral (Codestral) | live | codestral-latest |
| ch.at | live | ch.at |
+ 14 altri provider in fase di attivazione
| Cerebras | presto | gpt-oss-120b · zai-glm-4.7 · gemma-4-31b |
| GitHub Models | presto | openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324 |
| Vercel AI Gateway | presto | openai/gpt-4o-mini · meta/llama-3.3-70b |
| Scaleway | presto | llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506 |
| SambaNova Cloud | presto | Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it |
| Hyperbolic | presto | meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3 |
| Fireworks | presto | accounts/fireworks/models/llama-v3p3-70b-instruct |
| Nebius | presto | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Novita | presto | meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3 |
| Together AI | presto | meta-llama/Llama-3.3-70B-Instruct-Turbo |
| DeepInfra | presto | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Alibaba (Qwen) | presto | qwen-plus · qwen2.5-72b-instruct |
| Upstage (Solar) | presto | solar-pro2 · solar-mini |
| AI21 (Jamba) | presto | jamba-large · jamba-mini |
Modelli
Modelli popolari a $0
DreamPrompting è un'API LLM gratuita compatibile con OpenAI e un'alternativa gratuita drop-in alle API di ChatGPT e OpenAI. Poiché utilizza il formato standard chat completions, puoi chiamare gratuitamente popolari modelli open e di classe GPT: chat, coding, riassunto, estrazione e generazione di contenuti, tutto da un unico endpoint con una sola chiave gratuita.
Alternativa gratuita a ChatGPT / GPT
Modelli di classe GPT e GPT-OSS tramite un endpoint compatibile con OpenAI. Cambia solo la base URL, mantieni il tuo codice.
openai/gpt-oss-120b
API gratuita per Llama 3.3
Meta Llama 3.3 70B e Llama 3.1, erogati tramite NVIDIA NIM e Cloudflare Workers AI.
nvidia/meta/llama-3.3-70b-instruct
API gratuita per Gemini
Google Gemini Flash e Gemma tramite il piano gratuito Google AI Studio, con controllo del thinking.
google/gemini-3.1-flash-lite
API gratuita per DeepSeek
DeepSeek V3 e modelli di ragionamento per coding e attività complesse, senza costi.
nvidia/deepseek-ai/deepseek-v4-pro
API gratuita per Qwen & Mistral
Qwen 2.5, Mistral e Codestral per chat multilingua e generazione di codice.
mistral-small-latest · qwen2.5-72b
Una chiave, failover automatico
Se un provider è occupato o limitato nel rate, il router passa al successivo. La tua app continua a funzionare.
"model": "auto"
Esplora e testa tutto sulla pagina dei modelli, oppure vedi ogni modello AI mai rilasciato.
Claude ora contrassegna i suoi contenuti generati dall'AI
Anthropic ha iniziato a incorporare un watermark impercettibile nel testo generato da Claude e ad allegare metadati di provenienza C2PA firmati a file come .svg, .png e .jpg. Si applica ovunque venga utilizzato Claude, incluse le API e Claude Code. I modelli lanciati nell'UE a partire dal 2 agosto 2026 lo supportano al lancio, mentre per i modelli esistenti è in fase di implementazione.
Fonte: Come Claude contrassegna il contenuto generato dall'IA
Cosa rimuove la nostra API
- Caratteri a larghezza zero e joiner
- Override bidirezionali (CVE-2021-42574)
- Payload di tag Unicode, decodificati in ASCII
- Spazi non separabili e altri spazi bianchi esotici
- Selettori di variazione, trattini opzionali, BOM
Ogni rimozione è segnalata per codepoint e riga, sull'output di qualsiasi modello.
Cosa non rimuove
Il watermark testuale di Claude. Anthropic non pubblica l'algoritmo, ma il comportamento che descrive, che sopravvive a copia e incolla mentre svanisce quando il testo è fortemente modificato, parafrasato o tradotto, è caratteristico di uno schema a livello di token piuttosto che di caratteri nascosti.
Non viene inserito nulla, quindi nulla può essere eliminato. Il nostro scanner segnalerà il file come pulito, ma il segno rimarrà. Lo stesso vale per i metadati C2PA sulle immagini, che questo strumento non tocca affatto.
Preferiamo dirtelo qui piuttosto che farti registrare.
C'è ancora molto che vale la pena intercettare
Incolla un file e visualizza i caratteri a larghezza zero, gli override bidirezionali e i payload di tag nascosti presenti al suo interno, ognuno segnalato per codepoint e riga. Gratuito e funzionante sull'output di qualsiasi modello.
Strumento gratuito, accedi per scansionare
Vedi cosa si nasconde nel tuo codice
Caratteri a larghezza zero, override bidirezionali che fanno visualizzare il codice sorgente in un ordine e compilarlo in un altro, e caratteri tag Unicode che trasportano un payload invisibile. Ogni rimozione è segnalata per codepoint e riga, così puoi verificare la modifica invece di fidarti ciecamente.
Rimuovi watermark
Funziona con ogni modello
La scansione legge i caratteri, non i provider; quindi ChatGPT, Claude, Gemini, Copilot e qualsiasi altro modello vengono analizzati in un unico passaggio senza configurazioni. I payload di tag Unicode nascosti vengono decodificati in ASCII leggibile invece di essere semplicemente contati.
Scansiona il tuo codice →We measured it, 2026-08-12
L'output grezzo del modello è pulito. I caratteri vengono aggiunti dal percorso che il codice segue, solitamente un browser.
Strumenti gratuiti, nessuna registrazione
Calcola il costo prima di pagare
Quattro calcolatori basati su dati reali, non su stime approssimative: un tokenizer BPE live, più dati architetturali per 63 modelli open-weight e 34 schede. Nulla da installare, nessun account richiesto.
Calcolatore di token
Quanto costa realmente una richiesta
Incolla qualsiasi testo e guardalo suddiviso in token reali. Scopri perché l'output costa circa cinque volte l'input, perché il turno 20 di una conversazione costa tre volte il primo turno e perché la stessa frase costa quasi il doppio in swahili.
Tokenizza qualcosa →Stessa frase, stesso significato. 1.9x i token.
Oppure eseguilo sulla tua GPU
Calcolatore VRAM
Quanta VRAM richiede questo modello e cosa entra nella mia? Pesi, KV cache e overhead di runtime suddivisi, con uno slider da trascinare in base alla capacità della tua scheda.
Dimensiona un modello →Ricerca modelli
Quale modello open-weight dovrei eseguire? Cerca tra 63 modelli per dimensione, licenza, capacità, lunghezza del contesto e memoria effettivamente richiesta.
Trova un modello →Ricerca GPU
Quali GPU possono eseguire questo modello? Ognuna delle 34 schede classificate per compatibilità, con stima dei token al secondo e prezzo indicativo, da una T4 gratuita su Colab fino a un nodo 8x H100.
Confronta le schede →In natura
Prodotti che utilizzano questo API in produzione
Software reale, distribuito da altre persone, che risponde a utenti reali attraverso questo gateway.
Vuoi che la tua app sia elencata qui?
Non è ancora elencato nulla, quindi il primo ottiene molto spazio. Se hai distribuito qualcosa che utilizza questo API, informaci e noi lo aggiungeremo.
FAQ
Domande
Esiste un'API LLM veramente gratuita?
Sì. DreamPrompting è gratuito all'avvio senza carta di credito. Crea un account gratuito, ottieni una API key e il sistema instrada la tua richiesta attraverso i piani gratuiti di molti provider, restituendo una chat completion in formato standard OpenAI.
Posso usarlo come alternativa gratuita a ChatGPT o all'API GPT?
Sì. L'endpoint è compatibile con OpenAI, quindi è un'alternativa gratuita immediata all'API di ChatGPT e OpenAI. Punta l'SDK OpenAI verso la nostra base URL per accedere a modelli di classe GPT e modelli aperti come Llama 3.3, Gemini, DeepSeek, Qwen e Mistral.
Quali modelli LLM gratuiti sono supportati?
Modelli popolari inclusi Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command e GPT-OSS, serviti tramite Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio e altri.
Guide