API LLM gratuita · Compatibile con OpenAI · 27 provider

Tutti i LLM gratuiti. Un'unica API.

Prendi una chiave gratuita e chiama Llama, Gemini, DeepSeek, Qwen e altri tramite un unico endpoint compatibile con OpenAI. Quando un provider è occupato, il router esegue il failover su quello successivo. La tua richiesta riceve semplicemente risposta.

Accedi con Google, copia la tua chiave, prima richiesta in meno di un minuto. Oppure copia il prompt e lascia che ChatGPT, Claude o Cursor lo integrino nel tuo progetto.

dreamprompting-router · POST /api/v1/chat/completions demo


        
        
Traccia simulata. Le tue richieste vengono eseguite dal vivo. ottieni una chiave →
Compatibile con OpenAI Nessuna carta di credito Failover automatico

Una chiave raggiunge tutti questi

Groq Mistral NVIDIA NIM NVIDIA NIM Vision Cohere Google AI Studio OpenRouter Cloudflare Workers AI Cloudflare Workers AI Vision Hugging Face ch.at

12 di 27 provider configurati stanno servendo traffico in questo momento. Il router passa da uno all'altro per ogni richiesta.

27

provider upstream dietro un unico endpoint

12

provider attivi e operativi in questo momento

43,343

richieste servite tramite il router

$0

per richiesta, per chiave, al mese

Realizzato con DreamPrompting

Prodotti in esecuzione su questa API in produzione.

Guida rapida

Punta il tuo SDK qui.

Qualsiasi cosa che parli l'API Chat Completions di OpenAI funziona. Imposta il base_url, incolla la tua chiave, fatto. Ottieni una chiave →

curl https://dreamprompting.com/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role":"user","content":"Hello!"}]
  }'

Fissa un modello con "model": "groq/openai/gpt-oss-120b", oppure usa "auto" per lasciare che il router scelga e faccia il failover. Streaming funziona: passa "stream": true o dell'SDK stream=True. Elenca tutto in /api/v1/models.

Routing

Tabella di routing

Le richieste provano i provider live in ordine e fanno il failover in caso di errori o limiti di velocità. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.

Provider Stato Modelli predefiniti
Groq live openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini
Mistral (La Plateforme) live mistral-small-latest · open-mistral-nemo · mistral-large-latest
NVIDIA NIM live nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b
NVIDIA NIM Vision live meta/llama-3.2-11b-vision-instruct
Cohere live command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025
Google AI Studio (Gemini) live gemini-3.1-flash-lite · gemini-2.5-flash
OpenRouter (Ox Alpha preview) live stealth/ox-alpha
OpenRouter live nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free
Cloudflare Workers AI live @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b
Cloudflare Workers AI Vision live @cf/meta/llama-4-scout-17b-16e-instruct
Hugging Face live meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Mistral (Codestral) live codestral-latest
ch.at live ch.at
+ 14 altri provider in fase di attivazione
Cerebras presto gpt-oss-120b · zai-glm-4.7 · gemma-4-31b
GitHub Models presto openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324
Vercel AI Gateway presto openai/gpt-4o-mini · meta/llama-3.3-70b
Scaleway presto llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506
SambaNova Cloud presto Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it
Hyperbolic presto meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3
Fireworks presto accounts/fireworks/models/llama-v3p3-70b-instruct
Nebius presto meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Novita presto meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3
Together AI presto meta-llama/Llama-3.3-70B-Instruct-Turbo
DeepInfra presto meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Alibaba (Qwen) presto qwen-plus · qwen2.5-72b-instruct
Upstage (Solar) presto solar-pro2 · solar-mini
AI21 (Jamba) presto jamba-large · jamba-mini

Modelli

Modelli popolari a $0

DreamPrompting è un'API LLM gratuita compatibile con OpenAI e un'alternativa gratuita drop-in alle API di ChatGPT e OpenAI. Poiché utilizza il formato standard chat completions, puoi chiamare gratuitamente popolari modelli open e di classe GPT: chat, coding, riassunto, estrazione e generazione di contenuti, tutto da un unico endpoint con una sola chiave gratuita.

Alternativa gratuita a ChatGPT / GPT

Modelli di classe GPT e GPT-OSS tramite un endpoint compatibile con OpenAI. Cambia solo la base URL, mantieni il tuo codice.

openai/gpt-oss-120b

API gratuita per Llama 3.3

Meta Llama 3.3 70B e Llama 3.1, erogati tramite NVIDIA NIM e Cloudflare Workers AI.

nvidia/meta/llama-3.3-70b-instruct

API gratuita per Gemini

Google Gemini Flash e Gemma tramite il piano gratuito Google AI Studio, con controllo del thinking.

google/gemini-3.1-flash-lite

API gratuita per DeepSeek

DeepSeek V3 e modelli di ragionamento per coding e attività complesse, senza costi.

nvidia/deepseek-ai/deepseek-v4-pro

API gratuita per Qwen & Mistral

Qwen 2.5, Mistral e Codestral per chat multilingua e generazione di codice.

mistral-small-latest · qwen2.5-72b

Una chiave, failover automatico

Se un provider è occupato o limitato nel rate, il router passa al successivo. La tua app continua a funzionare.

"model": "auto"

Esplora e testa tutto sulla pagina dei modelli, oppure vedi ogni modello AI mai rilasciato.

Annunciato Anthropic, agosto 2026

Claude ora contrassegna i suoi contenuti generati dall'AI

Anthropic ha iniziato a incorporare un watermark impercettibile nel testo generato da Claude e ad allegare metadati di provenienza C2PA firmati a file come .svg, .png e .jpg. Si applica ovunque venga utilizzato Claude, incluse le API e Claude Code. I modelli lanciati nell'UE a partire dal 2 agosto 2026 lo supportano al lancio, mentre per i modelli esistenti è in fase di implementazione.

Fonte: Come Claude contrassegna il contenuto generato dall'IA

Cosa rimuove la nostra API

  • Caratteri a larghezza zero e joiner
  • Override bidirezionali (CVE-2021-42574)
  • Payload di tag Unicode, decodificati in ASCII
  • Spazi non separabili e altri spazi bianchi esotici
  • Selettori di variazione, trattini opzionali, BOM

Ogni rimozione è segnalata per codepoint e riga, sull'output di qualsiasi modello.

Cosa non rimuove

Il watermark testuale di Claude. Anthropic non pubblica l'algoritmo, ma il comportamento che descrive, che sopravvive a copia e incolla mentre svanisce quando il testo è fortemente modificato, parafrasato o tradotto, è caratteristico di uno schema a livello di token piuttosto che di caratteri nascosti.

Non viene inserito nulla, quindi nulla può essere eliminato. Il nostro scanner segnalerà il file come pulito, ma il segno rimarrà. Lo stesso vale per i metadati C2PA sulle immagini, che questo strumento non tocca affatto.

Preferiamo dirtelo qui piuttosto che farti registrare.

C'è ancora molto che vale la pena intercettare

Incolla un file e visualizza i caratteri a larghezza zero, gli override bidirezionali e i payload di tag nascosti presenti al suo interno, ognuno segnalato per codepoint e riga. Gratuito e funzionante sull'output di qualsiasi modello.

Strumento gratuito, accedi per scansionare

Vedi cosa si nasconde nel tuo codice

Caratteri a larghezza zero, override bidirezionali che fanno visualizzare il codice sorgente in un ordine e compilarlo in un altro, e caratteri tag Unicode che trasportano un payload invisibile. Ogni rimozione è segnalata per codepoint e riga, così puoi verificare la modifica invece di fidarti ciecamente.

Rimuovi watermark

Funziona con ogni modello

La scansione legge i caratteri, non i provider; quindi ChatGPT, Claude, Gemini, Copilot e qualsiasi altro modello vengono analizzati in un unico passaggio senza configurazioni. I payload di tag Unicode nascosti vengono decodificati in ASCII leggibile invece di essere semplicemente contati.

Scansiona il tuo codice →

We measured it, 2026-08-12

chiamate di generazione codice 68
target dei modelli 17
conteneva un carattere nascosto 0

L'output grezzo del modello è pulito. I caratteri vengono aggiunti dal percorso che il codice segue, solitamente un browser.

Strumenti gratuiti, nessuna registrazione

Calcola il costo prima di pagare

Quattro calcolatori basati su dati reali, non su stime approssimative: un tokenizer BPE live, più dati architetturali per 63 modelli open-weight e 34 schede. Nulla da installare, nessun account richiesto.

Calcolatore di token

Quanto costa realmente una richiesta

Incolla qualsiasi testo e guardalo suddiviso in token reali. Scopri perché l'output costa circa cinque volte l'input, perché il turno 20 di una conversazione costa tre volte il primo turno e perché la stessa frase costa quasi il doppio in swahili.

Tokenizza qualcosa →
Inglese 8
Swahili 15

Stessa frase, stesso significato. 1.9x i token.

Oppure eseguilo sulla tua GPU

In natura

Prodotti che utilizzano questo API in produzione

Software reale, distribuito da altre persone, che risponde a utenti reali attraverso questo gateway.

Vuoi che la tua app sia elencata qui?

Non è ancora elencato nulla, quindi il primo ottiene molto spazio. Se hai distribuito qualcosa che utilizza questo API, informaci e noi lo aggiungeremo.

Arriva direttamente a un essere umano. Nulla viene pubblicato fino a quando non lo abbiamo esaminato.

FAQ

Domande

Esiste un'API LLM veramente gratuita?

Sì. DreamPrompting è gratuito all'avvio senza carta di credito. Crea un account gratuito, ottieni una API key e il sistema instrada la tua richiesta attraverso i piani gratuiti di molti provider, restituendo una chat completion in formato standard OpenAI.

Posso usarlo come alternativa gratuita a ChatGPT o all'API GPT?

Sì. L'endpoint è compatibile con OpenAI, quindi è un'alternativa gratuita immediata all'API di ChatGPT e OpenAI. Punta l'SDK OpenAI verso la nostra base URL per accedere a modelli di classe GPT e modelli aperti come Llama 3.3, Gemini, DeepSeek, Qwen e Mistral.

Quali modelli LLM gratuiti sono supportati?

Modelli popolari inclusi Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command e GPT-OSS, serviti tramite Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio e altri.

Guide

Approfondisci

Tutte le guide →