Kostenlose LLM-API · OpenAI-kompatibel · 27 Anbieter
Alle kostenlosen LLMs.
Eine API.
Holen Sie sich einen kostenlosen Schlüssel und rufen Sie Llama, Gemini, DeepSeek, Qwen und weitere über einen einzigen OpenAI-kompatiblen Endpoint auf. Wenn ein Anbieter ausgelastet ist, leitet der Router die Anfrage automatisch weiter. Ihre Anfrage wird einfach beantwortet.
Mit Google anmelden, Schlüssel kopieren und die erste Anfrage in unter einer Minute stellen. Oder kopieren Sie den Prompt und lassen Sie ChatGPT, Claude oder Cursor ihn in Ihr Projekt einbinden.
Ein Schlüssel reicht für alle diese
12 von 27 konfigurierten Anbietern dienen derzeit Traffic. Der Router wechselt zwischen ihnen pro Anfrage.
27
Upstream-Anbieter hinter einem Endpoint
12
Anbieter aktuell aktiv und verfügbar
43,346
Anfragen über den Router verarbeitet
$0
pro Anfrage, pro Schlüssel, pro Monat
Schnellstart
Verweisen Sie Ihr SDK hierhin.
Alles, was die OpenAI Chat Completions API verwendet, funktioniert. Stelle die
base_url, deinen Schlüssel eingeben, fertig.
Schlüssel erhalten →
curl https://dreamprompting.com/api/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "auto",
"messages": [{"role":"user","content":"Hello!"}]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://dreamprompting.com/api/v1",
api_key="YOUR_API_KEY",
)
r = client.chat.completions.create(
model="auto",
messages=[{"role": "user", "content": "Hi"}],
)
print(r.choices[0].message.content)
const r = await fetch("https://dreamprompting.com/api/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
"Authorization": "Bearer YOUR_API_KEY",
},
body: JSON.stringify({
model: "auto",
messages: [{ role: "user", content: "Hi" }],
}),
});
const d = await r.json();
console.log(d.choices[0].message.content);
Ein Modell mit "model": "groq/openai/gpt-oss-120b", oder verwenden "auto" um den Router auswählen und failover zu lassen. Streaming funktioniert: übergeben "stream": true oder das SDK's stream=True. Alles auflisten bei /api/v1/models.
Routing
Routing-Tabelle
Anfragen versuchen aktive Anbieter in der Reihenfolge und failover bei Fehlern oder Rate-Limits. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.
| Anbieter | Status | Standardmodelle |
|---|---|---|
| Groq | live | openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini |
| Mistral (La Plateforme) | live | mistral-small-latest · open-mistral-nemo · mistral-large-latest |
| NVIDIA NIM | live | nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b |
| NVIDIA NIM Vision | live | meta/llama-3.2-11b-vision-instruct |
| Cohere | live | command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025 |
| Google AI Studio (Gemini) | live | gemini-3.1-flash-lite · gemini-2.5-flash |
| OpenRouter (Ox Alpha preview) | live | stealth/ox-alpha |
| OpenRouter | live | nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free |
| Cloudflare Workers AI | live | @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b |
| Cloudflare Workers AI Vision | live | @cf/meta/llama-4-scout-17b-16e-instruct |
| Hugging Face | live | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Mistral (Codestral) | live | codestral-latest |
| ch.at | live | ch.at |
+ 14 weitere Anbieter werden aktiviert
| Cerebras | in Kürze | gpt-oss-120b · zai-glm-4.7 · gemma-4-31b |
| GitHub Models | in Kürze | openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324 |
| Vercel AI Gateway | in Kürze | openai/gpt-4o-mini · meta/llama-3.3-70b |
| Scaleway | in Kürze | llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506 |
| SambaNova Cloud | in Kürze | Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it |
| Hyperbolic | in Kürze | meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3 |
| Fireworks | in Kürze | accounts/fireworks/models/llama-v3p3-70b-instruct |
| Nebius | in Kürze | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Novita | in Kürze | meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3 |
| Together AI | in Kürze | meta-llama/Llama-3.3-70B-Instruct-Turbo |
| DeepInfra | in Kürze | meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct |
| Alibaba (Qwen) | in Kürze | qwen-plus · qwen2.5-72b-instruct |
| Upstage (Solar) | in Kürze | solar-pro2 · solar-mini |
| AI21 (Jamba) | in Kürze | jamba-large · jamba-mini |
Modelle
Beliebte Modelle für $0
DreamPrompting ist eine kostenlose, OpenAI-kompatible LLM-API und eine direkte, kostenlose Alternative zur ChatGPT- und OpenAI-API. Da sie das Standard-Format für Chat-Completions unterstützt, können Sie beliebte Open-Source- und GPT-Klasse-Modelle kostenlos aufrufen: Chat, Programmierung, Zusammenfassungen, Extraktion und Content-Generierung – alles über einen einzigen Endpoint mit einem kostenlosen API-Key.
Kostenlose ChatGPT / GPT-Alternative
Modelle der GPT-Klasse und GPT-OSS über einen OpenAI-kompatiblen Endpoint. Ändern Sie nur die base URL, behalten Sie Ihren Code.
openai/gpt-oss-120b
Kostenlose Llama 3.3 API
Meta Llama 3.3 70B und Llama 3.1, bereitgestellt über NVIDIA NIM und Cloudflare Workers AI
nvidia/meta/llama-3.3-70b-instruct
Kostenlose Gemini API
Google Gemini Flash und Gemma über den kostenlosen Google AI Studio-Tarif, inklusive Thinking-Kontrolle.
google/gemini-3.1-flash-lite
Kostenlose DeepSeek API
DeepSeek V3 und Reasoning-Modelle für Programmierung und komplexe Aufgaben, ohne Kosten.
nvidia/deepseek-ai/deepseek-v4-pro
Kostenlose Qwen & Mistral API
Qwen 2.5, Mistral und Codestral für mehrsprachigen Chat und Code-Generierung.
mistral-small-latest · qwen2.5-72b
Ein Key, automatisches Failover
Wenn ein Anbieter ausgelastet ist oder ein Rate-Limit erreicht wurde, wechselt der Router zum nächsten. Ihre App funktioniert weiter.
"model": "auto"
Durchsuchen und testen Sie alles auf der Modellseite, oder sehen Sie jedes jemals veröffentlichte KI-Modell.
Claude markiert jetzt seine KI-generierten Inhalte
Anthropic hat damit begonnen, ein unsichtbares Wasserzeichen in von Claude generierte Texte einzubetten und signierte C2PA-Provenienz-Metadaten an Dateien wie .svg, .png und .jpg anzuhängen. Dies gilt überall dort, wo Claude verwendet wird, einschließlich der API und Claude Code. Modelle, die am oder nach dem 2. August 2026 in der EU eingeführt wurden, unterstützen dies ab dem Start; bei bestehenden Modellen ist die Implementierung in Arbeit.
Was unsere API entfernt
- Zero-width-Zeichen und Joiner
- Bidirektionale Overrides (CVE-2021-42574)
- Unicode-Tag-Payloads, zurückdekodiert in ASCII
- No-break- und andere exotische Leerzeichen
- Variationsselektoren, bedingte Trennstriche, BOMs
Jede Entfernung wird nach Codepoint und Zeile gemeldet, bei der Ausgabe jedes Modells.
Was sie nicht entfernt
Claudes Text-Wasserzeichen. Anthropic veröffentlicht den Algorithmus nicht, aber das beschriebene Verhalten, das beim Kopieren und Einfügen überlebt und bei starkem Bearbeiten, Paraphrasieren oder Übersetzen verblasst, ist charakteristisch für ein Token-Level-Schema statt versteckter Zeichen.
Es wird nichts eingefügt, also kann auch nichts gelöscht werden. Unser Scanner meldet eine Datei als sauber, während die Markierung bestehen bleibt. Dasselbe gilt für C2PA-Metadaten in Bildern, die dieses Tool überhaupt nicht berührt.
Wir sagen Ihnen das lieber hier, als Ihre Registrierung entgegenzunehmen.
Es gibt immer noch viel, das es wert ist, gefunden zu werden
Fügen Sie eine Datei ein und sehen Sie die Zero-width-Zeichen, bidirektionalen Overrides und eingeschleusten Tag-Payloads, die tatsächlich enthalten sind – jedes einzeln gemeldet nach Codepoint und Zeile. Kostenlos und funktioniert mit der Ausgabe jedes Modells.
Kostenloses Tool, zum Scannen anmelden
Sehen Sie, was sich in Ihrem Code versteckt
Zero-width-Zeichen, bidirektionale Overrides, die dazu führen, dass Quellcode in einer Reihenfolge angezeigt, aber in einer anderen kompiliert wird, sowie Unicode-Tag-Zeichen, die einen Payload transportieren, der unsichtbar bleibt. Jede Entfernung wird nach Codepoint und Zeile gemeldet, damit Sie die Änderung prüfen können, anstatt ihr blind zu vertrauen.
Wasserzeichen-Entferner
Funktioniert mit jedem Modell
Der Scan liest Zeichen, keine Anbieter. Daher durchlaufen ChatGPT, Claude, Gemini, Copilot und alle nachfolgenden Modelle einen einzigen Durchlauf ohne Konfigurationsaufwand. Eingeschleuste Unicode-Tag-Payloads werden in lesbares ASCII zurückdekodiert, anstatt sie nur zu zählen.
Code scannen →We measured it, 2026-08-12
Die rohe Modellausgabe ist sauber. Die Zeichen werden auf dem Übertragungsweg hinzugefügt, meist durch den Browser.
Kostenlose Tools, keine Registrierung
Kosten vorab kalkulieren
Vier Rechner auf Basis echter Daten statt Daumenregeln: ein Live-BPE-Tokenizer sowie Architekturdaten für 63 Open-Weight-Modelle und 34 Karten. Keine Installation, kein Konto erforderlich.
Token-Rechner
Was eine Anfrage wirklich kostet
Fügen Sie einen beliebigen Text ein und sehen Sie, wie er in echte Tokens zerlegt wird. Verstehen Sie, warum die Ausgabe etwa das Fünffache der Eingabe kostet, warum der 20. Turn einer Konversation dreimal so viel kostet wie der erste und warum derselbe Satz auf Swahili fast doppelt so viel kostet.
Text tokenisieren →Gleicher Satz, gleiche Bedeutung. 1.9x so viele Tokens.
Oder auf der eigenen GPU ausführen
VRAM-Rechner
Wie viel VRAM benötigt dieses Modell und was passt auf meine Karte? Gewichtungen, KV cache und Laufzeit-Overhead aufgeschlüsselt, mit einem Schieberegler für die Kapazität Ihrer Karte.
Modellgröße bestimmen →Modell-Finder
Welches Open-Weight-Modell soll ich ausführen? Durchsuchen Sie 63 Modelle nach Größe, Lizenz, Fähigkeiten, Kontextlänge und dem tatsächlich benötigten Speicher.
Modell finden →GPU-Finder
Welche GPUs können dieses Modell ausführen? Alle 34 Karten bewertet nach Eignung, geschätzten Tokens pro Sekunde und Richtpreis, von einer kostenlosen Colab T4 bis zu einem 8x H100 Node.
Karten vergleichen →In der Praxis
Produkte, die auf dieser API in der Produktion ausgeführt werden
Echtes Software, von anderen Menschen ausgeliefert, das reale Benutzer über dieses Gateway bedient.
Möchten Sie Ihre App hier auflisten?
Noch nichts ist aufgelistet, also erhält der Erste viel Platz. Wenn Sie etwas ausgeliefert haben, das auf dieser API läuft, teilen Sie es uns mit und wir werden es hinzufügen.
FAQ
Fragen
Gibt es eine wirklich kostenlose LLM API?
Ja. DreamPrompting ist ohne Kreditkarte kostenlos nutzbar. Erstellen Sie ein kostenloses Konto, erhalten Sie einen API-Key und Ihre Anfragen werden über die kostenlosen Kontingente verschiedener Anbieter geroutet, wobei eine standardmäßige OpenAI-konforme Chat-Completion zurückgegeben wird.
Kann ich dies als kostenlose Alternative zu ChatGPT oder der GPT API nutzen?
Ja. Der Endpoint ist OpenAI-kompatibel und somit eine kostenlose Drop-in-Alternative zur ChatGPT- und OpenAI-API. Richten Sie das OpenAI SDK auf unsere base URL, um GPT-Klasse-Modelle sowie Open-Models wie Llama 3.3, Gemini, DeepSeek, Qwen und Mistral zu erreichen.
Welche kostenlosen LLM-Modelle werden unterstützt?
Beliebte Modelle wie Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command und GPT-OSS, bereitgestellt über Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio und weitere.
Anleitungen