Kostenlose LLM-API · OpenAI-kompatibel · 27 Anbieter

Alle kostenlosen LLMs. Eine API.

Holen Sie sich einen kostenlosen Schlüssel und rufen Sie Llama, Gemini, DeepSeek, Qwen und weitere über einen einzigen OpenAI-kompatiblen Endpoint auf. Wenn ein Anbieter ausgelastet ist, leitet der Router die Anfrage automatisch weiter. Ihre Anfrage wird einfach beantwortet.

Mit Google anmelden, Schlüssel kopieren und die erste Anfrage in unter einer Minute stellen. Oder kopieren Sie den Prompt und lassen Sie ChatGPT, Claude oder Cursor ihn in Ihr Projekt einbinden.

dreamprompting-router · POST /api/v1/chat/completions demo


        
        
Simulierter Trace. Ihre Anfragen laufen live. Schlüssel erhalten →
OpenAI-kompatibel Keine Kreditkarte Automatisches failover

Ein Schlüssel reicht für alle diese

Groq Mistral NVIDIA NIM NVIDIA NIM Vision Cohere Google AI Studio OpenRouter Cloudflare Workers AI Cloudflare Workers AI Vision Hugging Face ch.at

12 von 27 konfigurierten Anbietern dienen derzeit Traffic. Der Router wechselt zwischen ihnen pro Anfrage.

27

Upstream-Anbieter hinter einem Endpoint

12

Anbieter aktuell aktiv und verfügbar

43,346

Anfragen über den Router verarbeitet

$0

pro Anfrage, pro Schlüssel, pro Monat

Erstellt mit DreamPrompting

Produkte, die diese API in der Produktion nutzen.

Schnellstart

Verweisen Sie Ihr SDK hierhin.

Alles, was die OpenAI Chat Completions API verwendet, funktioniert. Stelle die base_url, deinen Schlüssel eingeben, fertig. Schlüssel erhalten →

curl https://dreamprompting.com/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role":"user","content":"Hello!"}]
  }'

Ein Modell mit "model": "groq/openai/gpt-oss-120b", oder verwenden "auto" um den Router auswählen und failover zu lassen. Streaming funktioniert: übergeben "stream": true oder das SDK's stream=True. Alles auflisten bei /api/v1/models.

Routing

Routing-Tabelle

Anfragen versuchen aktive Anbieter in der Reihenfolge und failover bei Fehlern oder Rate-Limits. Free tiers first, trial credits next, keyless ch.at as the always-on last resort.

Anbieter Status Standardmodelle
Groq live openai/gpt-oss-120b · openai/gpt-oss-20b · qwen/qwen3.6-27b · groq/compound-mini
Mistral (La Plateforme) live mistral-small-latest · open-mistral-nemo · mistral-large-latest
NVIDIA NIM live nvidia/nemotron-3-super-120b-a12b · nvidia/nemotron-3-nano-30b-a3b
NVIDIA NIM Vision live meta/llama-3.2-11b-vision-instruct
Cohere live command-r-08-2024 · command-r-plus-08-2024 · command-a-03-2025
Google AI Studio (Gemini) live gemini-3.1-flash-lite · gemini-2.5-flash
OpenRouter (Ox Alpha preview) live stealth/ox-alpha
OpenRouter live nvidia/nemotron-3-super-120b-a12b:free · google/gemma-4-31b-it:free · openai/gpt-oss-20b:free
Cloudflare Workers AI live @cf/meta/llama-3.3-70b-instruct-fp8-fast · @cf/ibm-granite/granite-4.0-h-micro · @cf/nvidia/nemotron-3-120b-a12b · @cf/openai/gpt-oss-120b
Cloudflare Workers AI Vision live @cf/meta/llama-4-scout-17b-16e-instruct
Hugging Face live meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Mistral (Codestral) live codestral-latest
ch.at live ch.at
+ 14 weitere Anbieter werden aktiviert
Cerebras in Kürze gpt-oss-120b · zai-glm-4.7 · gemma-4-31b
GitHub Models in Kürze openai/gpt-4o-mini · meta/Llama-3.3-70B-Instruct · deepseek/DeepSeek-V3-0324
Vercel AI Gateway in Kürze openai/gpt-4o-mini · meta/llama-3.3-70b
Scaleway in Kürze llama-3.3-70b-instruct · mistral-small-3.2-24b-instruct-2506
SambaNova Cloud in Kürze Meta-Llama-3.3-70B-Instruct · DeepSeek-V3.2 · gemma-4-31B-it
Hyperbolic in Kürze meta-llama/Llama-3.3-70B-Instruct · deepseek-ai/DeepSeek-V3
Fireworks in Kürze accounts/fireworks/models/llama-v3p3-70b-instruct
Nebius in Kürze meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Novita in Kürze meta-llama/llama-3.3-70b-instruct · deepseek/deepseek_v3
Together AI in Kürze meta-llama/Llama-3.3-70B-Instruct-Turbo
DeepInfra in Kürze meta-llama/Llama-3.3-70B-Instruct · Qwen/Qwen2.5-72B-Instruct
Alibaba (Qwen) in Kürze qwen-plus · qwen2.5-72b-instruct
Upstage (Solar) in Kürze solar-pro2 · solar-mini
AI21 (Jamba) in Kürze jamba-large · jamba-mini

Modelle

Beliebte Modelle für $0

DreamPrompting ist eine kostenlose, OpenAI-kompatible LLM-API und eine direkte, kostenlose Alternative zur ChatGPT- und OpenAI-API. Da sie das Standard-Format für Chat-Completions unterstützt, können Sie beliebte Open-Source- und GPT-Klasse-Modelle kostenlos aufrufen: Chat, Programmierung, Zusammenfassungen, Extraktion und Content-Generierung – alles über einen einzigen Endpoint mit einem kostenlosen API-Key.

Kostenlose ChatGPT / GPT-Alternative

Modelle der GPT-Klasse und GPT-OSS über einen OpenAI-kompatiblen Endpoint. Ändern Sie nur die base URL, behalten Sie Ihren Code.

openai/gpt-oss-120b

Kostenlose Llama 3.3 API

Meta Llama 3.3 70B und Llama 3.1, bereitgestellt über NVIDIA NIM und Cloudflare Workers AI

nvidia/meta/llama-3.3-70b-instruct

Kostenlose Gemini API

Google Gemini Flash und Gemma über den kostenlosen Google AI Studio-Tarif, inklusive Thinking-Kontrolle.

google/gemini-3.1-flash-lite

Kostenlose DeepSeek API

DeepSeek V3 und Reasoning-Modelle für Programmierung und komplexe Aufgaben, ohne Kosten.

nvidia/deepseek-ai/deepseek-v4-pro

Kostenlose Qwen & Mistral API

Qwen 2.5, Mistral und Codestral für mehrsprachigen Chat und Code-Generierung.

mistral-small-latest · qwen2.5-72b

Ein Key, automatisches Failover

Wenn ein Anbieter ausgelastet ist oder ein Rate-Limit erreicht wurde, wechselt der Router zum nächsten. Ihre App funktioniert weiter.

"model": "auto"

Durchsuchen und testen Sie alles auf der Modellseite, oder sehen Sie jedes jemals veröffentlichte KI-Modell.

Angekündigt Anthropic, August 2026

Claude markiert jetzt seine KI-generierten Inhalte

Anthropic hat damit begonnen, ein unsichtbares Wasserzeichen in von Claude generierte Texte einzubetten und signierte C2PA-Provenienz-Metadaten an Dateien wie .svg, .png und .jpg anzuhängen. Dies gilt überall dort, wo Claude verwendet wird, einschließlich der API und Claude Code. Modelle, die am oder nach dem 2. August 2026 in der EU eingeführt wurden, unterstützen dies ab dem Start; bei bestehenden Modellen ist die Implementierung in Arbeit.

Quelle: Wie Claude KI-generierte Inhalte kennzeichnet

Was unsere API entfernt

  • Zero-width-Zeichen und Joiner
  • Bidirektionale Overrides (CVE-2021-42574)
  • Unicode-Tag-Payloads, zurückdekodiert in ASCII
  • No-break- und andere exotische Leerzeichen
  • Variationsselektoren, bedingte Trennstriche, BOMs

Jede Entfernung wird nach Codepoint und Zeile gemeldet, bei der Ausgabe jedes Modells.

Was sie nicht entfernt

Claudes Text-Wasserzeichen. Anthropic veröffentlicht den Algorithmus nicht, aber das beschriebene Verhalten, das beim Kopieren und Einfügen überlebt und bei starkem Bearbeiten, Paraphrasieren oder Übersetzen verblasst, ist charakteristisch für ein Token-Level-Schema statt versteckter Zeichen.

Es wird nichts eingefügt, also kann auch nichts gelöscht werden. Unser Scanner meldet eine Datei als sauber, während die Markierung bestehen bleibt. Dasselbe gilt für C2PA-Metadaten in Bildern, die dieses Tool überhaupt nicht berührt.

Wir sagen Ihnen das lieber hier, als Ihre Registrierung entgegenzunehmen.

Es gibt immer noch viel, das es wert ist, gefunden zu werden

Fügen Sie eine Datei ein und sehen Sie die Zero-width-Zeichen, bidirektionalen Overrides und eingeschleusten Tag-Payloads, die tatsächlich enthalten sind – jedes einzeln gemeldet nach Codepoint und Zeile. Kostenlos und funktioniert mit der Ausgabe jedes Modells.

Kostenloses Tool, zum Scannen anmelden

Sehen Sie, was sich in Ihrem Code versteckt

Zero-width-Zeichen, bidirektionale Overrides, die dazu führen, dass Quellcode in einer Reihenfolge angezeigt, aber in einer anderen kompiliert wird, sowie Unicode-Tag-Zeichen, die einen Payload transportieren, der unsichtbar bleibt. Jede Entfernung wird nach Codepoint und Zeile gemeldet, damit Sie die Änderung prüfen können, anstatt ihr blind zu vertrauen.

Wasserzeichen-Entferner

Funktioniert mit jedem Modell

Der Scan liest Zeichen, keine Anbieter. Daher durchlaufen ChatGPT, Claude, Gemini, Copilot und alle nachfolgenden Modelle einen einzigen Durchlauf ohne Konfigurationsaufwand. Eingeschleuste Unicode-Tag-Payloads werden in lesbares ASCII zurückdekodiert, anstatt sie nur zu zählen.

Code scannen →

We measured it, 2026-08-12

Code-Generierungs-Aufrufe 68
Modell-Ziele 17
enthielt ein verstecktes Zeichen 0

Die rohe Modellausgabe ist sauber. Die Zeichen werden auf dem Übertragungsweg hinzugefügt, meist durch den Browser.

Kostenlose Tools, keine Registrierung

Kosten vorab kalkulieren

Vier Rechner auf Basis echter Daten statt Daumenregeln: ein Live-BPE-Tokenizer sowie Architekturdaten für 63 Open-Weight-Modelle und 34 Karten. Keine Installation, kein Konto erforderlich.

Token-Rechner

Was eine Anfrage wirklich kostet

Fügen Sie einen beliebigen Text ein und sehen Sie, wie er in echte Tokens zerlegt wird. Verstehen Sie, warum die Ausgabe etwa das Fünffache der Eingabe kostet, warum der 20. Turn einer Konversation dreimal so viel kostet wie der erste und warum derselbe Satz auf Swahili fast doppelt so viel kostet.

Text tokenisieren →
Englisch 8
Swahili 15

Gleicher Satz, gleiche Bedeutung. 1.9x so viele Tokens.

Oder auf der eigenen GPU ausführen

In der Praxis

Produkte, die auf dieser API in der Produktion ausgeführt werden

Echtes Software, von anderen Menschen ausgeliefert, das reale Benutzer über dieses Gateway bedient.

Möchten Sie Ihre App hier auflisten?

Noch nichts ist aufgelistet, also erhält der Erste viel Platz. Wenn Sie etwas ausgeliefert haben, das auf dieser API läuft, teilen Sie es uns mit und wir werden es hinzufügen.

Gelangt direkt an einen Menschen. Nichts wird veröffentlicht, bevor wir es uns angesehen haben.

FAQ

Fragen

Gibt es eine wirklich kostenlose LLM API?

Ja. DreamPrompting ist ohne Kreditkarte kostenlos nutzbar. Erstellen Sie ein kostenloses Konto, erhalten Sie einen API-Key und Ihre Anfragen werden über die kostenlosen Kontingente verschiedener Anbieter geroutet, wobei eine standardmäßige OpenAI-konforme Chat-Completion zurückgegeben wird.

Kann ich dies als kostenlose Alternative zu ChatGPT oder der GPT API nutzen?

Ja. Der Endpoint ist OpenAI-kompatibel und somit eine kostenlose Drop-in-Alternative zur ChatGPT- und OpenAI-API. Richten Sie das OpenAI SDK auf unsere base URL, um GPT-Klasse-Modelle sowie Open-Models wie Llama 3.3, Gemini, DeepSeek, Qwen und Mistral zu erreichen.

Welche kostenlosen LLM-Modelle werden unterstützt?

Beliebte Modelle wie Llama 3.3 70B, Google Gemini, DeepSeek, Qwen, Mistral, Cohere Command und GPT-OSS, bereitgestellt über Groq, Cerebras, NVIDIA NIM, OpenRouter, Google AI Studio und weitere.

Anleitungen

Mehr erfahren

Alle Anleitungen →