Skip to content

Kostenlose Cloud ​

MiniTavern ist BYOK (Bring Your Own Key): Es gibt kein Cloud-Kontingent von der App — Sie registrieren API Keys bei Anbietern oder Inference-Plattformen selbst.
Diese Seite fasst übliche Free-/Trial-Kontingente und die App-Konfiguration zusammen. Kontingente und Policies ändern sich — maßgeblich ist die Live-Anzeige in den jeweiligen Konsolen.

Sicherheit: Ein API Key ist wie ein Passwort. Nur in der lokalen App-Speicherung hinterlegen — nicht in Chats, Screenshots oder öffentlichen Repos teilen.

Zuerst den schnellsten Pfad wählen ​

Ihre SituationEmpfehlungApp-Plattform
Festlandchina, schnell chattenZhipu Flash (kostenlos) oder SiliconFlow FreeCustom (OpenAI)
Ein Key für Text + Bild (multimodal)Agnes AICustom (OpenAI) / Images
Ein Key für GPT / Gemini *-free + BildAIHubMixCustom (OpenAI) / Images
Coding-Gateway, befristete Free-TextmodelleOpenCode ZenCustom (OpenAI)
Offizielle chinesische LLMs (Trial)Qwen · Alibaba BailianQwen
Reasoning / CodeDeepSeekDeepSeek
Overseas-Account, multimodaler TextGoogle GeminiGemini(Google)
Ein Key für viele freie Open-Source-ModelleOpenRouter :freeOpenRouter
Weitere Free-AnbieterFreeLLM-Verzeichnis (awesome-freellm-apis)siehe Verzeichnis
Sehr schnelle Open-Source-InferenceGroqCustom (OpenAI)
Keine CloudLokale ModelleCustom (OpenAI)

Allgemeine Key-Schritte: Modellverbindung. Lokal: Lokale Modelle · 30-Minuten-Quickstart.

So tragen Sie es in MiniTavern ein ​

Pfad: Einstellungen → Modelle → Modellverbindung → Neu

  1. Richtige Modellplattform wählen (Spalte „App-Plattform“).
  2. API Key einfügen; bei Custom zusätzlich Base URL.
  3. Modell-ID wählen oder tippen (exakt wie in der Herstellerdoku, Groß-/Kleinschreibung beachten).
  4. Testen → bei Erfolg als Standard setzen.
AnbieterApp-PlattformBase URL (üblich)Hinweis
GeminiGemini(Google)VoreinstellungGemini-Protokoll — nicht als OpenAI eintragen
OpenRouterOpenRouterVoreinstellungFree-IDs oft mit :free
Qwen / BailianQwenVoreinstellung (Intl. umschaltbar)Allgemeinen API Key nutzen, keinen Coding-Plan-Key
DeepSeekDeepSeekVoreinstellung
Zhipu / SiliconFlow / Agnes / AIHubMix / Zen / Groq / Mistral u. a.Custom (OpenAI)siehe AbschnitteOpenAI-kompatibles Gateway

Häufig in China (Direktzugang Festland) ​

Zhipu AI (GLM) ​

Geeignet für: dauerhaft kostenlosen Chat (Flash-Serie), gute chinesische Roleplay-Qualität.

FeldInhalt
Website / Keyopen.bigmodel.cn → Konsole → API Keys
FreePermanente Free-Modelle wie GLM-*-Flash; neue Nutzer oft Extra-Trial (Konsole)
Kreditkartemeist nicht nötig
Base URLhttps://open.bigmodel.cn/api/paas/v4
Modellbeispieleglm-4.5-flash, glm-4.7-flash (Namen im Model Plaza prüfen)
AppCustom (OpenAI)

Ablauf: registrieren → API Key → Custom (OpenAI) → Base URL + Key → Flash-ID → Verbindung testen.

SiliconFlow ​

Geeignet für: ein Key für viele Open-Source-Chatmodelle; teils Free-Bildmodelle.

FeldInhalt
Website / Keycloud.siliconflow.cn → Konto → API-Schlüssel
FreeFree-Modelle ohne Abrechnung (Name ohne Pro/-Präfix); nach Realname alle Free-Modelle
Limitsfeste RPM/TPM je Modell; Rate Limits
Base URLhttps://api.siliconflow.cn/v1
ModellbeispielePlaza-Tag „免费“, z. B. Qwen/Qwen3-8B (Liste ändert sich)
AppCustom (OpenAI)

Achtung: gleiches Modell oft als Free und Pro/... (kostenpflichtig). Falsche ID = Kosten. Free-Verbrauch in der Rechnung sollte 0 sein.

Qwen · Alibaba Cloud Bailian ​

Geeignet für: offizielle Qwen-Serie; MiniTavern hat Qwen-Preset.

FeldInhalt
AktivierungBailian-Konsole (Nordchina 2 / Peking), Vertrag akzeptieren
FreeNeukunden-Token: oft ca. 1 Mio. Token / Modell, ca. 90 Tage; Kontingente nicht übertragbar
KeyBailian → API-Key; allgemeinen Key (Token-/Coding-Plan-Keys verbrauchen kein Free-Kontingent)
AppQwen (CN-Preset; Intl. umschaltbar)
Kostenstopp„Bei aufgebrauchtem Free-Kontingent stoppen“ in der Konsole aktivieren

Offiziell: Neukunden-Free-Quota. Nach Ablauf entstehen Kosten.

Bildgenerierung (Wanxiang / Qwen-Image): Einstellungen → Bildgenerierung → Bildverbindung → Qwen, wenn das Modell im Free-Kontingent ist.

DeepSeek ​

Geeignet für: Reasoning, lange Texte, gutes Preis-Leistungs-Verhältnis — nicht dauerhaft 0 €.

FeldInhalt
Website / Keyplatform.deepseek.com → API Keys
Freeoft Startguthaben / Trial (Betrag laut Konsole)
AppDeepSeek
Modellbeispieledeepseek-v4-flash, deepseek-v4-pro (Doku)

Nach Guthaben: Pay-as-you-go; ohne Saldo schlagen Requests fehl.

ModelScope API-Inference ​

Geeignet für: Alibaba-Realname vorhanden, Community-Open-Source-Inference.

FeldInhalt
Tokenmodelscope.cn → Zugriffstoken
FreeTages-Request-Quota (Limits)
Base URLhttps://api-inference.modelscope.cn/v1
AppCustom (OpenAI)

International / Aggregatoren ​

Agnes AI ​

Ein Free-Key für Text und Bild (Flash Free). Video: Website; App hat noch keinen Video-Einstieg.

Details: Agnes AI.

FeldInhalt
Website / Keyagnes-ai.com · platform.agnes-ai.com
FreeFree Access: Flash Text/Bild (RPM-Limits)
Base URLhttps://apihub.agnes-ai.com/v1
Textagnes-2.5-flash
Bildagnes-image-2.1-flash (Custom (OpenAI Images))
AppCustom (OpenAI) / Custom (OpenAI Images)

OpenCode Zen ​

Free-Textmodelle auf dem OpenCode-Gateway (z. B. mimo-v2.5-free). Flagship meist Pay-as-you-go — Autotop-up prüfen.

Details: OpenCode Zen.

FeldInhalt
Website / Keyopencode.ai/auth · Docs
FreeModelle mit Free in der Preisliste (innerhalb Caps)
Base URLhttps://opencode.ai/zen/v1
Textmimo-v2.5-free, hy3-free, big-pickle
AppCustom (OpenAI) (chat/completions-kompatible IDs)

AIHubMix ​

Ein Key für gesponserte *-free-Modelle (GPT / Gemini / GLM …) und GPT-Image-2-free; oft ohne Karte.

Details: AIHubMix.

FeldInhalt
Website / Keyaihubmix.com · Free-Modelle
FreeIDs enden auf -free; RPM / Tageskontingent je Modell
Base URLhttps://aihubmix.com/v1
Textgpt-4o-free, gpt-5.5-free, coding-glm-5.1-free
Bildgpt-image-2-free (Custom (OpenAI Images))
AppCustom (OpenAI) / Custom (OpenAI Images)

Google Gemini ​

Multimodaler Text, langer Kontext; Text-Free-Tier oft großzügig.

FeldInhalt
Keyaistudio.google.com/app/apikey
FreeTeile Gemini Flash / Lite Text (RPM / RPD in AI Studio)
KreditkarteText-Free meist ohne; neuere Bild-APIs oft ohne Free tier
RegionEU / UK / CH ggf. ohne Free
PrivacyFree-Prompts können zur Produktverbesserung genutzt werden
AppGemini(Google)

Chat: Textmodelle (z. B. gemini-flash-latest). Keine IDs mit tts / image — Test erwartet TEXT; TTS liefert AUDIO → response modalities (TEXT) is not supported.

HTTP 404 + no longer available to new users: ID offline / nicht für neue Nutzer (z. B. gemini-2.5-flash-lite). Liste aktualisieren, online Flash/Lite wählen (z. B. gemini-flash-latest).

HTTP 429 + generate_content_free_tier_requests (oft Limit 20): Free RPM erschöpft — laut Please retry in … warten. ai.dev/rate-limit.

Bild: Gemini-App vs. Developer API unterschiedlich; API-Bildmodelle oft ohne Free. Typisch: Chat mit Gemini, Bild lokal A1111/ComfyUI — Bildmodelle lokal.

OpenRouter ​

Ein Key für viele Open-Source-/Drittanbieter-Free-Pools; IDs oft :free. Details: OpenRouter.

FeldInhalt
Keyopenrouter.ai/keys
Free:free / Collection Free; ca. 20 RPM, begrenzte Tagesrequests; Aufladen kann Tageslimit erhöhen
AppOpenRouter
Beispieleopenrouter/free, meta-llama/llama-3.3-70b-instruct:free, openai/gpt-oss-20b:free
CollectionsFree Models · openairouter.net/free-models

Hinweis: Free-Upstream kann Prompts für Training speichern. HTTP 429: Provider returned error → anderes :free, später erneut, oder BYOK.

Groq ​

Sehr niedrige Latenz für Open-Source-Inference.

FeldInhalt
Keyconsole.groq.com/keys
Freedauerhafter Free tier (RPM / RPD / TPM, ändert sich)
Kreditkartemeist nicht nötig
Base URLhttps://api.groq.com/openai/v1
Beispielellama-3.1-8b-instant, llama-3.3-70b-versatile, openai/gpt-oss-20b
AppCustom (OpenAI)

Mistral AI ​

FeldInhalt
Keyconsole.mistral.ai/api-keys
FreeExperiment / Trial (Monats-Token laut Konsole); Prompts ggf. zur Verbesserung
Base URLhttps://api.mistral.ai/v1
AppCustom (OpenAI)

Cerebras / SambaNova u. a. ​

PlattformKeyBase URLHinweis
Cerebrascloud.cerebras.aihttps://api.cerebras.ai/v1Free oft mit Tages-Token-Cap; ggf. Zahlungsmethode
SambaNovacloud.sambanova.aihttps://api.sambanova.ai/v1dauerhafter Free + gelegentliches Guthaben; enge Limits

App: Custom (OpenAI); Modellnamen laut Konsole.

GitHub Models ​

FeldInhalt
EinstiegGitHub Models
AuthGitHub Personal Access Token
Base URLhttps://models.github.ai/inference
AppCustom (OpenAI)
LimitsRPM / RPD je Modell — leichtes Trial

NVIDIA NIM ​

FeldInhalt
Einstiegbuild.nvidia.com
Base URLhttps://integrate.api.nvidia.com/v1
AppCustom (OpenAI) (falls Nvidia-Preset wieder verfügbar: optional)

Trial-Kontingente (nicht dauerhaft free) ​

AnbieterTypischApp
OpenAIgelegentliches Trial-Guthaben; kein stabiles Free-Tier am Haupt-APIChatGPT(OpenAI)
Anthropic ClaudeStarter Credits, schnell wegClaude(Anthropic)
DeepSeeksiehe Startguthaben obenDeepSeek
Alibaba BailianNeukunden-Token (~90 Tage)Qwen

Danach Autoload-Risiko senken: Key löschen, „Stop bei 0 Free“ aktivieren, oder Free-/Lokal-Backend wählen.


Kostenlose Bildgenerierung ​

PfadKostenHinweis
Lokal A1111 / ComfyUIStrom + GPUunbegrenzte Anzahl; Handy → PC-LAN
SiliconFlow Free-Bildmodelle0 bei Free-IDBildverbindung Custom (OpenAI Images), Base URL wie Silicon …/v1
Agnes AI Image FlashFree AccessCustom (OpenAI Images), https://apihub.agnes-ai.com/v1, z. B. agnes-image-2.1-flash
AIHubMix*-free BildCustom (OpenAI Images), https://aihubmix.com/v1, z. B. gpt-image-2-free
Wanxiang / Qwen ImageBailian-Kontingent prüfenEinstellungen → Bildgenerierung → Bildverbindung → Qwen
OpenAI / viele Gemini Image APIsmeist bezahltnicht als „kostenlose Bild-API“ planen

Chat- und Bildverbindung getrennt möglich: z. B. Chat Zhipu Flash, Bild heimisches ComfyUI.


Tipps & Fehlerbehebung ​

  1. Erst testen, dann chatten: bei Fehler „Details“ → Fehlercodes.
  2. 429 / Rate limit: leichteres Modell, kürzerer Kontext, oder zweites Free-Backend.
  3. Unerwartete Kosten: Pro/-Modell? Bailian ohne Stopp? Trial leer?
  4. Privacy: Free-Tiers erlauben oft Log-Training — Sensibles besser lokal.
  5. Kontingentänderungen: Zahlen hier sind Richtwerte; Live-Konsole gilt. Mehr Index: FreeLLM (awesome-freellm-apis · freellm.net).

Verwandte Kapitel ​