Kostenlose Cloud
MiniTavern ist BYOK (Bring Your Own Key): Es gibt kein Cloud-Kontingent von der App — Sie registrieren API Keys bei Anbietern oder Inference-Plattformen selbst.
Diese Seite fasst übliche Free-/Trial-Kontingente und die App-Konfiguration zusammen. Kontingente und Policies ändern sich — maßgeblich ist die Live-Anzeige in den jeweiligen Konsolen.
Sicherheit: Ein API Key ist wie ein Passwort. Nur in der lokalen App-Speicherung hinterlegen — nicht in Chats, Screenshots oder öffentlichen Repos teilen.
Zuerst den schnellsten Pfad wählen
| Ihre Situation | Empfehlung | App-Plattform |
|---|---|---|
| Festlandchina, schnell chatten | Zhipu Flash (kostenlos) oder SiliconFlow Free | Custom (OpenAI) |
| Ein Key für Text + Bild (multimodal) | Agnes AI | Custom (OpenAI) / Images |
Ein Key für GPT / Gemini *-free + Bild | AIHubMix | Custom (OpenAI) / Images |
| Coding-Gateway, befristete Free-Textmodelle | OpenCode Zen | Custom (OpenAI) |
| Offizielle chinesische LLMs (Trial) | Qwen · Alibaba Bailian | Qwen |
| Reasoning / Code | DeepSeek | DeepSeek |
| Overseas-Account, multimodaler Text | Google Gemini | Gemini(Google) |
| Ein Key für viele freie Open-Source-Modelle | OpenRouter :free | OpenRouter |
| Weitere Free-Anbieter | FreeLLM-Verzeichnis (awesome-freellm-apis) | siehe Verzeichnis |
| Sehr schnelle Open-Source-Inference | Groq | Custom (OpenAI) |
| Keine Cloud | Lokale Modelle | Custom (OpenAI) |
Allgemeine Key-Schritte: Modellverbindung. Lokal: Lokale Modelle · 30-Minuten-Quickstart.
So tragen Sie es in MiniTavern ein
Pfad: Einstellungen → Modelle → Modellverbindung → Neu
- Richtige Modellplattform wählen (Spalte „App-Plattform“).
- API Key einfügen; bei Custom zusätzlich Base URL.
- Modell-ID wählen oder tippen (exakt wie in der Herstellerdoku, Groß-/Kleinschreibung beachten).
- Testen → bei Erfolg als Standard setzen.
| Anbieter | App-Plattform | Base URL (üblich) | Hinweis |
|---|---|---|---|
| Gemini | Gemini(Google) | Voreinstellung | Gemini-Protokoll — nicht als OpenAI eintragen |
| OpenRouter | OpenRouter | Voreinstellung | Free-IDs oft mit :free |
| Qwen / Bailian | Qwen | Voreinstellung (Intl. umschaltbar) | Allgemeinen API Key nutzen, keinen Coding-Plan-Key |
| DeepSeek | DeepSeek | Voreinstellung | |
| Zhipu / SiliconFlow / Agnes / AIHubMix / Zen / Groq / Mistral u. a. | Custom (OpenAI) | siehe Abschnitte | OpenAI-kompatibles Gateway |
Häufig in China (Direktzugang Festland)
Zhipu AI (GLM)
Geeignet für: dauerhaft kostenlosen Chat (Flash-Serie), gute chinesische Roleplay-Qualität.
| Feld | Inhalt |
|---|---|
| Website / Key | open.bigmodel.cn → Konsole → API Keys |
| Free | Permanente Free-Modelle wie GLM-*-Flash; neue Nutzer oft Extra-Trial (Konsole) |
| Kreditkarte | meist nicht nötig |
| Base URL | https://open.bigmodel.cn/api/paas/v4 |
| Modellbeispiele | glm-4.5-flash, glm-4.7-flash (Namen im Model Plaza prüfen) |
| App | Custom (OpenAI) |
Ablauf: registrieren → API Key → Custom (OpenAI) → Base URL + Key → Flash-ID → Verbindung testen.
SiliconFlow
Geeignet für: ein Key für viele Open-Source-Chatmodelle; teils Free-Bildmodelle.
| Feld | Inhalt |
|---|---|
| Website / Key | cloud.siliconflow.cn → Konto → API-Schlüssel |
| Free | Free-Modelle ohne Abrechnung (Name ohne Pro/-Präfix); nach Realname alle Free-Modelle |
| Limits | feste RPM/TPM je Modell; Rate Limits |
| Base URL | https://api.siliconflow.cn/v1 |
| Modellbeispiele | Plaza-Tag „免费“, z. B. Qwen/Qwen3-8B (Liste ändert sich) |
| App | Custom (OpenAI) |
Achtung: gleiches Modell oft als Free und Pro/... (kostenpflichtig). Falsche ID = Kosten. Free-Verbrauch in der Rechnung sollte 0 sein.
Qwen · Alibaba Cloud Bailian
Geeignet für: offizielle Qwen-Serie; MiniTavern hat Qwen-Preset.
| Feld | Inhalt |
|---|---|
| Aktivierung | Bailian-Konsole (Nordchina 2 / Peking), Vertrag akzeptieren |
| Free | Neukunden-Token: oft ca. 1 Mio. Token / Modell, ca. 90 Tage; Kontingente nicht übertragbar |
| Key | Bailian → API-Key; allgemeinen Key (Token-/Coding-Plan-Keys verbrauchen kein Free-Kontingent) |
| App | Qwen (CN-Preset; Intl. umschaltbar) |
| Kostenstopp | „Bei aufgebrauchtem Free-Kontingent stoppen“ in der Konsole aktivieren |
Offiziell: Neukunden-Free-Quota. Nach Ablauf entstehen Kosten.
Bildgenerierung (Wanxiang / Qwen-Image): Einstellungen → Bildgenerierung → Bildverbindung → Qwen, wenn das Modell im Free-Kontingent ist.
DeepSeek
Geeignet für: Reasoning, lange Texte, gutes Preis-Leistungs-Verhältnis — nicht dauerhaft 0 €.
| Feld | Inhalt |
|---|---|
| Website / Key | platform.deepseek.com → API Keys |
| Free | oft Startguthaben / Trial (Betrag laut Konsole) |
| App | DeepSeek |
| Modellbeispiele | deepseek-v4-flash, deepseek-v4-pro (Doku) |
Nach Guthaben: Pay-as-you-go; ohne Saldo schlagen Requests fehl.
ModelScope API-Inference
Geeignet für: Alibaba-Realname vorhanden, Community-Open-Source-Inference.
| Feld | Inhalt |
|---|---|
| Token | modelscope.cn → Zugriffstoken |
| Free | Tages-Request-Quota (Limits) |
| Base URL | https://api-inference.modelscope.cn/v1 |
| App | Custom (OpenAI) |
International / Aggregatoren
Agnes AI
Ein Free-Key für Text und Bild (Flash Free). Video: Website; App hat noch keinen Video-Einstieg.
Details: Agnes AI.
| Feld | Inhalt |
|---|---|
| Website / Key | agnes-ai.com · platform.agnes-ai.com |
| Free | Free Access: Flash Text/Bild (RPM-Limits) |
| Base URL | https://apihub.agnes-ai.com/v1 |
| Text | agnes-2.5-flash |
| Bild | agnes-image-2.1-flash (Custom (OpenAI Images)) |
| App | Custom (OpenAI) / Custom (OpenAI Images) |
OpenCode Zen
Free-Textmodelle auf dem OpenCode-Gateway (z. B. mimo-v2.5-free). Flagship meist Pay-as-you-go — Autotop-up prüfen.
Details: OpenCode Zen.
| Feld | Inhalt |
|---|---|
| Website / Key | opencode.ai/auth · Docs |
| Free | Modelle mit Free in der Preisliste (innerhalb Caps) |
| Base URL | https://opencode.ai/zen/v1 |
| Text | mimo-v2.5-free, hy3-free, big-pickle |
| App | Custom (OpenAI) (chat/completions-kompatible IDs) |
AIHubMix
Ein Key für gesponserte *-free-Modelle (GPT / Gemini / GLM …) und GPT-Image-2-free; oft ohne Karte.
Details: AIHubMix.
| Feld | Inhalt |
|---|---|
| Website / Key | aihubmix.com · Free-Modelle |
| Free | IDs enden auf -free; RPM / Tageskontingent je Modell |
| Base URL | https://aihubmix.com/v1 |
| Text | gpt-4o-free, gpt-5.5-free, coding-glm-5.1-free |
| Bild | gpt-image-2-free (Custom (OpenAI Images)) |
| App | Custom (OpenAI) / Custom (OpenAI Images) |
Google Gemini
Multimodaler Text, langer Kontext; Text-Free-Tier oft großzügig.
| Feld | Inhalt |
|---|---|
| Key | aistudio.google.com/app/apikey |
| Free | Teile Gemini Flash / Lite Text (RPM / RPD in AI Studio) |
| Kreditkarte | Text-Free meist ohne; neuere Bild-APIs oft ohne Free tier |
| Region | EU / UK / CH ggf. ohne Free |
| Privacy | Free-Prompts können zur Produktverbesserung genutzt werden |
| App | Gemini(Google) |
Chat: Textmodelle (z. B. gemini-flash-latest). Keine IDs mit tts / image — Test erwartet TEXT; TTS liefert AUDIO → response modalities (TEXT) is not supported.
HTTP 404 + no longer available to new users: ID offline / nicht für neue Nutzer (z. B. gemini-2.5-flash-lite). Liste aktualisieren, online Flash/Lite wählen (z. B. gemini-flash-latest).
HTTP 429 + generate_content_free_tier_requests (oft Limit 20): Free RPM erschöpft — laut Please retry in … warten. ai.dev/rate-limit.
Bild: Gemini-App vs. Developer API unterschiedlich; API-Bildmodelle oft ohne Free. Typisch: Chat mit Gemini, Bild lokal A1111/ComfyUI — Bildmodelle lokal.
OpenRouter
Ein Key für viele Open-Source-/Drittanbieter-Free-Pools; IDs oft :free. Details: OpenRouter.
| Feld | Inhalt |
|---|---|
| Key | openrouter.ai/keys |
| Free | :free / Collection Free; ca. 20 RPM, begrenzte Tagesrequests; Aufladen kann Tageslimit erhöhen |
| App | OpenRouter |
| Beispiele | openrouter/free, meta-llama/llama-3.3-70b-instruct:free, openai/gpt-oss-20b:free |
| Collections | Free Models · openairouter.net/free-models |
Hinweis: Free-Upstream kann Prompts für Training speichern. HTTP 429: Provider returned error → anderes :free, später erneut, oder BYOK.
Groq
Sehr niedrige Latenz für Open-Source-Inference.
| Feld | Inhalt |
|---|---|
| Key | console.groq.com/keys |
| Free | dauerhafter Free tier (RPM / RPD / TPM, ändert sich) |
| Kreditkarte | meist nicht nötig |
| Base URL | https://api.groq.com/openai/v1 |
| Beispiele | llama-3.1-8b-instant, llama-3.3-70b-versatile, openai/gpt-oss-20b |
| App | Custom (OpenAI) |
Mistral AI
| Feld | Inhalt |
|---|---|
| Key | console.mistral.ai/api-keys |
| Free | Experiment / Trial (Monats-Token laut Konsole); Prompts ggf. zur Verbesserung |
| Base URL | https://api.mistral.ai/v1 |
| App | Custom (OpenAI) |
Cerebras / SambaNova u. a.
| Plattform | Key | Base URL | Hinweis |
|---|---|---|---|
| Cerebras | cloud.cerebras.ai | https://api.cerebras.ai/v1 | Free oft mit Tages-Token-Cap; ggf. Zahlungsmethode |
| SambaNova | cloud.sambanova.ai | https://api.sambanova.ai/v1 | dauerhafter Free + gelegentliches Guthaben; enge Limits |
App: Custom (OpenAI); Modellnamen laut Konsole.
GitHub Models
| Feld | Inhalt |
|---|---|
| Einstieg | GitHub Models |
| Auth | GitHub Personal Access Token |
| Base URL | https://models.github.ai/inference |
| App | Custom (OpenAI) |
| Limits | RPM / RPD je Modell — leichtes Trial |
NVIDIA NIM
| Feld | Inhalt |
|---|---|
| Einstieg | build.nvidia.com |
| Base URL | https://integrate.api.nvidia.com/v1 |
| App | Custom (OpenAI) (falls Nvidia-Preset wieder verfügbar: optional) |
Trial-Kontingente (nicht dauerhaft free)
| Anbieter | Typisch | App |
|---|---|---|
| OpenAI | gelegentliches Trial-Guthaben; kein stabiles Free-Tier am Haupt-API | ChatGPT(OpenAI) |
| Anthropic Claude | Starter Credits, schnell weg | Claude(Anthropic) |
| DeepSeek | siehe Startguthaben oben | DeepSeek |
| Alibaba Bailian | Neukunden-Token (~90 Tage) | Qwen |
Danach Autoload-Risiko senken: Key löschen, „Stop bei 0 Free“ aktivieren, oder Free-/Lokal-Backend wählen.
Kostenlose Bildgenerierung
| Pfad | Kosten | Hinweis |
|---|---|---|
| Lokal A1111 / ComfyUI | Strom + GPU | unbegrenzte Anzahl; Handy → PC-LAN |
| SiliconFlow Free-Bildmodelle | 0 bei Free-ID | Bildverbindung Custom (OpenAI Images), Base URL wie Silicon …/v1 |
| Agnes AI Image Flash | Free Access | Custom (OpenAI Images), https://apihub.agnes-ai.com/v1, z. B. agnes-image-2.1-flash |
| AIHubMix | *-free Bild | Custom (OpenAI Images), https://aihubmix.com/v1, z. B. gpt-image-2-free |
| Wanxiang / Qwen Image | Bailian-Kontingent prüfen | Einstellungen → Bildgenerierung → Bildverbindung → Qwen |
| OpenAI / viele Gemini Image APIs | meist bezahlt | nicht als „kostenlose Bild-API“ planen |
Chat- und Bildverbindung getrennt möglich: z. B. Chat Zhipu Flash, Bild heimisches ComfyUI.
Tipps & Fehlerbehebung
- Erst testen, dann chatten: bei Fehler „Details“ → Fehlercodes.
- 429 / Rate limit: leichteres Modell, kürzerer Kontext, oder zweites Free-Backend.
- Unerwartete Kosten:
Pro/-Modell? Bailian ohne Stopp? Trial leer? - Privacy: Free-Tiers erlauben oft Log-Training — Sensibles besser lokal.
- Kontingentänderungen: Zahlen hier sind Richtwerte; Live-Konsole gilt. Mehr Index: FreeLLM (awesome-freellm-apis · freellm.net).
Verwandte Kapitel
- Modellverbindung — Eintrag in der App
- Erste Schritte
- FreeLLM-Verzeichnis
- Lokale Modelle
- Bildmodelle lokal — A1111 / ComfyUI