Modelle laden & wählen
Toolübergreifend: Empfohlene Modelle. Hier Ollama-Befehle.
Modell pullen
bash
ollama pull <Modellname>Einstieg:
bash
ollama pull llama3.2:3b
ollama pull qwen2.5:3b
ollama pull qwen2.5:7b
ollama pull qwen2.5:14bHeruntergeladen:
bash
ollama listLokal chatten:
bash
ollama run qwen2.5:7bGröße wählen
| ca. Größe | RAM/VRAM grob | Hinweis |
|---|---|---|
| 1B–3B | ca. 4–8GB | Pfadtest, leichte Antworten |
| 7B–8B | ca. 8–16GB | Roleplay-Sweetspot |
| 14B+ | 16GB+ | bessere Qualität, mehr Hardware |
Kleinere Quantisierung = weniger RAM, schneller, etwas weniger Qualität. Ollama-Tags (:3b, :7b) sind offizielle Default-Packs — Anfänger können die Namen direkt nutzen.
Roleplay
- Dialog-/Instruct-Finetunes; reine Completion-Bases oft ungeeignet.
- In MiniTavern Modellname exakt wie linke Spalte von
ollama list(inkl. Tag). - Chinesische Karten: zuerst Qwen, dann nach Gefühl wechseln.