下載與選擇模型
更完整的跨工具推薦見 推薦模型。本頁專注 Ollama 命令。
拉取模型
bash
ollama pull <模型名>入門示例:
bash
ollama pull llama3.2:3b
ollama pull qwen2.5:3b
ollama pull qwen2.5:7b
ollama pull qwen2.5:14b查看已下載:
bash
ollama list本機試聊:
bash
ollama run qwen2.5:7b怎麼選大小
| 大致規模 | 內存/顯存粗略參考 | 說明 |
|---|---|---|
| 1B–3B | 約 4–8GB | 驗證通路、輕量回復 |
| 7B–8B | 約 8–16GB | 角色扮演常用甜點區 |
| 14B+ | 16GB+ | 質量更好,更吃硬件 |
量化越小越省內存、速度更快,質量略降。Ollama 的 tag(如 :3b、:7b)已按官方默認量化打包,新手直接用官方名即可。
角色扮演提示
- 優先選對話 / 指令微調模型;純補全基座可能不適合聊天格式。
- 在 MiniTavern 裡填寫的 模型名 必須與
ollama list左列名稱完全一致(含 tag)。 - 中文角色卡可優先試 Qwen 系列;再按手感換其它模型。