Skip to content

下載與選擇模型 ​

更完整的跨工具推薦見 推薦模型。本頁專注 Ollama 命令。

拉取模型 ​

bash
ollama pull <模型名>

入門示例:

bash
ollama pull llama3.2:3b
ollama pull qwen2.5:3b
ollama pull qwen2.5:7b
ollama pull qwen2.5:14b

查看已下載:

bash
ollama list

本機試聊:

bash
ollama run qwen2.5:7b

怎麼選大小 ​

大致規模內存/顯存粗略參考說明
1B–3B約 4–8GB驗證通路、輕量回復
7B–8B約 8–16GB角色扮演常用甜點區
14B+16GB+質量更好,更吃硬件

量化越小越省內存、速度更快,質量略降。Ollama 的 tag(如 :3b、:7b)已按官方默認量化打包,新手直接用官方名即可。

角色扮演提示 ​

  • 優先選對話 / 指令微調模型;純補全基座可能不適合聊天格式。
  • 在 MiniTavern 裡填寫的 模型名 必須與 ollama list 左列名稱完全一致(含 tag)。
  • 中文角色卡可優先試 Qwen 系列;再按手感換其它模型。

下一步 ​

開啟局域網訪問 → 在 MiniTavern 中配置