Skip to content

下载与选择模型

更完整的跨工具推荐见 推荐模型。本页专注 Ollama 命令。

拉取模型

bash
ollama pull <模型>

入门示例:

bash
ollama pull llama3.2:3b
ollama pull qwen2.5:3b
ollama pull qwen2.5:7b
ollama pull qwen2.5:14b

查看已下载:

bash
ollama list

本机试聊:

bash
ollama run qwen2.5:7b

怎么选大小

大致规模内存/显存粗略参考说明
1B–3B约 4–8GB验证通路、轻量回复
7B–8B约 8–16GB角色扮演常用甜点区
14B+16GB+质量更好,更吃硬件

量化越小越省内存、速度更快,质量略降。Ollama 的 tag(如 :3b:7b)已按官方默认量化打包,新手直接用官方名即可。

角色扮演提示

  • 优先选对话 / 指令微调模型;纯补全基座可能不适合聊天格式。
  • 在 MiniTavern 里填写的 模型名 必须与 ollama list 左列名称完全一致(含 tag)。
  • 中文角色卡可优先试 Qwen 系列;再按手感换其它模型。

下一步

开启局域网访问在 MiniTavern 中配置