Skip to content

下载与选择模型 ​

更完整的跨工具推荐见 推荐模型。本页专注 Ollama 命令。

拉取模型 ​

bash
ollama pull <模型名>

入门示例:

bash
ollama pull llama3.2:3b
ollama pull qwen2.5:3b
ollama pull qwen2.5:7b
ollama pull qwen2.5:14b

查看已下载:

bash
ollama list

本机试聊:

bash
ollama run qwen2.5:7b

怎么选大小 ​

大致规模内存/显存粗略参考说明
1B–3B约 4–8GB验证通路、轻量回复
7B–8B约 8–16GB角色扮演常用甜点区
14B+16GB+质量更好,更吃硬件

量化越小越省内存、速度更快,质量略降。Ollama 的 tag(如 :3b、:7b)已按官方默认量化打包,新手直接用官方名即可。

角色扮演提示 ​

  • 优先选对话 / 指令微调模型;纯补全基座可能不适合聊天格式。
  • 在 MiniTavern 里填写的 模型名 必须与 ollama list 左列名称完全一致(含 tag)。
  • 中文角色卡可优先试 Qwen 系列;再按手感换其它模型。

下一步 ​

开启局域网访问 → 在 MiniTavern 中配置