下载与选择模型
更完整的跨工具推荐见 推荐模型。本页专注 Ollama 命令。
拉取模型
bash
ollama pull <模型名>入门示例:
bash
ollama pull llama3.2:3b
ollama pull qwen2.5:3b
ollama pull qwen2.5:7b
ollama pull qwen2.5:14b查看已下载:
bash
ollama list本机试聊:
bash
ollama run qwen2.5:7b怎么选大小
| 大致规模 | 内存/显存粗略参考 | 说明 |
|---|---|---|
| 1B–3B | 约 4–8GB | 验证通路、轻量回复 |
| 7B–8B | 约 8–16GB | 角色扮演常用甜点区 |
| 14B+ | 16GB+ | 质量更好,更吃硬件 |
量化越小越省内存、速度更快,质量略降。Ollama 的 tag(如 :3b、:7b)已按官方默认量化打包,新手直接用官方名即可。
角色扮演提示
- 优先选对话 / 指令微调模型;纯补全基座可能不适合聊天格式。
- 在 MiniTavern 里填写的 模型名 必须与
ollama list左列名称完全一致(含 tag)。 - 中文角色卡可优先试 Qwen 系列;再按手感换其它模型。