工具总览
MiniTavern 只要对方提供 OpenAI 兼容 的 Chat Completions(或可映射到该协议),就能用「自定义」模型连接接入。下表帮你选工具。
对比
| 工具 | 上手难度 | 界面 | 拉模型 | 角色扮演向 | 典型 Base URL |
|---|---|---|---|---|---|
| Ollama | ★☆☆ | 托盘 + CLI | ollama pull | 通用对话强 | http://IP:11434/v1 |
| LM Studio | ★☆☆ | 完整 GUI | 应用内下载 | 通用 | http://IP:1234/v1 |
| KoboldCPP | ★★☆ | 轻量 GUI/CLI | 自备 GGUF | RP 社区常用 | http://IP:5001/v1 |
| llama.cpp server | ★★★ | CLI | 自备 GGUF | 可控、轻 | http://IP:8080/v1 |
| LocalAI | ★★☆ | API / 可选 UI | YAML / 镜像 | 多后端 | http://IP:8080/v1 |
| Jan | ★☆☆ | 桌面 App | 应用内 | 通用 | 见应用「API」页 |
| text-generation-webui | ★★★ | Web UI | 扩展多 | 插件生态 | 开启 OpenAI 扩展后 |
怎么选(一句话)
- 只想最快跑通:Ollama 或 LM Studio → 30 分钟通关
- 更在意角色扮演预设 / 采样器:KoboldCPP
- 已有 GGUF、想最少依赖:llama.cpp
llama-server - 已在用 Docker / 想统一兼容层:LocalAI
- 喜欢一体化桌面助手:Jan
- 已有 oobabooga 环境:开 OpenAI 兼容扩展后连 MiniTavern
共同要求
无论选哪款:
- 服务监听 局域网(
0.0.0.0或「允许局域网设备」),不要只绑127.0.0.1 - 防火墙放行对应端口
- 手机填 电脑局域网 IP,Base URL 带
/v1(除非该工具文档另有说明) - 模型名与工具里显示的 id / 名称完全一致
下一步:推荐模型 · 在 MiniTavern 中配置