server の開始(llama.cpp)
以下はよくある書き方。具体パラメータは使用中の llama.cpp 版 README を正とする。
起動例
bash
./llama-server -m /path/to/model.gguf --host 0.0.0.0 --port 8080要点:
--host 0.0.0.0:LAN アクセスを許可(127.0.0.1のみだとスマホ不可)--port:カスタムポート、ファイアウォールで開放- 版によっては OpenAI 互換ルートの追加が必要(新版 server は通常
/v1/chat/completions付き)
セルフテスト
text
http://127.0.0.1:8080/v1/models
http://YOUR_PC_IP:8080/v1/modelsMiniTavern 向け
| フィールド | 例 |
|---|---|
| Base URL | http://YOUR_PC_IP:8080/v1 |
| API Key | 空欄またはプレースホルダ |
| モデル名 | /v1/models の id と一致(版によってはファイル名) |