ローカル LLM の利用
Blaze CLI は、ローカルマシンで動かす LLM を Ollama 経由で利用できます。ネットワークを介さず、自分の PC 内で完結するため、コードやデータを外部に送りたくないシーンで有用です。
ローカル LLM は応答品質・速度・ツール呼び出しの精度が外部 API より落ちる場合があります。Salesforce 開発のように複雑なツール連携を伴う作業では、Blaze の純正ルート(サブスク)や OpenRouter / OpenAI 経由のフロンティアモデルの方が安定することが多いです。
事前準備
1. Ollama をインストールする
ollama.com から OS 用のインストーラをダウンロードして導入してください。macOS / Windows / Linux に対応しています。
インストール後、新しいターミナルで動作確認します。
ollama --version2. 使いたいモデルを取得する
ollama pull llama3.1:8bBlaze で動かす場合は、ツール呼び出し(function calling)に対応したモデル を選んでください。代表例:
llama3.1:8b/llama3.1:70bqwen2.5-coder:7b/qwen2.5-coder:32bmistral-nemo
モデルの一覧と詳細は Ollama のモデルライブラリ を参照してください。
3. Ollama サーバを起動する
多くの環境ではインストール時にバックグラウンドで自動起動します。手動で動かしたい場合は次のコマンドを実行します。
ollama serve待ち受けポートはデフォルトで 11434 です。
Blaze 側の設定
-
Blaze で
/modelを入力 -
モデル一覧の下部の 「+ 自分のAPIキーを使う…」 を選択
-
プリセット一覧から 「Ollama (ローカル LLM)」 を選択
-
フォーム
- Nickname: 既定値(
ollama)のままで OK - Base URL:
http://localhost:11434/v1/chat/completions(既定値のまま) - API key: 空欄のまま(Ollama は認証なし)
- Nickname: 既定値(
-
Enterで送信 → ローカルの Ollama サーバから、ollama pull済みのモデル一覧が自動取得されます -
使いたいモデルを選んで
Enterで完了
設定後は /model 画面に「ローカル LLM」のルートが追加され、Blaze の純正ルート(サブスク)といつでも切り替えられます。
動作確認
接続できたら、簡単なメッセージを送って応答が返るか確かめてみてください。
こんにちは、自己紹介してください応答が返ってくれば接続成功です。
うまく動かない時
モデル一覧が空、または取得に失敗する
ollama listでモデルが pull 済みか確認ollama serveまたは Ollama アプリが起動しているか確認curl http://localhost:11434/api/tagsが JSON を返すか確認
ツール(bash / read / edit など)が呼ばれない、または失敗する
- 使っているモデルがツール呼び出しに対応しているか確認(Ollama のモデルライブラリ で
toolsタグの有無) - 小さすぎるモデル(〜3B 程度)はツール呼び出しが不安定です。可能であれば 7B 以上を試してください
- それでも安定しない場合は、別のモデル(
qwen2.5-coder系など)で試してみてください
応答が極端に遅い
- ローカル LLM はマシンスペックに強く依存します。Apple Silicon Mac の M2 Pro 以上、または GPU 搭載の Windows マシン推奨です
- 大きいモデルを使っている場合は、より小さいモデル(8B 程度)に切り替えると速くなります
ポートが違う
- Ollama 側のポートを変更している場合は、ウィザードの Base URL を編集してください。例:
http://localhost:11435/v1/chat/completions
Blaze の純正ルートに戻す
/model 画面で「Blaze (サブスク)」を選び直すと、いつでも純正ルートに戻せます。ローカル LLM の設定自体は残るので、また切り替えるのも自由です。