BlazeBlaze CLIローカル LLM の利用

ローカル LLM の利用

Blaze CLI は、ローカルマシンで動かす LLM を Ollama 経由で利用できます。ネットワークを介さず、自分の PC 内で完結するため、コードやデータを外部に送りたくないシーンで有用です。

ローカル LLM は応答品質・速度・ツール呼び出しの精度が外部 API より落ちる場合があります。Salesforce 開発のように複雑なツール連携を伴う作業では、Blaze の純正ルート(サブスク)や OpenRouter / OpenAI 経由のフロンティアモデルの方が安定することが多いです。

事前準備

1. Ollama をインストールする

ollama.com から OS 用のインストーラをダウンロードして導入してください。macOS / Windows / Linux に対応しています。

インストール後、新しいターミナルで動作確認します。

ollama --version

2. 使いたいモデルを取得する

ollama pull llama3.1:8b

Blaze で動かす場合は、ツール呼び出し(function calling)に対応したモデル を選んでください。代表例:

  • llama3.1:8b / llama3.1:70b
  • qwen2.5-coder:7b / qwen2.5-coder:32b
  • mistral-nemo

モデルの一覧と詳細は Ollama のモデルライブラリ を参照してください。

3. Ollama サーバを起動する

多くの環境ではインストール時にバックグラウンドで自動起動します。手動で動かしたい場合は次のコマンドを実行します。

ollama serve

待ち受けポートはデフォルトで 11434 です。

Blaze 側の設定

  1. Blaze で /model を入力

  2. モデル一覧の下部の 「+ 自分のAPIキーを使う…」 を選択

  3. プリセット一覧から 「Ollama (ローカル LLM)」 を選択

  4. フォーム

    • Nickname: 既定値(ollama)のままで OK
    • Base URL: http://localhost:11434/v1/chat/completions(既定値のまま)
    • API key: 空欄のまま(Ollama は認証なし)
  5. Enter で送信 → ローカルの Ollama サーバから、ollama pull 済みのモデル一覧が自動取得されます

  6. 使いたいモデルを選んで Enter で完了

設定後は /model 画面に「ローカル LLM」のルートが追加され、Blaze の純正ルート(サブスク)といつでも切り替えられます。

動作確認

接続できたら、簡単なメッセージを送って応答が返るか確かめてみてください。

こんにちは、自己紹介してください

応答が返ってくれば接続成功です。

うまく動かない時

モデル一覧が空、または取得に失敗する

  • ollama list でモデルが pull 済みか確認
  • ollama serve または Ollama アプリが起動しているか確認
  • curl http://localhost:11434/api/tags が JSON を返すか確認

ツール(bash / read / edit など)が呼ばれない、または失敗する

  • 使っているモデルがツール呼び出しに対応しているか確認(Ollama のモデルライブラリtools タグの有無)
  • 小さすぎるモデル(〜3B 程度)はツール呼び出しが不安定です。可能であれば 7B 以上を試してください
  • それでも安定しない場合は、別のモデル(qwen2.5-coder 系など)で試してみてください

応答が極端に遅い

  • ローカル LLM はマシンスペックに強く依存します。Apple Silicon Mac の M2 Pro 以上、または GPU 搭載の Windows マシン推奨です
  • 大きいモデルを使っている場合は、より小さいモデル(8B 程度)に切り替えると速くなります

ポートが違う

  • Ollama 側のポートを変更している場合は、ウィザードの Base URL を編集してください。例: http://localhost:11435/v1/chat/completions

Blaze の純正ルートに戻す

/model 画面で「Blaze (サブスク)」を選び直すと、いつでも純正ルートに戻せます。ローカル LLM の設定自体は残るので、また切り替えるのも自由です。