Skip to main content
PromptQuorum
ホーム/ローカルLLM活用/ローカルLLMでWeChatボット:個人アシスタント 2026年版
Productivity & Knowledge Tools

ローカルLLMでWeChatボット:個人アシスタント 2026年版

··Hans Kuepper 著 · PromptQuorumの創設者、マルチモデルAIディスパッチツール · PromptQuorum

WeChatFerry + OllamaをWindowsで使えば、2026年にローカルLLM(Qwen3 8B推奨)を活用したWeChat個人アシスタントボットを構築できます。全データがローカルに留まり、クラウドAPIへの送信は一切ありません。

このページには参考用の第三者製品へのリンクが含まれています。PromptQuorumはいかなるアフィリエイトプログラムにも参加しておらず、これらはコミッションを得ない単なる参照リンクです。リンクのクリックと次のステップはご自身の責任です。これらのリンクはPromptQuorumによる推奨や検証を表すものではありません。

ローカルLLMでWeChatボット:個人アシスタント 2026年版

重要なポイント

  • WeChatFerry + Ollama:2026年のローカルWeChatボット推奨スタック
  • Qwen3 8B:中国語WeChat応答の最良ローカルモデル
  • Windows必須:WeChatFerryはWindows WeChat PCクライアントへのフック
  • セットアップ時間:Pythonに慣れていれば30〜60分
  • クラウドAPIなし:全推論がローカルで完結
  • WeChat利用規約:自動ボット禁止——個人利用のみ
WeChatボットのアーキテクチャ:WeChatメッセージがWeChatFerry(WindowsのDLLインジェクション)をトリガーし、Pythonブリッジ経由でQwen3:8bを実行するOllamaにルーティング、3〜10秒で返信——5段階すべてがローカルで完結しクラウドAPI呼び出しはありません。
WeChatボットのアーキテクチャ:WeChatメッセージがWeChatFerry(WindowsのDLLインジェクション)をトリガーし、Pythonブリッジ経由でQwen3:8bを実行するOllamaにルーティング、3〜10秒で返信——5段階すべてがローカルで完結しクラウドAPI呼び出しはありません。
  1. 1
    Ollamaをインストールし、Qwen3 8Bを取得
    Why it matters: ollama.comからOllamaをダウンロードして実行:`ollama pull qwen3:8b`
  2. 2
    WeChat PCにログイン
    Why it matters: Windows上でWeChatを開き、QRコードをスキャンしてログイン。バックグラウンドでログイン状態を維持したまま実行してください。
  3. 3
    WeChatFerryをインストール
    Why it matters: pip経由でインストール:`pip install wcferry`。WeChatFerryはWeChatプロセスに注入され、メッセージAPIを公開します。
  4. 4
    Pythonメッセージハンドラーを作成
    Why it matters: WeChatFerryクライアント、OllamaのHTTP API呼び出し、メッセージルーティングロジックを含む`wechat_bot.py`を作成します。
  5. 5
    自分宛メッセージでテスト
    Why it matters: "@ai"で始まるWeChatメッセージを自分自身に送信し、ボットが10秒以内に応答することを確認します。
  6. 6
    会話履歴を追加
    Why it matters: 複数ターンの会話コンテキストを可能にするため、連絡先ごとの直近10件のメッセージをdictに保存します。
  7. 7
    バックグラウンドサービスとして実行
    Why it matters: NSSM(Non-Sucking Service Manager)を使用し、Pythonスクリプトを自動起動するWindowsサービスとして実行します。
モデルサイズ中国語品質速度(CPU)速度(8GB VRAM)
Qwen3:8b4.7GB優秀3–5 tok/s30–45 tok/s
Qwen3:14b9GB最良1–2 tok/s15–20 tok/s
Qwen3:3b2GB良好8–12 tok/s60+ tok/s
Llama3.1:8b4.7GB普通3–5 tok/s30–45 tok/s
中国語WeChat応答のモデル別CPU速度:Qwen3:3bが最速で8〜12 tok/s、Qwen3:8bは品質と速度のバランスが良く3〜5 tok/s、Llama3.1:8bは同速度で中国語品質はやや劣り、Qwen3:14bは最高品質で1〜2 tok/s。
中国語WeChat応答のモデル別CPU速度:Qwen3:3bが最速で8〜12 tok/s、Qwen3:8bは品質と速度のバランスが良く3〜5 tok/s、Llama3.1:8bは同速度で中国語品質はやや劣り、Qwen3:14bは最高品質で1〜2 tok/s。

WeChatボットはMacで動作しますか?

いいえ。WeChatFerryはWindowsが必須で、Windows WeChat PCクライアントへのDLLインジェクションを使用します。macOSユーザーはParallels等の仮想マシンでWindowsを動作させることができます。

ボットを使うとWeChatアカウントが凍結されるリスクはありますか?

WeChatは利用規約で自動化されたボットを禁止しています。自動化ツールの使用が検出されたアカウントは、一時停止または永久凍結のリスクがあります。低頻度の個人利用のみに留めてください。

中国語WeChatメッセージに最良のOllamaモデルは?

Qwen3 8Bが品質と速度の最良バランス——優れた中国語理解力、4.7GBで8GB VRAMに収まり、GPUがあれば1〜3秒で応答します。

ボットはグループチャットを処理できますか?

はい。WeChatFerryはルームIDとともにグループメッセージを公開します。on_messageハンドラーを修正してmsg.roomidを確認し、ボットが応答すべきグループをフィルタリングしてください。すべてのグループメッセージに応答しないよう、トリガーキーワードを追加してください。

← ローカルLLM活用 に戻る