ブラウザでローカルAI:Ollamaであらゆるウェブページと対話
OllamaでAIモデルをローカル実行することが、開発者やプライバシーを重視するユーザーの定番になっています。そのローカルモデルをブラウザに直接接続して、閲覧中のウェブページとチャットできたら?このガイドでその方法をお伝えします。
Ollamaとは?
Ollamaは、大規模言語モデルをローカルマシンで実行するためのオープンソースツールです。モデルのダウンロード、量子化、サービング提供をシンプルなHTTP APIで行います。インストール後にollama serveを実行すれば、127.0.0.1:11434でモデルが利用可能になります。
モデルを選ぶ
Ollamaライブラリには数百のモデルがあります。まずはこの5つがおすすめです:
- Gemma 4 — Googleの最新オープンモデル。複数サイズがあり、高速でバランスが良い。
- Qwen 3.5 — Alibabaの多言語モデル。英語・中国語タスクに強い。
- Llama 4 — Metaの最新モデル。コミュニティサポートが厚く、ファインチューン済みバリエーションが豊富。
- Mistral Small — コンパクトで効率的、日常的な読み物に最適。
- DeepSeek-R1 — 推論能力に優れ、ほとんどのハードウェアで動作する蒸留版も提供。
ollama.com/searchで人気順の全リストを確認し、ollama pull <model>で取得できます。
お使いのマシンで特定のモデルが動くか不安ですか? canirun.aiでチェックしましょう。ハードウェアを検出して、あなたの環境に合うモデルを表示します。
Ollamaをブラウザに接続する
ローカルAIモデルがあっても、ターミナルとブラウザの切り替えは読書の流れを妨げます。理想的なセットアップは、閲覧中のウェブページに対して、ブラウザ内で直接ローカルOllamaモデルを使って質問できることです。
3ステップでセットアップ
- Ollamaをインストール — ollama.comからダウンロードし、モデルを取得:
ollama pull <model> - サーバーを起動 —
ollama serveを実行(デフォルトで127.0.0.1:11434でリッスン) - PageGrokをインストール — Chromeウェブストアから入手。実行中のOllamaモデルを自動検出します。
以上です。任意のウェブページを開き、PageGrokアイコンをクリックして質問を始めましょう。AIがページの内容を読み取り、ローカルモデルで回答します。データはあなたのマシンから出ません。
なぜローカルAIでウェブを閲覧するのか?
- プライバシー — ページコンテンツと会話はデバイス内にとどまります。クラウドAPIへのデータ送信はありません。
- APIコストゼロ — モデルを手に入れたら、推論は無料。トークン課金はありません。
- 制限なし — 好きなだけ質問でき、速度はハードウェア次第です。
- オフライン対応 — モデルダウンロード後は、AI推論にインターネット接続は不要です。
- 完全なコントロール — モデルの選択、コンテキスト長のカスタマイズ、いつでもモデル切り替えが可能。
活用例
- 技術ドキュメント — APIリファレンスを段落ごとに読まずにすばやく理解
- ニュース分析 — 記事の多角的な視点を得る、主張と根拠を区別する
- 語学学習 — 外国語コンテンツの翻訳や説明を質問
- 企業利用 — 社内Ollamaインスタンスに接続し、チーム全体でプライベートAIアクセス
- リサーチ — 長文記事の要約、キーポイントの抽出、追加質問
使い始める前に知っておくべき制約
- 長いページはトリミングされます。 PageGrokがモデルに送信するページコンテンツの上限は12,000文字です。ほとんどの記事やドキュメントページはカバーできます。より長いコンテンツの場合は、テキスト選択モードで必要な部分を指定してください。
- 間隔を空けた後の最初の質問は遅くなります。 PageGrokは
keep_alive: 30mを設定しており、Ollamaは質問間で30分間モデルをメモリに保持します。それを超えるとモデルがアンロードされ、次の質問ではモデルの再ロード時間がかかります。 - 小さなモデルは要約が得意、推論は苦手。 小型モデルは「このページの内容は?」には確実に答えます。密度の高い技術ページでの多段階推論では、回答の検証をおすすめします。
- PageGrokはページ自体のテキストを読み取ります。 現在のタブのDOM(Shadow DOM含む)をたどるため、テキストとしてレンダリングされたものはすべて読み取れます。ログイン後のページも対象です。iframe内のコンテンツ、canvas要素、ブラウザ表示のPDFは読み取り対象外です。
よくある質問
自分のPCで特定のモデルが動くか確認するには?
canirun.aiをお使いください。ハードウェアを検出し、どのモデルが快適に動作するか表示します。GPUやチップを選択すると、数百のモデルの推定速度とメモリ使用量が確認できます。
OllamaでGrokをローカル実行できますか?
xAIはOllamaモデルライブラリに公式のGrokウェイトを公開していません。コミュニティメンバーがGrok-1やGrok-2のビルドをアップロードしていますが、出所は未確認で、Grok-1は3140億パラメータのMoEモデルであり、一般的なハードウェアでの実行は現実的ではありません。同等の品質をローカルで求めるなら、Ollamaライブラリから現在の主要な大規模モデルをお選びください。PageGrokはすべて対応しています。
PageGrokは全てのOllamaモデルに対応していますか?
はい。PageGrokはローカルのOllamaにロードされたあらゆるモデルを自動検出します。ライブラリからモデルをpullすれば、すぐにPageGrokのモデル選択画面に表示されます。
データは安全ですか?
Ollama(デフォルト)使用時は、すべての処理がブラウザとlocalhost間で行われます。ページコンテンツや会話がネットワーク経由で送信されることはありません。詳しくはプライバシーポリシーをご覧ください。
いま読んでいるこのページで試せます
PageGrok はローカルのモデルを任意のブラウザタブに接続します。無料、データは端末内に留まり、登録も不要です。
関連ガイド
- Ollamaをブラウザに接続:セットアップとCORS修正 — OllamaをChrome拡張機能に接続する手順ガイド。インストール、OLLAMA_ORIGINSによるCORS設定、よくある接続エラーの対処法。
- LM Studioをブラウザ拡張機能で使う:セットアップガイド — LM Studioのローカルサーバーをブラウザ拡張機能に接続する方法。サーバー起動、エンドポイント設定、OllamaとLM Studioの切り替え。
- PageGrok vs Page Assist:どちらのローカルAI拡張機能を選ぶか — PageGrokとPage Assistの正直な比較。ローカルAIでウェブページとチャットする2つのChrome拡張機能の機能差、セットアップ、ワークフロー別の選び方。