浏览器里的本地 AI:用 Ollama 跟任意网页对话
用 Ollama 在本地跑 AI 模型,已经成为开发者和注重隐私的用户的首选方案。如果能把这些本地模型直接接到浏览器,边看网页边提问呢?这篇指南告诉你怎么做。
Ollama 是什么?
Ollama 是一款开源工具,让你在自己的电脑上运行大语言模型。它负责下载、量化和提供模型服务,背后是一个简单的 HTTP API。安装后运行 ollama serve,模型就在 127.0.0.1:11434 上就绪了。
选一个模型
Ollama 库里有几百个模型。下面是几个上手推荐:
- Gemma 4 — Google 最新的开放模型,多种尺寸可选,速度快且均衡。
- Qwen 3.5 — 阿里巴巴的多语言模型,中英文任务都很强。
- Llama 4 — Meta 最新版本,社区支持广泛,微调变体多。
- Mistral Small — 小巧高效,适合日常阅读场景。
- DeepSeek-R1 — 推理能力突出,提供蒸馏版,大多数硬件都能跑。
在 ollama.com/search 浏览完整列表(按热度排序),用 ollama pull <model> 拉取。
不确定你的电脑能不能跑某个模型?用 canirun.ai 查一下——它检测你的硬件,告诉你哪些模型适合你的配置。
把 Ollama 接到浏览器
本地有了 AI 模型是好事,但在终端和浏览器之间来回切换会打断阅读节奏。理想的方式是直接在浏览器里、用你的本地 Ollama 模型对正在读的网页提问。
三步搞定
- 安装 Ollama — 从 ollama.com 下载,然后拉取一个模型:
ollama pull <model> - 启动服务 — 运行
ollama serve(默认监听127.0.0.1:11434) - 安装 PageGrok — 从 Chrome 应用商店获取。它会自动发现你正在运行的 Ollama 模型。
就这样。打开任意网页,点击 PageGrok 图标,开始提问。AI 读取页面内容,用你的本地模型回答——数据不出你的电脑。
为什么用本地 AI 浏览网页?
- 隐私 — 网页内容和对话留在你的设备上,不会发送到云端 API。
- 零成本 — 模型下载好之后,推理免费,没有按 token 计费。
- 无限制 — 想问多少问多少,速度只取决于你的硬件。
- 离线可用 — 模型下载完成后,AI 推理不需要联网。
- 完全掌控 — 自由选择模型、调整上下文长度、随时切换。
用它做什么
- 技术文档 — 快速理解 API 参考,不用逐段阅读
- 新闻分析 — 获取文章的多角度观点,区分论据与观点
- 语言学习 — 对外语内容提问翻译、解释
- 企业场景 — 指向内部 Ollama 实例,为团队提供私有 AI 访问
- 研究阅读 — 总结长文章、提取关键论点、追问细节
使用前须知的局限
- 长页面会被截断。 PageGrok 向模型发送的页面内容上限为 12,000 字符,涵盖大多数文章和文档页。内容更长时,用选择文本模式把模型指向你真正关心的段落。
- 暂停后的第一个问题会慢一些。 PageGrok 设置了
keep_alive: 30m,Ollama 在两次提问之间保持模型在内存里 30 分钟。超过后模型会卸载,下次提问需要重新加载。 - 小模型擅长总结,不擅长推理。 较小的模型做“这个页面说了什么”很可靠。对于密集技术页面的多步推理,建议你验证它的回答。
- PageGrok 读取页面本身的文本。 它遍历当前标签页的 DOM(包括 Shadow DOM),所以页面上渲染的文本都能读到——包括登录后的内容。iframe 里的内容、canvas 元素和浏览器渲染的 PDF 不在读取范围内。
常见问题
怎么知道我的电脑能不能跑某个模型?
用 canirun.ai 查——它检测你的硬件,告诉你哪些模型跑得动。选择你的 GPU 或芯片,就能看到数百个模型的估算速度和显存占用。
能用 Ollama 在本地跑 Grok 吗?
xAI 从未向 Ollama 模型库发布官方 Grok 权重。社区成员上传过 Grok-1 和 Grok-2 的构建,但来源未经验证,且 Grok-1 是 3140 亿参数的混合专家模型,在消费级硬件上不现实。如果你想要本地跑同等水平的模型,从 Ollama 库里挑一个当前主流的大模型即可——PageGrok 全都支持。
PageGrok 支持所有 Ollama 模型吗?
支持。PageGrok 自动发现你本地 Ollama 里加载的任何模型。拉取库里的任何模型,它会立刻出现在 PageGrok 的模型选择器里。
我的数据安全吗?
使用 Ollama(默认模式)时,所有处理都发生在你的浏览器和 localhost 之间。网页内容和对话永远不会通过网络传输。详见隐私政策。
相关指南
- 把 Ollama 接到浏览器:安装配置与 CORS 修复 — 一步步把 Ollama 接到 Chrome 扩展。涵盖安装、用 OLLAMA_ORIGINS 配置 CORS、以及常见连接错误排查。
- 用 LM Studio 搭配浏览器扩展:配置指南 — 把 LM Studio 的本地 AI 服务器接到 Chrome 扩展。如何启动本地服务、配置端点、以及在 LM Studio 和 Ollama 之间切换。
- PageGrok 对比 Page Assist:选哪个本地 AI 扩展 — 诚实对比 PageGrok 和 Page Assist——两个用本地 AI 跟网页对话的 Chrome 扩展。功能差异、配置难度、以及哪个更适合你的工作流。