用 LM Studio 搭配浏览器扩展:配置指南
LM Studio 是一款用图形界面运行本地 AI 模型的桌面应用。如果你偏好 GUI 而非命令行,或者想从 Hugging Face 试用模型而不需手动转换格式,LM Studio 是个好选择。这篇指南讲解如何把它接到 PageGrok。
安装 LM Studio
从 lmstudio.ai 下载并安装。支持 macOS、Windows 和 Linux。
LM Studio 通过图形界面处理模型下载、量化选择和 GPU 卸载——不需要终端命令。
下载模型
- 打开 LM Studio
- 使用搜索栏或模型浏览器找到模型
- 选择量化等级(Q4_K_M 是不错的默认选择——平衡了体积和质量)
- 点击 Download
适合阅读场景的推荐模型:
- Gemma 4 — 快速、均衡
- Qwen 3.5 — 多语言能力强
- Llama 4 — 社区支持广泛
- Mistral — 小巧高效
LM Studio 在下载前就会显示预估的内存用量,提前确认兼容性。
启动本地服务
- 进入 Local Server 标签(某些版本标注为 “Developer”)
- 从下拉菜单选择已下载的模型
- 点击 Start Server
服务默认运行在 http://127.0.0.1:1234。绿色状态指示灯亮起表示就绪。
验证是否生效:
curl http://127.0.0.1:1234/v1/models
应返回包含你加载模型的 JSON 列表。
连接 PageGrok
PageGrok 通过 OpenAI 兼容 API 连接 LM Studio:
- 点击浏览器中的 PageGrok 图标
- 打开设置(齿轮图标)
- 将提供商改为 OpenAI-compatible
- 端点设为
http://127.0.0.1:1234/v1 - API key 留空(LM Studio 本地不需要)
- 保存设置
PageGrok 现在会用你的 LM Studio 模型进行所有对话。
LM Studio 与 Ollama 对比
两者都能很好地配合 PageGrok 使用。选择建议:
| LM Studio | Ollama | |
|---|---|---|
| 界面 | GUI——可视化模型管理 | CLI——终端命令 |
| 自动发现 | 需手动配置端点 | PageGrok 自动检测 |
| 模型格式 | Hugging Face 的 GGUF | Ollama 库(预打包) |
| 启动方式 | 点击按钮 | ollama serve |
| 适合 | 偏好 GUI、想浏览 Hugging Face 模型的用户 | 习惯终端、想要最简 PageGrok 体验的用户 |
两者可以同时安装。只需一次运行一个服务,或者在 PageGrok 里指向当前活跃的那个。
常见问题排查
| 症状 | 原因 | 解决 |
|---|---|---|
| “连接失败” | LM Studio 服务未启动 | 打开 Local Server 标签并点击 Start Server |
| “模型未加载” | 服务标签中未选择模型 | 启动前从下拉菜单选择模型 |
| 回复为空 | 模型太小处理不了页面内容 | 换一个更大的模型(8B+) |
| 非常慢 | 模型超出内存 | 使用更小的量化或更小的模型 |
| CORS 错误 | LM Studio 很少出现(默认允许所有来源) | 更新到最新版 LM Studio |
切换提供商
PageGrok 记住上一次的提供商设置。切换方法:
- 切到 LM Studio:设置 → 提供商:OpenAI-compatible → 端点:
http://127.0.0.1:1234/v1 - 切到 Ollama:设置 → 提供商:Ollama → 端点:
http://127.0.0.1:11434(或恢复默认)
切换即时生效,无需重启。
常见问题
PageGrok 能自动发现 LM Studio 吗?
不能自动发现。LM Studio 使用 OpenAI 兼容的 API 格式,端口不同(1234 vs 11434)。在 PageGrok 设置中选择 'OpenAI-compatible' 作为提供商,指向 http://127.0.0.1:1234/v1 即可。
能在 LM Studio 和 Ollama 之间切换吗?
可以。在 PageGrok 设置中切换提供商和端点。根据当前运行的服务器随时切换,同一时间只需运行一个。
哪些模型支持 LM Studio?
LM Studio 支持 GGUF 格式模型。Hugging Face 上大多数热门开放模型都有 GGUF 版本,用内置的模型浏览器即可找到并直接下载。
LM Studio 免费吗?
LM Studio 个人使用免费。它提供图形界面来下载、管理和运行本地模型,不需要命令行操作。
相关指南
- 浏览器里的本地 AI:用 Ollama 跟任意网页对话 — 把 Ollama、LM Studio 或 oMLX 里的本地模型接到你正在看的网页。安装、推荐模型、使用场景和真实局限。
- 把 Ollama 接到浏览器:安装配置与 CORS 修复 — 一步步把 Ollama 接到 Chrome 扩展。涵盖安装、用 OLLAMA_ORIGINS 配置 CORS、以及常见连接错误排查。