浏览器扩展能读到什么、能做什么:只读和自动化的差别

发布于 2026年8月28日 · 更新于2026年8月28日

浏览器给扩展划的权限范围

浏览器扩展安装时会向浏览器声明它需要哪些权限,浏览器按这份声明弹出提示,装完之后也一直按这份声明约束它。这里面对读网页影响最大的是网站访问权限:一个扩展要在某个网站上做事,就得先拿到这个网站的访问权限。声明范围可以窄到一个域名,也可以宽到所有网站,Chrome 在安装时会用「读取和更改您在所有网站上的数据」这样一句话把范围告诉你。

拿到网站访问权限之后,扩展可以往页面里注入一段脚本,这段脚本和页面本身的脚本站在同一个位置上,能读到页面的结构和文本。同一个位置也意味着它有条件在页面上点击按钮、往输入框里写字、提交表单。浏览器给的是同一份能力,具体用到哪一步由扩展自己决定,这一点是后面所有判断的起点。

还有一类更克制的声明方式,权限只在你主动点击扩展图标的那一刻生效,对当前这一个标签页有效,你不点它就什么都读不到。Chrome 本身也提供了一个开关,在扩展的详情页里可以把网站访问权限改成「点击时」「在特定网站上」或者「在所有网站上」,这个开关由你控制,装完之后随时能改。

只读和自动化的差别

只读工具做的事是把页面上的文本取出来交给模型,然后把回答显示给你。它对页面本身没有任何改动,你刷新一下页面,一切和它介入之前一样。这类工具的风险集中在一个问题上:这些文本被送到哪里去了,送过去之后被怎么处理。

自动化工具要替你走完一段流程,所以它需要在页面上真的操作:点击按钮、填写表单、触发提交。这类操作会改变你账号里的状态,发出去的消息收不回来,提交的订单要走退款流程,改掉的设置得手动改回去。判断失误的代价在这里和只读工具完全不同,一个是内容去了不该去的地方,一个是账号里发生了你没打算发生的事。

登录之后的内容让这个差别更值得关注。扩展在你自己的浏览器会话里运行,你在屏幕上看得到的内容,页面脚本就读得到,公司内网、邮箱、后台系统都在这个范围里。扩展本身不能绕过登录,你打不开的页面它也打不开,所以要看的是范围之外的两件事:这些内容有没有离开你的机器,以及这个扩展有没有能力在这些页面上替你操作。

装之前值得花两分钟看的几项。 商店页面上有一栏隐私权做法,开发者要在这里声明收集哪些数据、有没有卖给第三方、有没有用于和核心功能无关的用途,声明内容和实际不符会被下架,所以这一栏有约束力。功能描述里写着自动填表、代你操作、无人值守走完流程的,按自动化工具的标准看待。装完之后在浏览器的扩展详情页里可以逐条看到实际声明的权限,也可以在这里把网站访问权限收窄。最后看一眼它有没有一份写明数据怎么处理的隐私说明。

在浏览器里怎么用上

按上面的标准看,一个只做阅读的 AI 扩展应该把自己的能力限制在读取文本这一件事上。

PageGrok 是一个只做网页阅读的 Chrome 侧边栏。打开面板时它读取当前标签页里已经渲染出来的文本,你也可以只框选页面上的一块或几块区域再提问。它不点击页面上的任何元素,不往输入框里写字,不提交表单,也不会去抓取别的网址。判断读得到什么的标准很简单:你在标签页里看得到的文本,它就能读到,其中包括登录之后才显示的内容和前端动态渲染出来的页面。

安装时 Chrome 会提示它可以读取你访问的网站上的数据,这是读取当前页面必须的一项。拿到这个权限之后它做的事只有取文本。你可以在扩展详情页里把网站访问权限改成只在点击时生效,改完侧边栏照常工作。

内容送到哪里由你选。用内置 AI 时,你提交的内容会发到 PageGrok 的服务生成回答,服务端不存储页面文本、问题和回答,也不用于训练。接本机的 Ollama、LM Studio 或者 Apple Silicon 上的 oMLX 时,页面内容只在浏览器和你自己机器上的模型之间流动。

安装 PageGrok →

延伸阅读:总结任意网页在浏览器里用本地 AI

常见问题

装一个 AI 阅读扩展,要先配置什么吗?

PageGrok 装完打开侧边栏就能对当前页面提问,内置 AI 用的是云端轻量模型,不需要注册账号,也不需要填 API Key。它只读取当前标签页里已经显示出来的文本,不点击、不填表、不去抓别的网址。

扩展能看到我登录之后才能看到的内容吗?

能。扩展在你自己的浏览器会话里运行,你在屏幕上看得到的文本,页面里的脚本就读得到,这里面包含登录之后才显示的内容。扩展做不到的是绕过登录,你自己打不开的页面它也打不开。值得看清楚的是这些内容之后去了哪里。

怎么分辨一个扩展是只读的还是能替我操作的?

看它宣传的功能。写着自动填表、自动下单、代替你走完流程的,属于自动化工具,它需要在页面上点击和输入。写着阅读、总结、翻译、问答的,通常只需要读取文本。装完之后在浏览器的扩展详情页里还能逐条看到它声明了哪些权限。

PageGrok 读得到哪些内容?

当前标签页里以文本渲染出来的内容都读得到:普通文章和文档、登录之后才显示的后台和内部系统、前端加载完成后才拼出来的页面。信息密度高的长页面可以框选一个或多个主题区域,只把这几块交给模型,回答更贴题。

就在你正在读的这个页面上试一下

内置 AI 无需配置、无需注册,装完即可试用。也可以连接自己的模型。