Page Assist 完整指南:让本地 AI 模型看懂你正在浏览的网页
【免费下载链接】page-assistUse your locally running AI models to assist you in your web browsing项目地址: https://gitcode.com/GitHub_Trending/pa/page-assist
你在读一份长文档,想追问第三段的数据口径,却不想把整页内容粘贴进某个云端对话框?Page Assist 是一个开源浏览器扩展,让运行在你自己电脑上的本地 AI 模型直接读你眼前的网页并作答——适合处理敏感资料、注重隐私的浏览用户。
快速跑起来:从克隆到验证成功
前置条件只有三样:一个 Chromium 系浏览器(Chrome、Edge、Brave 等)或 Firefox、构建工具 Bun(用 npm 也可以)、以及一个本地 AI 服务端,比如 Ollama 或 LM Studio。
git clone https://gitcode.com/GitHub_Trending/pa/page-assist cd page-assist bun install bun run build构建完成后产物在build目录里,一次构建同时覆盖 Chrome、Edge 和 Firefox。Chromium 系浏览器:打开chrome://extensions,开启"开发者模式",点击"加载已解压的扩展程序"并选择build目录;Firefox:在about:addons中通过"加载临时附加组件"选择build目录下的manifest.json。
提示:装好后打开任意网页,按
Ctrl+Shift+Y应弹出侧边栏,按Ctrl+Shift+L应在新标签页打开 Web UI——两处都出现 Page Assist,且能在设置里看到你的 Ollama 模型列表,就说明部署成功了。连不上服务端时,参考 docs/connection-issue.md 排查。
核心能力:三个最有体感的功能
读到一半想追问?把当前页直接交给模型
你打开一篇技术文章或一份财报,按Ctrl+Shift+Y调出侧边栏,打开Chat with Website选项,然后直接问"这个结论的数据来源是什么"。模型基于页面内容作答,长页面默认先由嵌入模型切成向量片段存本地,再按问题检索相关部分(RAG),所以不会因为页面太长而"失忆"。细节见 docs/sidebar/chat-with-website.md。
不想挤在侧边栏?开个独立的网页版
点击扩展图标,或按Ctrl+Shift+L,Page Assist 会打开一个类 ChatGPT 的独立网页界面 🖥️ 它和侧边栏共用同一套对话历史与设置,适合需要大窗口看代码块、表格和 Mermaid 图的场景。常用应用内快捷键:Ctrl+Shift+O新建对话、Ctrl+E在普通聊天与网页问答间切换,完整列表在 docs/shortcuts.md。
手头资料比网页多?建一个私有知识库
把 PDF、Docx、Txt、CSV、MD 拖进Settings > Manage Knowledge的Add New Knowledge,处理完成后输入框会出现一个知识库图标,勾选即可让这些文档参与问答 ⚙️ 前提是在 RAG 设置里配一个嵌入模型(官方推荐nomic-embed-text)。所有文件和向量都只存在浏览器本地,就像给模型配了一个只属于你的资料柜。使用注意见 docs/features/knowledge-base.md。
设计内幕:几个关键取舍
为什么数据全部留在浏览器里
Page Assist 不收集任何用户数据,聊天记录、设置、知识库向量全部存在浏览器本地存储中,唯一的例外是可选的分享功能(Page Share),且可在设置中关闭。这么做是为了让"隐私"不依赖你信任某个后端的承诺——数据从未离开设备,代码又是开源的,你可以自己逐行验证。详见 PRIVACY.md 与 docs/privacy.md。
为什么"操作网页"被拆成独立扩展
让 AI 替你点击、填表、滚动页面(Page Action)需要debugger这类强权限。如果把它打包进主扩展,每个只想聊天的用户都被迫授予这些权限。拆成独立的伴侣扩展后,主扩展保持最小权限集,权限审核更简单,安全边界也更清晰——你不用它时,它根本不存在。设计理由完整写在 docs/features/page-action.md。
为什么网页问答默认要先过一遍嵌入模型
把整页原文直接塞给模型,短页够用,长页既贵又容易丢重点。Page Assist 默认走 RAG:先切块、本地向量化、按需检索,模型只处理和问题相关的片段。代价是需要额外配置一个嵌入模型;如果你只需要处理短页面,可以在侧边栏设置里关掉Chat with website using vector embeddings,改为直接发送原文并调大内容上限——两种路线都保留着,选择权在你。
进阶与调优
低配设备怎么先跑顺
模型是最大开销,优先在 Ollama 里拉一个 8B 级别的小模型,别一上来就选 70B。同时注意:知识库的向量存在浏览器存储里,官方文档明确警告大文档量可能拖慢性能,资料多而机器慢时,宁可缩小知识库范围,或干脆用网页问答替代知识库。
把联网搜索变成默认动作
侧边栏和 Web UI 都有地球图标的开关,打开后模型可以调用 Google、DuckDuckGo、Brave、百度、Bing、Searxng 等搜索源(完整列表见 docs/features/internet-search.md)。嫌每次手动开麻烦的话,去Settings > General Settings > Manage Web Search打开Internet Search ON by default并保存。想要模型抓取并通读具体网页,关闭Perform Simple Internet Search即进入 Deep Search Mode。
换一套顺手快捷键
浏览器级快捷键(Ctrl+Shift+Y/Ctrl+Shift+L)在chrome://extensions/shortcuts里改;应用内快捷键如Ctrl+E切换模式则可在扩展设置中调整,各浏览器入口不同,按 docs/shortcuts.md 的分步操作即可。
延伸玩法
想给模型接更多"手",可以连 MCP 服务器(支持 Streamable HTTP,含 Bearer Token 与 OAuth 2.1 认证,并支持逐工具的人审开关),配置入口在Settings > MCP Settings,教程见 docs/features/mcp.md;对特定站点(亚马逊、Twitter、Wikipedia、Google Docs 等)的正文提取逻辑集中在 src/parser/ 目录,想为新站点加解析器从这里入手;浏览器自动化伴侣扩展的源码在 extensions/page-action/。想贡献代码或提需求,先看 CONTRIBUTING.md。
常见疑问
不联网也能用吗?能。核心对话、网页问答、知识库都走你本地的 Ollama/LM Studio 端点,不依赖外网;只有联网搜索功能需要网络。
对话会被上传吗?不会。全部数据存在浏览器本地,只有你主动使用 Page Share 分享时才产生外部通信,且可随时在设置中禁用。
模型需要自己准备吗?需要。Page Assist 本身不包含模型,你需要先装好 Ollama 或任一 OpenAI 兼容端点(LM Studio、llamafile 等),再在扩展设置里指向它。
Firefox 上功能少吗?侧边栏、网页问答、Web UI 在 Firefox 上都有,唯一例外是 Page Action——它依赖 Chromium 的调试协议,仅支持 Chrome、Brave、Edge 系浏览器。
【免费下载链接】page-assistUse your locally running AI models to assist you in your web browsing项目地址: https://gitcode.com/GitHub_Trending/pa/page-assist
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考