如何在浏览器里接入本地AI助手:Page Assist完整配置指南
【免费下载链接】page-assistUse your locally running AI models to assist you in your web browsing项目地址: https://gitcode.com/GitHub_Trending/pa/page-assist
Page Assist是一款开源的本地AI浏览器扩展:它把你电脑上正在运行的AI模型(Ollama、LM Studio等)接到浏览器里,在任何网页上给你一个侧边栏和Web UI。如果你不想让网页内容上传到云端,或者希望在阅读时直接让AI回答页面相关问题,值得花10分钟把它配起来。
快速上手:3条命令跑通
前置依赖只有两个:Bun(构建工具)和 Ollama(本地模型服务,也可以换成 LM Studio、llamafile 等任意 OpenAI 兼容端点)。装好后克隆代码并构建:
git clone https://gitcode.com/GitHub_Trending/pa/page-assist cd page-assist && bun install && bun run build这条命令会为 Chrome、Edge 和 Firefox 三个浏览器各生成一份构建产物。Chrome 系浏览器打开chrome://extensions,开启开发者模式,点"加载已解压的扩展程序",选build目录;Firefox 则在about:addons里点"加载临时扩展",选build里的manifest.json。
第一次验证:终端执行ollama list,能看到已拉取的模型(比如 llama3)就算就绪。Ollama 跑在默认地址localhost:11434时会被 Page Assist 自动探测,扩展里的模型下拉框会自动列出它,不需要手工配置。加载扩展后点工具栏图标打开 Web UI,选一个模型发一句"你好",收到回复就算跑通了。注意:如果 Bun 遇到问题,README 里说明可以用 npm 替代。
上手之后:三个最实用的用法
和当前网页对话
读一篇长文档或技术文章时,按Ctrl+Shift+Y在页面右侧打开侧边栏(也可以在页面右键菜单里从 Page Assist 进入),打开Chat with Website开关,然后在输入框直接问"这篇文章的核心结论是什么"。注意这一步:该模式默认需要嵌入模型——它会把页面内容先向量化再检索相关片段。第一次用要么在设置里选一个 embedding 模型,要么在"设置 → Copilot Chat With Website Settings"里关掉Chat with website using vector embeddings,改用整页内容直送模型的方式。
划词右键:总结、翻译、改写
打开一个外文页面,选中一段文字右键,Page Assist 菜单里会列出 5 个内置动作:Summarize、Rephrase、Translate、Explain、Custom。点 Translate,几秒后侧边栏里出现选中文本的英文翻译。想要"检查语法""改得更正式"这类固定动作,可以到"设置 → Manage Prompts → Custom Copilot"自建提示词,模板里用{text}占位符代表选中内容,保存后立刻出现在右键菜单里,无需重启浏览器。
用知识库提问自己的文件
在"设置 → Manage Knowledge"上传 PDF、Docx、Txt、CSV 或 MD 文件。处理完成后,聊天输入框会出现一个知识库块图标,点它选中刚上传的文件,就可以针对这份文件提问了。官方建议的嵌入模型是nomic-embed-text,别拿对话模型顶替它。
技术内幕:浏览器扩展为什么能调本地模型
第一个要解决的是跨域。扩展发起的请求和本地 Ollama 服务属于不同源,浏览器会直接拦下返回 403。Page Assist 的做法是重写请求头让请求放行,但这个自动重写只对http://127.0.0.1:*和http://localhost:*生效——Ollama 跑在别的端口或别的机器上时,要手动开启设置里的 Custom Origin URL,或者在 Ollama 一侧设OLLAMA_ORIGINS=*。
[!NOTE] 为什么要绕这么一圈?因为扩展只能通过浏览器发请求,跨域策略是无法绕过的安全边界。Page Assist 只对本地地址重写请求头,而不是全面放开 CORS,影响面小、也便于排查问题。
第二个是服务商层。Ollama、LM Studio、llamafile,甚至 Chrome 浏览器自带的 Chrome AI(Gemini Nano),都接到同一套接入层,换成哪个,侧边栏的用法都不变。所有模型、对话和知识库数据存在浏览器本地存储,扩展本身不收集个人数据;唯一会连外网的是 share 分享功能,而且可以在设置里直接关掉。
避坑清单:新手最常见的3个报错
连不上、发消息 403现象:选完模型发消息立刻报连接错误或 403。原因:Ollama 地址不在 localhost 范围内,请求被浏览器跨域策略拦截。解决:用localhost:11434默认的 Ollama,或设OLLAMA_ORIGINS=*后重启服务。
开启网页对话时提示缺嵌入模型现象:打开 Chat with Website 被要求配置 embedding。原因:默认 RAG 模式需要文本向量化模型。解决:拉取nomic-embed-text并在设置中选用,或关闭向量模式开关。
构建失败现象:bun install或bun run build报错。原因:Bun 运行时在部分系统上兼容性不稳。解决:README 明确说明可用 npm 替代 bun,命令对应替换即可。
适合谁,不适合谁
Page Assist 最适合已有 GPU 能跑本地模型、又对网页内容隐私敏感的人:读长文、翻译外文页面、基于本地文件提问,全程可以离线完成。反过来,如果你没有 Ollama 或任何本地推理服务,或者主要需要云端 API 的能力(超长上下文、复杂推理),它的价值就很有限。源码为 MIT 协议,仓库地址与上文 clone 命令相同,具体细节可查官方文档 docs/ 和连接排查 docs/connection-issue.md。
【免费下载链接】page-assistUse your locally running AI models to assist you in your web browsing项目地址: https://gitcode.com/GitHub_Trending/pa/page-assist
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考