乐于分享
好东西不私藏

开源浏览器 AI 助手,不需要联网就能帮你阅读网页、翻译文章、处理 PDF 和图片

开源浏览器 AI 助手,不需要联网就能帮你阅读网页、翻译文章、处理 PDF 和图片

NativeMind 是一个开源的浏览器 AI 助手扩展,完全在用户本地设备上运行(支持 WebLLM 和 Ollama),无需联网即可使用,注重隐私保护,兼容 Chrome、Firefox 和 Edge 浏览器。

简单来说,它就是一个装在你浏览器里的"离线 AI 助手",不需要联网就能帮你阅读网页、翻译文章、处理 PDF 和图片。

已关注
关注
重播 分享
已关注
关注
重播 分享

要点

  • 主打"隐私优先" :无追踪、无数据收集,所有 AI 推理均在用户本地设备完成,无需联网即可使用。
  • 多功能 AI Agent(智能体):具备自主任务执行能力,可理解复杂请求并拆解为具体步骤;支持多步问题解决,能处理需要多种工具和推理的复杂工作流;具备上下文感知,能理解当前标签页上下文做出智能决策,并无缝集成各种工具。
  • 双本地模型后端支持:同时支持 WebLLM(通过 WebAssembly 在浏览器内直接运行,无需安装额外软件,默认提供 Qwen3-0.6B 模型用于快速评估与测试)和 Ollama(调用本机部署的自托管本地服务器,性能更强,支持更多本地大模型)。
  • 全场景生产力工具:不仅覆盖网页摘要、跨标签页上下文对话、双语对照翻译,还支持 PDF 交互问答(支持智能文本提取)、图像对话(理解屏幕截图和上传的图片)以及高级写作辅助(重写、纠错、语气调整、创意改写等)。
  • 端侧性能突破:得益于模型效率的提升,本地运行的 Qwen3-4B(比 Qwen2.5-72B 小 18 倍但性能超越)、Gemma3-4B(参数量少 6.75 倍,性能匹敌 Gemma2-27B 且具备优秀的图像识别能力)以及 Phi-4(在数学推理和竞赛问题上超越 Gemini Pro 1.5)均可在本地高效运行,无网络延迟且无 API 额度限制。

安装方式

NativeMind 提供两种安装途径:

方式一:应用商店一键安装(推荐,最简单)

直接从各浏览器官方商店(如 Chrome Web Store 或 Firefox Add-ons)下载安装,或通过官网 nativemind.app 跳转安装。

方式二:从源码手动构建(适合开发者)

安装运行(开发环境):

  1. 克隆仓库:git clone https://github.com/NativeMindBrowser/NativeMindExtension.git
  2. 安装依赖:pnpm install
  3. 启动开发:pnpm dev(Chrome)或 pnpm dev:edge(Edge)
  4. 构建打包:pnpm zip:beta(开发包)/ pnpm zip:prod(生产包)

基本使用流程

安装好扩展并将其固定到工具栏后,点击 NativeMind 图标即可使用:

  1. 选择 AI 后端 —— 决定由谁来跑 AI:

    • WebLLM:AI 直接运行在浏览器中,利用 WebAssembly 技术,零门槛开箱即用,但对系统内存有要求(建议 8GB+ RAM)。
    • Ollama:需要在电脑上安装 Ollama 并下载模型(默认运行在本地 11434 端口),可充分调用系统资源,性能更强、模型选择更多。
  2. 加载一个模型:选择后端后,加载对应的 AI 模型(如 Deepseek, Qwen, Llama, Gemma, Mistral, Phi 或 gpt-oss 模型)。

  3. 开始使用:打开任意网页,在侧边栏中调用 NativeMind,就可以让它帮你翻译页面、总结内容、解释文字等。

常见问题

  • 跑起来特别慢? —— WebLLM 模式下关闭其他占用内存的标签页;Ollama 模式下确认电脑配置够用。也可以试试换个小一点的模型。
  • 翻译或总结功能不生效? —— 确认模型已加载完成;刷新页面重试;检查页面内容是不是可选中文本(图片里的文字 AI 读不到)。

项目由 NativeMind(主要贡献者 tonyhu-012 等) 开发,采用 AGPL v3.0 协议。当前 1.1k Stars

项目地址:https://github.com/NativeMindBrowser/NativeMindExtension