ARTICLE · 979759
AI 工具台|合同别丢云端,先让模型住进硬盘
AI 三餐 · 工具台 · 今日一句
合同、病历、聊天记录,能不离开这台电脑,就别送去别人的机房。
🍱 今天这道菜
Ollama · 💡 值得一试
开发方:Ollama Inc. · MIT 开源(GitHub ollama/ollama)
价格:本机跑模型免费、不限次数;云端免费档为轻度用量,Pro $20/月或 $200/年,Max $100/月(新购已暂停),Team $25/席/月起、最少 5 席(2026-08-30 查证官网定价页)
平台:macOS 14 及以上 / Windows 10 及以上 / Linux;有菜单栏或任务栏应用
热度:GitHub 179,100 stars · 2026-08-30;Gemma 4 在 Ollama 库 2260 万次下载,3 天前更新
🍱它解决什么问题
云端聊天很方便,代价是字要经过别人的服务器。Ollama 把开源模型装进你自己的电脑,对话在本机算完。
改一份不能外传的稿。把合同条款或客户邮件贴进去,让它改口气、列风险。本地模式下,这些字不会送到 ollama.com。
断网也要能问。给孩子讲一道题,或自己啃一份说明书。模型下完后,官方写明可以完全离线跑。
把纪要变成待办。把会议记录丢进去,问“下周三条必须做的事”。它不会自动进你的日历,但能先帮你从一摊字里抠出动作。
📎 Ollama 官网 · 官方 FAQ(本地不回传提示词) · 2026-08-30
🧠背后原理
把它想成“会说话的本地软件”。你先下载一份模型文件(权重),体积按型号从几 GB 到几十 GB。提问时,软件在内存或显卡里做矩阵运算,吐出下一个字。本地档不经过外网;只有你主动跑带 :cloud 后缀的云模型,提示词才会短暂送到 Ollama 的机房(官网写明不训练、不长期存)。
🛠跟着做
门槛先说清:装软件本身几分钟;第一次下模型按网速走,gemma4:e2b 官方标 7.2GB,普通宽带可能要十几分钟到一小时。内存吃紧就选这一档,别一上来下 31B。
1打开下载页
访问 ollama.com/download,按系统取安装包。Mac 官方要求 macOS 14 或更新;Windows 要求 Win10 或更新。预期:下到安装程序,不是网页聊天框。
2装完看菜单栏
双击安装并打开应用。Mac 菜单栏、Windows 任务栏应出现 Ollama 图标。官方 FAQ 写:这两端会在登录时自动启动,可在系统登录项里关掉。
3拉一个够用的小模型
打开终端,输入 ollama run gemma4:e2b。这是 Google DeepMind 开源的 Gemma 4 边缘档,Ollama 库页标 7.2GB、128K 上下文。预期:先看到下载进度,结束后出现对话提示符。
4丢一句人话进去
官方入门示例是:用一段话解释天空为什么是蓝的。你也可以贴一段自己的会议纪要,问“列出三条待办,每条带负责人”。预期:终端里逐字往外蹦回答。
5看它到底占了哪块内存
另开一个终端,输入 ollama ps。FAQ 写:Processor 列若是 100% GPU,模型全在显卡;若大量落到 CPU,就会明显变慢。这是判断“电脑扛不扛得住”的最快一眼。
6需要彻底断云就关掉
只跑本机模型可以不管。若要禁用云模型和网页搜索,官方 FAQ 写:在 ~/.ollama/server.json 设 "disable_ollama_cloud": true,或环境变量 OLLAMA_NO_CLOUD=1,然后重启应用。日志里应出现 Ollama cloud disabled: true。
📎 Quickstart · Gemma 4 模型页 · 2026-08-30
📊公开数据
入门档别跟旗舰档比参数。Gemma 4 库页把 E2B 标成面向端侧;X 用户 @Berserkr_777 在 8 月下旬给更大的 26B A4B 打了全天使用 9/10、编程 7/10,说它是这个量级里适合整天开着的型号之一——那是另一档体积,笔记本先别跟风。
📊 关键数字
7.2 GB
gemma4:e2b 官方体积 · ollama.com/library/gemma4 · 2026-08-30
“Ollama runs locally. We don’t see your prompts or data when you run locally.”—— Ollama FAQ / 隐私政策摘要 · 政策页标注 Last updated: March 2026
🔒隐私与账单
本地推理:官方写明看不到你的提示词和回答。云模型:短暂处理请求,不用于训练,机房主要在美国,也可能转到欧洲、新加坡。支付走 Stripe。免费本机不限次;云用量按计划和模型“用量等级”扣,免费档会话限额每 5 小时重置、另有每周限额。Pro 可在 ollama.com/settings 看用量;删号走 settings/profile。订阅变更以账号页为准,别在应用商店里找第二套扣费。
⚠️坑与边界
模型塞不进显存就会掉到内存,速度会断崖。X 用户 @datachad、@AIAppsAPI 都把“以为在用 GPU、其实在用内存带宽”当成慢的主因。先 ollama ps,再决定要不要换更小的型号。 推完推理,显存不一定立刻还你。@D_Ochandiano 写过:切去剪视频或画图时容易显存爆,得结束 ollama 相关进程,不能指望它自己腾干净。 默认上下文只有 4096 token(官方 FAQ),长文会被悄悄截断。需要更长再改 OLLAMA_CONTEXT_LENGTH 或对话里 /set parameter num_ctx。 别把 11434 端口暴露到公网。默认绑 127.0.0.1;有人拿公网 IP 开着无鉴权接口,等于把提示词和算力敞着。
📎 @D_Ochandiano · @datachad · FAQ 默认上下文
🔁替代对比
- LM Studio Bionic
:更像图形界面。官方定价页 2026-08-30:本地免费 $0,云按量、宣称零留存。你讨厌终端、只想点按钮,选它。 - 腾讯元宝 / DeepSeek 网页
:零安装。数据走它们的服务器。你能接受上云、只想马上问一句,选它们。 - Open WebUI
:GitHub 149,400 stars(2026-08-30),给 Ollama 套一层网页聊天。你已经会跑 Ollama、还想要对话历史和上传文件,再加这一层;新手先别叠。
🗣 Leif 怎么看
一个月后还值得装。不是因为它突然变聪明,是因为“字留在自己硬盘”这条需求不会过季。先跑 gemma4:e2b,能聊再换大的。云功能能关就关。别为了追 31B 把笔记本拖成电风扇。
— AI 三餐 · 明天中午加菜 —