运行效果如下
,打码的地方,不适合小朋友观看



显存给空出来, 如果跑显存(qwen3:4b的模型差不多占用2.6g左右显存)

下载安装Ollama:官网下载安装包,全程开魔法。安装后无需登录注册(国内手机号收不到验证码),直接使用。
修改模型存储路径:打开Ollama界面点击
Settings,在Model location中设置模型保存到本地其他盘符,避免占满C盘。下载Qwen模型:在下拉框输入模型名(如
qwen3:4b)后回车,模型开始自动下载。对照体积/显存表选择适合自己硬件的版本(雪狼推荐4b约2.6GB显存)。配置CPU运行:新建环境变量
OLLAMA_LLM_LIBRARY值为cpu,重启Ollama即可让模型跑在CPU上,释放GPU显存给ComfyUI等其他应用。如无效可加OLLAMA_NUM_GPU:0并重启电脑。
那么说下正事 跑cpu+内存一个前提, 雪狼是amd9900x 12核24线程+64g内存 所以合理利用下cpu的算力。 注意,安装、下模型的时候, 全程得开魔法! 用的时候不用开魔法,因为都是本地跑
官网地址:https://ollama.com/ 划下来有一个下载的。 然后本地安装下

安装完,不用去登录、注册啥的, 那个要国外的手机号, 国内手机号我记得是收不到验证码, 当然你要试也可以试。 第三方授权登录后,还是要验证手机。 所以不用去登录,不影响 进来界面先点Settings


📊 Qwen 全系列精简对照表(仅含模型名称与体积/显存)
| Qwen1.5 | ||
| Qwen2 | ||
| Qwen2.5 | ||
| Qwen2.5-Coder | ||
| Qwen3 | ||
| Qwen3.5 | ||
| Qwen3.6 | ||
然后就是模型位置,你输入哪个模型,他如果没出来 你输入完回车下,他就出来了 选中之后,你随便发1两句他就会开始下载模型 所以这里还是得开魔法


右键右小角的ollama这边会出来一个update的更新ollama的按钮, 下图因为我更新过,所以他就没有这个按钮,你点下去等他更新就好

等他下完模型后, 你就可以和他聊天了。


这里模型就很多了 点一个进去之后 下滑就有模型的名字和模型多大

你名字复制一下后,在框框输入, 在发一句话,他自己去下载了 对了这个得魔法!!!

然后说下Ollama怎么改cpu来跑 我的电脑右键属性

搜环境变量

这里新增一个环境变量OLLAMA_LLM_LIBRARY:cpu

然后保存下, 右下角Ollama给退出重启 你在试试。

这里其实我不确定你能不能一次成 因为在这之前我动过很多命令, 但是真正生效的是配了上图的环境变量。 所以你试下,如果他还是占用显存,你重启下电脑 如果在不行,就在加一个用户变量OLLAMA_NUM_GPU:0
雪狼之夜ps:既然都看到这行了,不如给个3连,亲~~~
☟
夜雨聆风