乐于分享
好东西不私藏

千问 27B 开源四天 570 万下载,最大差评是想太多:画只鹈鹕思考 21 分钟

千问 27B 开源四天 570 万下载,最大差评是想太多:画只鹈鹕思考 21 分钟

上周五深夜阿里把 Qwen3.8-27B 白送,本号的建议是「周末装起来跑」。一个周末过去,验收数据到了:官方加社区量化仓合计 493 万次下载,算上衍生版逼近 570 万,把 Meta 同期的开源对手按在地上打。然后我翻社区实测,发现骂声最集中的地方特别清奇——它不是不行,是太爱思考。Simon Willison 让它画一个圆,它琢磨了几分钟,交出一个绝美的动画艺术品。唯一的问题是,没人要动画。

先补前情:8 月 14 日深夜,阿里开源 Qwen3.8-27B,27B 稠密模型、原生看图看视频、Apache 2.0 无门槛商用,量化后 17GB 就能塞进消费级显卡。本号 8/15 写过首发验货,这篇是开源第四天的回访。

下载潮:三天半,五倍于 Meta

HuggingFace 的账本(8/17 深夜快照):unsloth 家的 GGUF 量化一家就被下载 272.7 万次,LM Studio 社区版 70 万,官方 FP8 版 49.6 万,官方原版 41.5 万,加上其余主流量化仓,8 个仓合计 493 万次,而权重实际开放才三天半。对照组是 Meta 本月 9 号发的 Muse Glimmer-30B,早发五天,官方加 unsloth 合计 109 万。同级、同期、同开源,五倍差距。

阿里顺势给媒体发了份声明:千问系列近六个月全球下载超 30 亿次。这是全渠道累计口径,别跟单模型混着读;不过方向有独立佐证,HuggingFace 自家 8 月 14 日的报告里,2026 年站内下载 Qwen 20.45 亿,Google 4.18 亿,Meta 2.27 亿。开源模型的下载榜,目前是一超多强。

成绩单复读:61.7 分旁边那行小字

上篇验货写过它最抢眼的分数,这里只复读一行:SWE-bench Pro 61.7,把 Anthropic 前旗舰 Opus 4.6 Max 的 53.4 压在身下。这次把模型卡的脚注放大了看,小字比大字精彩:「除 Opus 4.6 Max 使用官方报告分数外,所有模型均使用 Claude Code harness 评测……有问题的任务已被修正,所有基线模型在修正后的基准上重新评测。」翻译一下:61.7 对 53.4 这行,是自己重考的新分对别人家旧成绩单,考题还是自己修订过的版本。分未必假,但这种比法,裁判和考生的距离近了点。

自建考场就更热闹了,QwenSWEBench 79.0、CoWorkBench 70.7、RecreationBench 47.1,三个 in-house 基准,三个第一,毕竟出题人总不能考砸自己。要说克制它也有:HLE 30.8 连自家闭源的 3.7-Plus(34.7)都没打过,照印在卡上。真正的裁决还没来,Artificial Analysis 至今没收录 27B(8/17 快照),第三方复测出分之前,全场都是自报口径。

21 分钟一只鹈鹕:思考税比 API 费贵

社区实测的主线剧情,是跟它的「思考癖」搏斗。Simon Willison 用 128GB 的 MacBook 跑 17GB 量化版,模型默认推理档位拉到最高,他的评价是「一个滑稽的默认值」。他的保留曲目「鹈鹕骑自行车 SVG」:思考 22,276 个 token,耗时 21 分钟,画出他所见本地模型史上最好的鹈鹕。值得等 21 分钟吗?他自答:「Absolutely not.」关掉思考只要 137 秒,代价是车架画崩了。

他在 HN 补了组对照数字。同一道 HTML 工具题,Qwen 烧 17,576 个思考 token,Meta 的 Glimmer 只烧 1,021 个。跑分低的那个惜字如金,跑分高的这个话痨成灾。HN 网友 jatora 给这个病找了病根,模型全靠强化学习激励训出来,「少答是昂贵的,多答是便宜的」,卷 benchmark 卷出来的性格。

惨案数字排排坐:网友 paulbjensen 挂一个任务从周日傍晚跑到周一凌晨四点,9 小时 13 分,思考 token 计数器停在 2,650 万,实际吞吐 0.92 token 每秒;SwellJoe 的双显卡机器跑一个任务 11 个小时,「同样的活 GPT-5.5 二十分钟干完」,虽然他也承认质量是自托管模型里最好的。最扎心的账来自 XCSme:算上电费,他那张 3090 本地跑 27B,比直接调 OpenAI 便宜档的 API 还贵,硬件钱还没算。

治法社区也齐活了:llama.cpp 本来就有思考预算参数,有人嫌不够,网友 hellajack3d 直接 fork 了 llama.cpp,在思考长度到阈值时往推理链里注入文本掐脖子,仓库名叫 llama-mindcontrol;另一派看完只回了两个词:「skill issue.」

百无禁忌支线:99 个去审查版,76 万下载

开源无门槛的另一面,四天里长出了 99 个「去审查」衍生仓(uncensored/abliterated),合计下载 76.4 万次。头号选手一家就有 35.8 万,而且 HF 时间戳显示它建仓比官方权重上架还早了 11 个小时。时间线可查,怎么做到的没有说法,本号不猜。V2EX 有个热帖叫《qwen3.8 27B 被低估了》,楼主畅想「穿越者套餐」:太阳能板加两张 3090 加 27B,再造人类文明;楼里马上有人接了句大实话:「本地百无禁忌……你甚至可以要求他做坏事,或者在灰色地带赚钱,只需要付出电费。」Apache 2.0 管版权不管人心,白送的自由包含你不喜欢的那部分,这是开源的老规矩,点破不装看不见。

口碑分裂到 B 站播放量都五五开:吹的《本地部署实战指南》28,626 播放,骂的《三宗罪:很强!很难伺候!很难用!》28,163 播放,差 463 次点击,堪称民意的毫米级平衡。

上手与比价:Claude 的壳,千问的芯

上手路线已经铺到一条命令:Ollama 官方上架了 27B,默认 18GB 量化、自带 MTP 加速,官方页面白纸黑字列着 ollama launch claude --model qwen3.8——用 Claude Code 的壳跑千问的芯,官方教程亲自教。llama.cpp 那边 ggerganov 实测开推测解码比 LM Studio 默认快约 72%。实际速度参考:7900XTX 跑 Q5 量化 55–80 token/s(V2EX 用户实测),Willison 的 Mac 15–30,m4 pro 约 10。

不想买卡的看云端:OpenRouter 牌价每百万 token 输入 0.45、输出 3.20 美元,三家供应商在架;OrcaRouter 标准档 0.33/2.40 美元,还有个 0 美元的免费档,代价是首 token 等 5 秒、错误率 18.5%,省下的钱从故障率里还回去。官方托管 Qwen Cloud 依然「coming soon」,第四天了。

顺手辟个谣:这两天全网转的「4090 单卡 26.5 token/s、十并发 281」,出处是知乎博主在 3.8 发布前夕测的 Qwen3.6-27B,还是没开 MTP 的基线成绩(开了能到 68.6/451.6)。数字是真的,模型是上一代的,转发前记得看车牌,串号是本号每周都要抓的惯犯。

结论

Willison 的收尾写得很动情:「一个 17GB 的文件能在我家里的机器上干这些事,是一个奇迹。一年前这是最贵的闭源旗舰才有的水平。」HN 最高赞评论说这句才配当大标题。本号的版本朴素一点:分数是自报的,等第三方;话痨是真的,治得住;奇迹也是真的,17GB 装得下。今天起 DeepSeek 的 API 按上班时间计价了(见头条),这位本地选手不分峰谷不看表——它只是把你家电表当计费器,省下的 API 钱,记得匀点给电网。


来源

事实来源
各仓下载数(unsloth 272.7 万等 8 仓合计 493 万)、去审查 99 仓 76.4 万、建仓时间戳HuggingFace API(8/17 23:24–27 北京快照)
Muse Glimmer-30B 官方+unsloth 合计 109 万HuggingFace API(同上)
SWE-bench Pro 61.7/53.4、harness 与「修正任务」脚注原文、自建基准三项、HLE 30.8HF 模型卡 Qwen/Qwen3.8-27B(https://huggingface.co/Qwen/Qwen3.8-27B)(8/17 快照)
鹈鹕 21 分钟/22,276 token、画圆事故、「hilarious default」、17GB miracle、15–30 tok/sSimon Willison 8/16 实测(https://simonwillison.net/2026/Aug/16/qwen-38-27b/)
Qwen 17,576 vs Glimmer 1,021、jatora/paulbjensen/SwellJoe/XCSme/hellajack3d 评论Hacker News 681 分帖(https://news.ycombinator.com/item?id=49324985)(8/17 快照)
千问半年 30 亿(阿里声明,媒体转述);HF 报告 Qwen 20.45 亿/Google 4.18 亿/Meta 2.27 亿网易 8/15(https://www.163.com/dy/article/L4BAD4R905198NMR.html)、TechNews 8/17(https://cdn.technews.tw/2026/08/17/alibaba-ai-models-hit-3-billion-downloads/)、IT之家(https://www.ithome.com/0/990/187.htm)
AA 未收录 27BArtificial Analysis(https://artificialanalysis.ai/models/open-source)(8/17 23:33 快照)
Ollama 默认 18GB、ollama launch claude 命令、20 万下载Ollama 官方库页(https://ollama.com/library/qwen3.8)(8/17 快照)
OpenRouter $0.45/$3.20 三供应商;OrcaRouter $0.33/$2.40、免费档错误率 18.5%OpenRouter(https://openrouter.ai/qwen/qwen3.8-27b)、OrcaRouter(https://www.orcarouter.ai/models/qwen/qwen3.8-27b)(8/17 快照)
「穿越者套餐」「百无禁忌」、7900XTX 55–80 tok/sV2EX 帖(https://www.v2ex.com/t/1234978)(8/17 快照)
26.5/281 系 Qwen3.6-27B 非 MTP 基线知乎专栏(4090 实测)(https://zhuanlan.zhihu.com/p/2071169496807650145)
B 站两视频播放数B 站 view API(8/17 23:40 快照)
ggerganov MTP 提速约 72%Willison 文内转述 ggerganov 推文

注:全部基准分数为厂商自报口径,第三方复测尚未发布;去审查仓建仓早于官方上架为时间戳事实、成因未证实;「30 亿下载」为阿里声明经媒体转述;本文不构成任何采购建议;概念图由 AI 生成。