一个2.4万亿参数的语言模型,上线第二天就告诉你:别急着测了,我明天会更强
7月19日,阿里通义千问团队官宣了下一代旗舰模型Qwen3.8,参数量2.4T,计划开放权重,预览版即日可试官方甚至自评只比Anthropic的Fable 5差一点消息一出,AI开发者圈子一片哗然。而让人更加坐不住的,是第二天那条更新:
"Qwen3.8-Max-Preview is getting better by the day... A big step up in web frontend."
“Qwen3.8-Max预览版每天都在变强……Web前端能力大幅跃进。”
一个还在"长大"的模型,你要怎么评价它?
2.4万亿:一个足以震撼市场的数字
先说官方放出的硬信息。
7月19日的发布帖明确了三件事:第一,Qwen3.8参数规模2.4万亿;第二,模型即将开放权重(open-weight);第三,预览版Qwen3.8-Max-Preview已上线Token Plan、Qoder和QoderWork三个平台


▲ Qwen官方7月19日发布帖:2.4T参数、即将开放权重、预览版上线
Qwen开发者Shuai Bai随后补充了一条关键信息,这是团队的首个万亿参数级多模态模型,能"吃"图像、视频、文档,目标是从"看懂"走向"把事做完"
而Bloomberg和Yahoo Finance的报道标题更简单粗暴:"Alibaba's Qwen Unveils Preview of Flagship AI Model",阿里亮出旗舰AI模型预览版
2.4万亿这个数字足够惊人。但它到底意味着什么,恐怕没有表面看起来那么简单
总参数≠你用得到的参数:2.4T背后的架构真相
这里需要拆开一个关键概念。
2.4T是总参数量,但Qwen的大规模模型历来采用MoE(混合专家)架构,把很多"专家子网络"放在一起,每次推理只激活其中一部分打个比方:2.4T像一座有几千间房的大楼,但你每次只会走进十几间
问题来了:激活参数是多少?官方没说。
这可太关键了。2.4T按4-bit量化粗算,仅权重文件就可能达到TB级别,单卡甚至单机根本跑不动开发者在意的,是每次推理实际调用多少参数、显存占多少、吞吐量如何,这些数字,目前全部缺席

▲ 官方7月20日更新:"预览版每天都在变强",Web前端大幅提升
而官方"每天都在变强"的说法,又制造了另一个麻烦:你测的模型是移动靶周一跑的分数,周三可能就过期了。这对媒体标题友好,永远有新故事可写;但对任何想做严肃横向对比的人来说,简直是噩梦
一折体验旗舰:开发者的“试药”现场
不管争议多大,手先痒了。
阿里这次给预览期开出了极其诱人的价格Qoder平台上,Qwen3.8-Max-Preview的Credits消耗打到了常规约九折优惠,相当于标准价的10%晚上更狠,夜间时段(以新加坡时间22:00-08:00为例)折扣可以到约98% off

▲ Qoder活动页:Qwen3.8-Max-Preview预览期最低仅需标准价2%的Credits
翻译成人话:阿里在倒贴钱让你用。说白了,阿里在拿算力库存换你手里的真实任务数据,一场AI时代的"药物临床试验"
而"试药者"们确实带回了一些惊人的报告一位开发者展示了用Qwen3.8约20分钟生成的一个完整Vue.js控制台,带设计、带动画、能运行
中文用户也找到了更轻量的入口:直接打开 chat.qwen.ai 就能体验,不用装任何客户端有人反馈"确实还不错",有人说"写代码甚至不输某些同期模型"GitHub上,已经有开发者在请求把 qwen3.8-max-preview 写进Qwen Code的内置模型列表,预览版已经开始渗透进真实的编码工作流了
"完全没有数字,有点令人担心"
但另一群人坐不住了,他们盯着的只有一样东西:数字
"We need benchmarks."
“我们需要基准测试数据。”
这条高赞评论直指要害。上一代Qwen3.7-Max发布时附有详细的官方评测博客,SWE系列、Terminal Bench、MCP相关、办公自动化,数字一应俱全而Qwen3.8-Max-Preview上线至今,没有一张对等的成绩单

▲ 科技观察者在官方更新下回复:完全没有benchmark数字,令人担心
FoneArena的报道更直接地列出了三个缺失:model card缺席、激活参数不明、benchmark全无在这些东西出来之前,无法做任何有意义的横向对比
"仅次于Fable 5",这只是官方自评,第三方尚未背书在独立榜单和可复现测试出来之前,这句话的含金量要打个问号
社区的另一个高频诉求同样尖锐:给中小尺寸版本Unsloth等本地推理工具社区明确表态,2.4T太大了,请同时放出27B、35B级别的变体,让个人机器也能跑起来对这些爱好者和中小团队来说,一个能下载到本地的35B,比云端的2.4T有获得感得多
如果权重真的开放,游戏规则会变
最后回到那个绕不开的承诺:开放权重
官方措辞是"soon"、"coming soon"、"open-weight it for everyone"方向明确,但日期没有、许可证没有、下载仓库没有、蒸馏版计划没有
如果2.4T的权重最终真的按承诺放出来,这会是什么概念?它将直接刷新"可下载前沿模型"的参数量级纪录即便以MoE形式出现,也足以推动整个推理框架、量化工具和分布式部署生态再上一个台阶
但"如果"二字,仍然悬在这个故事的最上方
通义团队过去的节奏往往是:旗舰先走云和订阅,建立能力上限印象;中小尺寸再以开放权重覆盖社区。Qwen3.8预告"旗舰也要open-weight",若兑现,将是对这个惯例的突破观察指标摆在那里,Hugging Face或ModelScope上是否出现Qwen3.8仓库、license文件和推理示例
在那一天到来之前,Qwen3.8的状态可以这样概括:一扇门已经打开了,但门后面的房间还在装修每天都在变强?也许吧。但开发者等待的,是装修完工那天,交出的钥匙和户型图
夜雨聆风