你没有看错。
7月的国际数学奥林匹克(IMO)赛场上,一道代数题、一道几何题、一道数论题、一道组合数学题——全部满分。
不是哪个国家的天才少年。是一个 AI。
更准确地说,是小红书旗下的大模型 dots-note 3.0。
IMO 满分是什么概念?历史上只有约 1% 的人类参赛者拿过满分。人类金牌得主看完 dots-note 的证明过程,给出的评价是:「解法简洁、推理优雅」。
做社交内容起家的公司,把最顶尖的数学竞赛给秒了。这事本身就充满了反常识感。
但仔细想想,其实合理。
小红书的 AI 团队一直都在做一件事:让模型理解「上下文」。你今天搜了露营装备,明天首页就推户外攻略——这种跨模态、跨时间的理解力,本质上就是推理能力。
把这种能力迁移到数学领域,就是:给你六个问题,你要从零开始,一步步推导,证明不出一点差错。
dots-note 3.0 做到了。
同一天,AMD 和 Cerebras 联起手来捅了英伟达一刀
如果说小红书的 IMO 满分代表 AI 智力天花板,那 AMD 和 Cerebras 的联手代表的就是 AI 成本的地板。
7月23日,AMD 和 Cerebras 在 Advancing AI 大会上宣布了一项合作:把 AMD 的 Helios 机架级系统和 Cerebras 的晶圆级芯片组合在一起,打造一个专门用于 AI 推理的异构算力方案。
Cerebras 的芯片有多大?是英伟达 GPU 的 58 倍——一块 12 英寸晶圆就是一整块芯片,不用切成几百个小 GPU。每秒能生成超过 2000 个 Token。
和 AMD Helios 机架组合后,每瓦输出的 Token 是传统方案的 5 倍。
这意味着什么?同样的电费,同样的机柜空间,你能服务 5 倍的用户。
微软、OpenAI、Meta、甲骨文——都已经在 AMD 的客户名单上了。
要知道,英伟达的护城河一直不只是芯片性能,更是 CUDA 生态。开发者习惯了英伟达的工具链,换别的芯片学习成本太高。
但 Cerebras 和 AMD 这次玩了个巧的——他们不打训练市场,专打推理。推理不需要开发者适配,只需要 API 调用更快、更便宜。
Cerebras 说了一句很狠的话:AI 竞争的下一个战场,不是"谁更聪明",而是"单位时间里谁更聪明"。
翻译成人话就是:便宜才是硬道理。
为什么这两个新闻要放在一起看
小红书的 IMO 满分,告诉我们 AI 能做什么的上限正在被不断刷新。
AMD 和 Cerebras 的组合,告诉我们这个上限被刷新的速度取决于一个东西:算力成本。
DeepSeek V4 已经把模型推理成本打到了竞品的七分之一。Cerebras 说它比 GPU 快 15 倍。阿里 Qwen3.8 宣布将开源 2.4 万亿参数的模型。
你发现没有?这三件事指向同一个方向:
最强的模型正在变成最便宜的模型。而最便宜的模型,就是最有价值的模型。
对三类人,三条建议
创业者:别把成本优势当短期红利。模型越来越便宜是趋势,你的护城河应该是垂直场景的不可替代性,而不是信息差。
职场人:趁现在注册 dots-note 或者 Kimi K3,把它们塞进日常工作流。模型价格战对你的唯一影响是——一个 AI 实习生越来越便宜了。不用白不用。
学生:IMO 满分证明了一件事:AI 的终极能力不是和人类比谁更聪明,而是帮人类变得更聪明。你的目标不是"比 AI 强",而是"会用 AI 让自己变得更强"。
从 IMO 满分到 58 倍大芯片,从社交 App 公司到芯片巨头联手——AI 世界的变化速度已经不是"按月计算"了。
它是按天计算的。
夜雨聆风