ARTICLE · 1138748
OpenAI甩722篇数学手稿攻准黎曼猜想,DeepSeek狂揽千亿月之暗面500亿冲港股
昨天和今天,资本这条线彻底压过了产品。DeepSeek这轮融资原定500亿,结果认购太猛,彭博说已经顶到至少800亿,最终大概率撞上1000亿关口,估值奔着5000亿去。腾讯和宁德时代是出钱最多的两家。放到四个月前,它刚完成首轮510亿,所有人都以为那就是天花板了。现在回头看,那不过是个开场。国产大模型不是没人要,是资本排队都拿不到额度。
跟DeepSeek并排往前冲的是月之暗面。它已经关掉了IPO前最后一轮私募,估值约500亿美元,目标明年一季度在港股挂牌,募资上限50亿。快手那边的可灵AI也动了,选定中金、高盛、瑞银三家筹备港股IPO,募资至少10亿美元。DeepSeek、月之暗面、可灵,一天之内三家同时传出融资或上市的风声,这不是巧合。国内头部大模型,正集体从一级市场往二级市场爬。
海外这边,OpenAI把GPT-6推给了全球12亿ChatGPT用户。付费的用GPT-6 Sol,免费的用GPT-6 Luna,还带了一个叫"智能UI"的东西,回复不再是纯文字,能直接出图表、按钮、表单。Anthropic几乎同一时间甩出Claude Haiku 5.5,10万token以下输入0.10、输出0.50美元每百万token。巧的是,GPT-6 Luna定的是完全一样的两个数。两家独立定价,落到一分不差,这已经是价格地板,不是巧合了。
还有一个容易被忽略的侧面:算力的钱也烧疯了。博通在给OpenAI的芯片安排超过500亿美元融资,甲骨文找阿波罗和高盛谈芯片租赁,SpaceX为了买英伟达芯片要融400亿,其中100亿银行贷款、300亿投资级债券。一周之内,光是"芯片债"就堆了约900亿美元。模型降价、算力涨价,这组矛盾会越来越尖锐,最后谁能把效率差跑出来,谁就能活。
DeepSeek这轮融资,钱和权分得很清楚。它的首轮就用了有限合伙架构,外部投资人没有投票权,股份锁定五年。梁文锋个人直接持股34%,最终受益股份84.29%,表决权接近100%。这一轮腾讯、宁德时代领投,首轮进来的IDG、国家人工智能产业投资基金基本全部加码。宁德时代入局最耐琢磨,表面上是跨界,实际上是把储能、电力资源和压低算力成本的AI公司绑到一块。硅谷的思路是不计成本烧钱堆算力,DeepSeek走的是开源加低成本,靠改写成本天花板来赢。资本看中的正是这套硬实力。
月之暗面的500亿美元,把国产大模型的估值天花板顶高了。9月初它已经用保密形式向港交所交了A1文件,股东里阿里占约15%、腾讯约7%。从年初的100亿美元到现在500亿,Kimi背后的公司一年翻了五倍。港股对亏损、轻资产、高研发的AI公司容忍度高,这条路一旦走通,后面一堆国产大模型独角兽会照着抄。可灵那边则是视频生成赛道的头一个,7月刚拿近30亿美元融资、投前估值150亿,是全球视频大模型里最大的一笔。
硬件和专利上也有实打实的动作。华为和高通达成多年期专利交叉许可,覆盖5G、计算、AI、网络几大块,还包含高通收购华为在计算、AI、网络方面部分美国专利,需要监管批准。华为这边说,2007年到2025年底,它累计的专利许可协议总额已经超过69亿美元。这是两家巨头长期较劲之后的一次重新握手,对国内AI芯片和通信的专利布局,算是个能落定的信号。
国产模型出海的分成生意还在铺。智谱GLM-5.3上月上了AWS Bedrock,AWS按调用量跟它分成,国内阿里云百炼、华为云也都签了类似协议。国产开源模型从"开放下载"走到"托管分成",把一次性开放变成持续抽成,这条护城河比单纯开源要实在不少。假期前后国产大模型上新密集,Kimi K3、GLM-5.3、可灵Kling 4.0,动作一个接一个,出海这条线明显在提速。
OpenAI那722篇数学手稿,是全行业这两天最吵的一件事。它把一个还没发布的内部模型产出的手稿一次性堆上GitHub,归成372个成果族,覆盖数论、几何、理论计算机等17个方向。最扎眼的是准黎曼猜想,OpenAI说把那条无零区域的线划到了7/8,对zeta函数和所有狄利克雷L函数同时成立,还附了Lean形式化。BSD猜想、希尔伯特第十问题也都在清单里。单个成果平均只用了ChatGPT Pro三个小时的计算量,绝大多数来自一条提示词。听起来像数学史上最重的一击。
可数学家们不买账。722篇里只有162篇带Lean形式化,OpenAI自己都承认,没形式化的结果可能有问题。MIT的Andrew Sutherland话说得很直,模型一天不放出、结果一天没法复现,所谓"一条提示词解决难题"就得当未经验证看待,他说得"要收据"。普林斯顿高等研究院也补了一刀,说现在AI能输出连人类都看不懂、验不了、也担不起责任的数学论证。能力是真的,但把几百个"声称证明"一次性倒出来,逼整个学界去消化,这姿态本身就让很多人不舒服。上一次Navier-Stokes是1万个Agent跑88小时,这次一条提示词三个小时,画风变得太快,谁都得缓一缓。
GPT-6的全面铺开,才是面向普通用户的真事。付费版GPT-6 Sol、免费版GPT-6 Luna,两款都被列为网络安全和生化领域的"高能力"级别。越狱测试里,Sol和Luna在各攻击预算下的防御成功率都高于GPT-5.6,指令注入防护率一个99.99%、一个99.79%。新上的"智能UI"让回复能带可点击按钮和图表,官方说流式思考把平均等待砍了44%。ChatGPT从纯文本问答,正式往交互式界面走。这条线谷歌5月就用Neural Expressive试过,现在OpenAI追了上来。
欧洲这次不打算继续当观众。法国Mistral放出Mistral Large 4,外号"大胖猫",细粒度MoE总参数1.05万亿、单次激活490亿,加一个16亿参数的视觉编码器。最让人意外的是训练成本,全程只用了4000张英伟达Grace Blackwell,在自己的欧洲数据中心里训出来。公司说这比中国同行的算力少两到三倍。Macron嘴里那个"AI的第三条路",Mistral是真在往那走,三周安全评估后公开权重。
几件散点收个尾。谷歌和Unity联手做AI游戏平台,实验产品Playground已经能靠自然语言生成可玩的小游戏,年底再推专业版Unity Spark。微软在旧金山发了Surface Laptop Ultra,起售价2599美元,本地能跑1200亿参数的模型,直接对标苹果MacBook Pro。Meta牵头Walmart、Stripe、Shopify八家,定了个人智能体购物协议,因为亚马逊已经把Meta的Muse整个屏蔽了,这类个人Agent现在连商品目录都翻不了。Brett Adcock的Hark发了Hark Pro,一个直接接管电脑桌面的OS级智能体。苹果和LG要联合做门铃、门锁、温控器,贴着"智能家居"的边往硬件里挤。模型、芯片、能源、监管、终端,五条线这个礼拜都在动。