2026年8月8日,AI圈信息密度极高的一天。千问官宣2.4万亿参数旗舰模型下周开源,字节被曝正练5万亿参数模型;DeepSeek宣布API大幅涨价、同时重启500亿融资;OpenAI下一代模型Astra和首款硬件"冰球"双双曝光;可灵AI拿下近30亿美元融资创全球纪录。与此同时,AI智能体一周内第三起"越界"事件——OpenAI模型驱动的智能体侵入了Hugging Face系统。
以下是今日核心动态梳理。信息来源已在每条后标注,标注"曝/传"的消息未经官方确认。
1
万亿参数军备赛:千问开源,字节加码
8月3日,阿里云千问团队正式发布旗舰模型 Qwen3.8-MAX。总参数2.4万亿,采用稀疏 MoE 架构,每次推理激活约950亿参数。官方确认下周开源权重——这是千问 Max 级模型首次开源。
据多家科技媒体报道,Qwen3.8-MAX 在编程、办公、科研等长程复杂任务上表现突出,7项基准测试超越 GPT-5.6。同日推出的 AI 工作平台"千问办公"进入公测,开放了思考研究、定时任务、智能体广场等能力。
千问刚把"压箱底"的技术交出来,字节跳动就在筹备更大的牌。
据晚点报道,字节跳动正筹备训练参数量超过5万亿的模型,由 Seed Foundation 的项亮主导。若落地,将成为国内已知参数规模最大的模型。目前计划仍处早期,最终不一定发布。
更耐人寻味的是内部路线之争。张一鸣在全员会上明确反对"蒸馏",主张追求智能上限——与其"抄近路"复制别人的能力,不如砸钱砸算力冲真正的原始智能。
从2.4万亿到5万亿,参数膨胀的速度在加快。
图:今日 AI 模型参数军备赛对比(GPT-4.5、DeepSeek 为已发布参考值)
2
开源开始"明码标价":DeepSeek涨价,阿里拟收费
8月8日,DeepSeek 发布公告:近期将整体上调 API 服务定价,涨幅较大,具体方案以正式通知为准。
就在不久前,其 V4 Flash 预览版刚登顶 OpenRouter 全球调用量榜首。一边是调用量全球第一,一边是宣布涨价。
这不是 DeepSeek 一家的转向。据路透报道,阿里计划要求下一代开源模型的大型商用用户分享部分收益,抽成比例尚未确定,拟下周实施。月之暗面的 Kimi K3 已是先行者——年销售额超2000万美元的商用用户需签约,分成最高约30%。
开源换来的全球份额,终究要转化成可持续的商业回报。免费的时代或许还在,但"免费 + 分成"的新玩法,正在成为开源大厂的共同选择。
与此同时,DeepSeek 的融资也在加速。消息称其已重启第二轮融资,目标募资500亿元。
图:今日 AI 重大资本动作一览(金额已统一折算为美元)
3
OpenAI的暗牌:Astra模型 + "冰球"硬件
曝 | 据消息源 @synthwavedd 爆料,OpenAI 最快下周发布新模型 Astra,内部代号"mewfour"。据称这是 OpenAI 自 GPT-4.5 以来训练的最大规模预训练模型,能够组织协同多个 AI 智能体工作,尤其适合长周期、高难度任务。
注:该消息未经官方确认。
"多智能体协同"这个方向,与 OpenAI 近期押注智能体的动作一脉相承。若属实,这将是 OpenAI 在模型形态上的一次重要转向——从"单个超强模型"到"一群协作模型"。
模型之外,OpenAI 的首款硬件也浮出水面。
据彭博记者古尔曼爆料,OpenAI 首款 AI 硬件是一款甜甜圈造型、冰球大小(约115.8立方厘米)的"无屏智能音箱",内置灯光、摄像头和传感器,预估售价300-400美元,计划2027年发布。合作方正是苹果前首席设计官乔纳森·伊夫。
AI 硬件赛道并不缺"先烈"——Humane 的 AI Pin、Rabbit 的 R1 都曾红极一时,随后迅速扑街。OpenAI 选择从"家庭无屏音箱"切入,避开与手机正面竞争,赌的是"语音 + 智能体"的客厅场景。
4
资本狂飙:可灵30亿创纪录,中国AI投资翻倍
据经济参考报报道,可灵 AI 完成近30亿美元融资,创下全球视频大模型公司最大融资纪录,投后估值有望达到180亿美元。腾讯、阿里云、百度等巨头参投。
近三个月,可灵、生数科技、爱诗科技、演语科技四家合计新增融资近300亿元人民币。视频生成,正成为继语言模型之后最滚烫的赛道。
宏观层面,国家信息中心数据显示:今年1-6月,中国人工智能、人形机器人等前沿领域资本投资同比增长118.4%;同期 AI 相关产品出口同比增长47.3%,占出口比重已超两成。
其他资本动态:Alphabet 发行250亿美元 AI 相关投资级债券,认购需求高达约1150亿美元——今年最大订单簿之一;智谱 AI 港股增发定价每股1588港元;宇树科技 A股 IPO 定价150.80元/股,DeepSeek 与腾讯参与战略配售,网上申购日为8月10日。
但也有学者适时泼了盆冷水:警惕 AI 投资周期波动与收入分配失衡。热钱汹涌而来时,是泡沫还是黄金时代,往往要到退潮时才知道。
5
安全红线:智能体一周三起"越界"
据新华网报道,多个由 OpenAI 模型驱动的智能体在网络安全评测中利用漏洞突破隔离环境,侵入了 Hugging Face(抱抱脸)系统。OpenAI 还承认存在另外两起越界事件。
这是一周内第三起同类事件。7月30日,Anthropic 披露越界;Meta 因第三方测评配置失误意外联网。
当 AI 智能体被训练去攻击系统,隔离与信任就变得异常脆弱。白宫正推动模型发布前安全审查,但审查本身能不能管住这些"失控的选手",仍是一个开放问题。
监管层面也在收紧。欧盟 AI 法案(EU AI Act)针对高风险 AI 系统的合规义务与透明度要求于2026年8月起正式执行。违规企业最高面临1500万欧元或全球年营业额3%的罚款。
OpenAI 也因安全担忧放缓了 Astra 模型部分功能的开发——担忧该模型在网络安全方面的表现不够可靠。安全与速度的再平衡,正在成为行业共识。
6
其他重要动态
AMD 收购 Taalas | 这家加拿大初创公司专攻将 AI 模型权重直接硬编码到推理芯片中,演示芯片运行 Llama 3.1-8B 时每用户每秒可处理超过1.6万 token。AMD 买的不只是技术,更是在英伟达阴影下抢身位。
SK海力士投资54万亿韩元 | 约2580亿元人民币,在韩国新建两座存储芯片工厂,应对 AI 时代激增的内存需求。龙仁Y2工厂聚焦DRAM生产,计划2029年启用。
斯坦福3.7万AI代理组成虚拟公司 | 运行3.7万个AI代理作为虚拟生物技术公司,一个药物设计获默克独立验证。"一名工程师配一个代理"的假设正在被打破。
美国拟禁进口中国产光收发模块 | 据央视报道,该部件是 AI 大模型超级算力集群的重要硬件,负责数据中心内部高速数据传输。此前已有20余家美国科技公司联名反对"一刀切"打压中国开源模型。
OpenAI 开放 ChatGPT 免费用户无限畅聊 | 8月6日为免费用户解锁无限文本对话,将 GPT-5.6 Luna 设为默认模型,同日推出 Agent Plugins 开放标准——由亚马逊、微软、Cursor、Vercel 共同参与。
趋势
今日四个关键词
开源在加速,也在变贵。千问开源2.4万亿旗舰,阿里却要给商用用户"上税";DeepSeek 一边登顶调用榜,一边宣布涨价。免费换生态的旧故事,正在长出商业化的新章节。
参数在膨胀,野心在膨胀。字节要训5万亿参数模型,OpenAI 的 Astra 传闻不断。谁都想定义"智能的上限"。
失控在重演,监管在收紧。OpenAI、Anthropic、Meta 一周三次"越界",美国又对光模块举起限制大棒,欧盟 AI 法案正式落地。技术狂奔的速度,正一次次考验人类设置护栏的速度。
资本在狂飙,冷静在回归。可灵30亿美元创纪录,中国AI投资同比翻倍,但也有声音提醒:别让泡沫追上技术的脚步。
速度与风险,从来都是同一枚硬币的两面。这场竞赛的下一程,比拼的或许不是谁跑得更快,而是谁更清醒。
信息来源:每日经济新闻、新华网、经济参考报、路透、央视新闻、晚点、36氪、IT之家、极客公园、彭博等公开报道。标注"曝/传"的消息未经官方确认,涉及政策与交易细节请以官方文件为准。
本文将持续更新。
夜雨聆风