乐于分享
好东西不私藏

元以AI早报-2026年08月18日

元以AI早报-2026年08月18日
1.Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限
2.国产AI,就差18分
3.70亿美元!全球最大「Token中转站」OpenRouter被收购

元以AI早报

01
Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限
🔓 Prime Intellect公开迄今最大规模AI自主科研实验成果🏆 Fable 5模型获2726步成绩,达人类水平82%🔮 AI科研效率逼近人类,或将推动科研范式转变
近日,Prime Intellect公开了迄今规模最大的AI自主科研实验成果。该实验将18款全球顶尖大模型置于断网沙盒环境中,连续运行153场完全自主的优化器挑战赛。在规则严苛、禁止修改模型架构与训练数据的纯优化赛道中,人类工程师耗时数月创下的2600步纪录被迅速逼近。其中,Fable 5模型最终以2726步的成绩缩小了690步的差距,达到人类水平的82%。实验环境限定独占八个高性能计算节点,验证门槛要求八次均值低于特定阈值以防运气蒙混,全程由独立LLM审计员监控。此次实验首次用实际算力和时间量化了AI自主研究的进度,表明模型已能独立完成假设提出、方案修改、实验运行到误差分析的完整闭环。尽管全新算法创新仍依赖人类灵感,但AI在实验执行与参数调优上的效率已逼近专业团队,预示着未来两年内多Agent系统可能实现递归自我改进,对科研范式转换及算力资源配置将产生深远影响。
信息来源:https://mp.weixin.qq.com/s/uvBaAb2YTHZq2XULKpM7Zg
02
国产AI,就差18分
📊 国际Arena发布2026年第33周AI大模型盲测排名
🏆 Anthropic多款Claude新模型包揽综合榜前五垄断头部
✨ 国产模型在前端开发细分赛道取得突破形成规模优势
8月17日,国际盲测平台Arena发布2026年第33周AI大模型匿名投票ELO盲测排名。本周榜单呈现Anthropic头部垄断、国产模型细分突破的格局:Anthropic一口气将多款Claude-opus-4系列新模型推上榜,包揽综合榜前五,通过拆分不同调优、不同定价的模型变体铺满前排,牢牢占据头部优势。国产模型方面,月之暗面Kimi K3-Max上升2位至综合第12名,是本周排名最高的国产选手,它以11969票的高投票量获得了更小的置信区间,排位稳定性强,和综合排名第8的阿里Qwen3.8-Max能力接近;不过Qwen3.8-Max本周综合排名较上周下滑2位,在代码榜也下滑5位至第13名。国产模型最大的惊喜在前端开发赛道,Kimi K3-Max以1674分拿下分榜第二,距离榜首仅差18分,这也是国产模型在所有分榜中和榜首差距最小的位置,前端榜Top10中就有3个国产模型,已经形成规模优势。目前国产模型在细分赛道已经能和国际头部掰手腕,综合能力和智能体方向仍有差距,但迭代速度极快,后续榜单仍有变动空间。
信息来源:https://mp.weixin.qq.com/s/k_DaNjc-1Oz6tgsxP8UU2Q
03
70亿美元!全球最大「Token中转站」OpenRouter被收购
💸 Stripe以超70亿美元收购AI平台OpenRouter
🤖 OpenRouter估值82天涨5倍,周处理Token超55万亿
💡 收购凸显AI中间层在大模型产业的核心价值
据彭博社8月16日爆料,全球顶级在线支付处理商Stripe已敲定收购AI模型路由平台OpenRouter,交易价格超过70亿美元。OpenRouter今年5月刚完成1.13亿美元B轮融资,彼时估值仅13亿美元,仅仅间隔82天估值就暴涨5倍,此前甚至传出超100亿美元报价、多家科技巨头争抢收购的消息。该平台由前NFT平台OpenSea联合创始人Alex Atallah创立,聚合了涵盖文本、图像、音频等领域的400余个主流AI模型,为全球超1000万开发者提供统一API智能调度服务。最新官方披露数据显示,OpenRouter每周处理的Token规模已超过55万亿,按此计算全年Token处理量将接近2600万亿,增长速度远超行业预期。今年5月的B轮融资就获得谷歌CapitalG、英伟达NVentures等头部机构参投,本次交易后Stripe将AI调用的计量与支付入口纳入版图,凸显了AI中间层在大模型产业供应链中的核心价值。
信息来源:https://mp.weixin.qq.com/s/EAOfwHRvHI1hlD2GPsRjNw
04
谁还说国产芯片不行?现在一天就把最新大模型接上了,老外都懵了。
🔌 FlagOS于2026年8月完成DeepSeek V4-Flash模型Day 0适配,覆盖多厂商芯片
⚙️ 采用标准化适配流程,实现国产芯片无缝运行目标模型
🚀 助力国产算力打破CUDA依赖,构建自主可控AI算力底座
智源研究院牵头的开源计算栈FlagOS宣布,于2026年8月中旬单日完成对DeepSeek V4-Flash模型的Day 0适配,覆盖华为昇腾、海光、寒武纪、摩尔线程等八家国产芯片及英伟达GPU。该方案通过引入通用中间层与多家硬件后端翻译器,将传统M×N的单点定制适配矩阵转化为可并行复制的标准化工程流程。团队借助Triton、FlagGems及编译器技术进行精度与路径的工程处理,使原本不支持特定精度的国产芯片亦能无缝运行同一份模型权重,使大模型适配体验趋近于标准化插座接口。此举标志着大模型部署逻辑从依赖单一生态绑定转向软硬件解耦的模块化协作。适配速度的提升不仅考验底层工具链的成熟度,更体现了产业链在多厂商接口对齐与工程节奏同步方面的协同能力。随着切换成本显著降低,国产算力体系有望打破传统CUDA生态的路径依赖,通过规模化适配重构议价机制,为构建自主可控的AI算力底座提供可行路径。
信息来源:https://mp.weixin.qq.com/s/8loEHO2Ozj3Zb98kdi_l6A
05
刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」
🌍 智象未来发布全球首款原生全模态交互式世界模型
🏆 第三方评测两项得分居首,支持交互推演与环境编辑
🤝 与诺亦腾达成合作,赋能多领域需完善相关规范
智象未来正式发布全球首款原生全模态交互式世界模型HiDream-O1-World。该模型基于自研UiT架构,摒弃传统多模态拼接逻辑,将文本、图像、动作指令等原始信号统一映射至共享Token空间进行联合推理。在第三方评测基准WBench中,其物理一致性得分73.3、时空一致性得分88.0,均列首位。模型支持第一与第三人称视角自由漫游及实时环境编辑,能够在雪山攀登、天气突变等场景中保持几何结构与光影材质的稳定输出,实现长时交互下的因果推演。与传统单向内容生成不同,该架构赋予用户对动态世界的探索与干预能力,大幅拓展了生成式AI的应用边界。该技术路线为具身智能提供了低成本、高保真的仿真数据生成方案,已与诺亦腾机器人达成战略合作,计划年内联合生成数万小时具身视频数据。交互式世界模型的落地将加速游戏引擎替代进程与机器人泛化训练,同时需提前布局生成内容的知识产权界定与安全交互规范。
信息来源:https://mp.weixin.qq.com/s/EVlUTW_d3fvrSUVVclSTkg
06
DeepSeek涨价350%,大模型的「免费时代」终结了
💹 DeepSeek上调V4系列API价格,最高涨幅达350%
🤖 开源Harness框架上线45小时星标破十万,接入国超算
📈 标志大模型告别补贴,进入可持续发展新阶段
国内头部大模型企业DeepSeek于8月17日起对V4系列API启用峰谷计价策略,输出价格由每百万Token 6元上调至最高27元,涨幅达350%。此次调价伴随开源智能体框架Harness的正式推出,该框架上线45小时内GitHub星标突破十万,并同步接入国家超算互联网。过去两年,该企业长期以极低定价策略抢占市场份额,此次价格回调标志着行业正式告别补贴驱动阶段,进入追求合理毛利与可持续研发的算账周期。定价权的回归建立在全链路技术能力夯实的基础之上,V4 Pro模型参数规模与上下文长度均已达到国际一线水平,Harness框架则填补了自主Agent工具链的生态空白。这一商业模式的转变折射出中国大模型产业已从跟随者成长为规则参与者,具备参与全球算力资源定价的能力。各地政府需借此窗口期完善算力补贴退坡机制,聚焦低延迟网络建设与高端人才留存,以配套政策承接产业盈利转化带来的区域经济增长动能。
信息来源:https://mp.weixin.qq.com/s/llfGceB83qjCzZjJFipInA
07
起猛了,机器人开上卡丁车了!
🤖 共生知行公开DPC模型实机演示,人形完成卡丁车操作
⚙️ 突破分层割裂瓶颈,基于超1.5万小时数据优化架构
💡 降低机器人部署门槛,加速多场景替代人工产业升级
共生知行今日公开Direct Perception Control模型实机演示,画面显示人形机器人在卡丁车座舱内完成上车、转向、油门刹车协调控制及终点漂移动作。该方案突破了传统人形机器人系统中语义推理与高频运动控制分层割裂的技术瓶颈,取消独立的全身追踪器中间层,直接融合视觉感知、任务语言与本体反馈计算关节目标。模型基于逾一万五千小时具身数据训练,涵盖人类第一视角、武装机器人及轮式人形等多源数据,采用DriftDistill机制在线修正部署偏移,确保在受限空间移动操作中的姿态稳定。DPC架构将感知专家与运动专家置于统一行动目标下联合优化,大幅缩短了从环境理解到肢体执行的响应链路。此项技术进展直击具身智能商业化落地的核心痛点,即如何让机器人适应非结构化动态环境而非依赖预设程序。随着底层控制协议简化与多模态数据管线打通,通用操作机器人的部署门槛显著降低,将在柔性制造、仓储物流及特种作业场景加速替代人工,推动制造业自动化向认知型交互升级。
信息来源:https://mp.weixin.qq.com/s/hnaYdgsVO2vZS94RI8-NOw
08
世界模型一口气输出小时级视频不跑偏,开源了
🎬 Alaya-EVOKE模型实现120分钟无衰减一镜到底视频生成
💻 破解长时序生成难题,单H200卡实现2.11秒低延迟推理
⚠️ 可降多行业生产成本,需建监管防范技术滥用
由Alaya Lab、中国科学技术大学与上海创智学院联合发布的Alaya-EVOKE视频世界模型,成功实现连续120分钟无衰减的一镜到底视频生成。针对长时序生成中显存溢出与信息丢失的行业难题,该方案将空间状态外置为以相机位姿索引的外部记忆库,仅保留最近3.2秒latent帧进入去噪上下文,彻底解除会话时长与计算开销的线性绑定。模型采用线性注意力机制重构长程教师网络,支持生成中途切换文本条件,并通过三步蒸馏策略在单张H200显卡上实现2.11秒的低延迟推理。评测显示,其在亮度饱和度维持、场景身份余弦相似度及几何召回率等指标上均表现优异,且无需开启CFG即可稳定输出。该架构设计为大规模视频数据合成与动态场景模拟提供了高效算力解决方案,有望降低影视制作、自动驾驶仿真及虚拟数字人的内容生产成本。随着生成长视频能力的突破,相关监管部门需同步建立深度伪造识别机制与生成内容溯源标准,防范技术滥用风险。
信息来源:https://mp.weixin.qq.com/s/alFXOq1h1fjGLr7UR4R_ug
09
英特尔参会,清华教授领衔!年度AI芯片旗舰大会9月举行
📅 2026全球AI芯片峰会9月20-21日举办,已公布嘉宾议程
🎤 峰会设多主题演讲研讨,展示AI芯片领域最新突破
💡 峰会助力打通技术壁垒,建议筑牢AI基础设施安全
2026全球AI芯片峰会组委会近日公布开幕式嘉宾阵容及详细议程,大会定于9月20日至21日举行,主题为芯路求索聚力致远。本届峰会汇聚英特尔中国区技术部总经理高宇、清华大学集成电路学院副教授胡杨、Imagination技术支持总监艾克以及维泛智能创始人殷积磊等数十位产业与学术领军人物,围绕大模型AI芯片、Agent推理芯片、具身智能芯片三大方向展开主旨演讲。会议同期设置超节点技术、异构混训混推、AI芯片架构创新、新型存储器及大模型KV Cache五项技术研讨会,由南京大学、中科院半导体所及上海交通大学等机构专家领衔探讨底层架构演进。作为国内规格最高的芯片产业盛会,此次大会集中展示了光交换互联、端侧高能效推理及机器人算力国产化等领域的最新突破。在全球算力竞赛加剧的背景下,此类高水平产学研交流平台有助于打通上下游技术壁垒,促进先进封装、EDA软件及核心IP的协同攻关。建议相关部门持续关注芯片制造良率提升与出口管制应对策略,通过专项基金引导关键设备进口替代,筑牢人工智能基础设施安全防线。
信息来源:https://mp.weixin.qq.com/s/QRAUPsfWn1otOaMyWCUOmg
10
RoboScience机器科学发布轮式仿人形机器人REX G1,打造新一代具身生产力伙伴
🌐 机器科学8月17日发布REX G1轮式仿人形机器人
⚙️ 搭载自研大模型,可穿行窄通道支持连续作业
🚀 商用落地赋能多场景,推动产业智能化降本增效
机器科学于8月17日正式发布轮式仿人形通用操作机器人REX G1,定位为新一代具身智能生产力终端。该产品搭载自研Visics通用具身大模型,采用以物体为中心的VLOA架构,实现环境感知、任务理解与底层物理控制的端到端闭环。整机配备22个自由度,宽度仅540毫米,可灵活穿梭于0.75米级狭窄通道,支持底盘升降与双臂协同的边走边抓作业模式。依托2070 TFLOPS端侧算力,REX G1大幅降低对云端高频通信的依赖,具备深柜阴影与反光环境下的自适应补光能力。单次续航最长4小时,支持5秒热插拔换电,满足高频连续作业需求。该机型打破了传统仓储AGV与固定机械臂的功能割裂局面,通过本体形态与智能算法的深度融合,直接适配现有仓库货架布局,无需改造现场设施。REX G1的商用落地标志着人形机器人从实验室Demo迈向真实生产流的关键一步,将为柔性制造、前置仓配送及零售巡检提供高性价比替代方案,推动传统产业智能化改造降本增效。
信息来源:https://mp.weixin.qq.com/s/rje0Cxc3iJiS1hvWonH0qQ

早报内容及素材均来自网络公开渠道,版权归原作者所有,仅作信息分享使用。

—— END ——