ARTICLE · 1133124
来了AI新闻早班车2026年10月7日
来了AI新闻早班车2026年10月7日DAILY AI BRIEFING 2026年10月7日 · 星期三 1模型发布Reflection AI发布5010亿参数开放权重模型Beam,英伟达8亿美元押注的"AI工厂"正式落地 2026年10月5日—6日 当地时间10月5日,由英伟达投资的初创企业Reflection AI正式发布其首款开放权重大模型Beam。该模型总参数量达5010亿,采用稀疏混合专家(MoE)架构,每次推理仅激活230亿参数,预训练数据量为23.8万亿Token。模型聚焦代码生成与长程智能体任务,性能对标智谱GLM-5.2,并在代码与智能体任务上逐步逼近千问3.8-Max。训练方面,Beam在6144张英伟达GB300 GPU上用不到4周完成预训练,随后使用10500张GB300 GPU运行4周、超1亿次强化学习迭代。在Terminal Bench v2.1测试中,Beam得分80.1(Kimi K3为88.3);在SWE-bench Verified中得分80.9,高于Thinking Machines Lab的Inkling(77.6)。值得注意的是,训练过程中Beam展现出"自发"网页浏览能力:尽管训练数据中未包含浏览任务,模型仍学会了自主查询其他AI模型并使用文本识别工具读取文档。Reflection AI由前DeepMind科学家米沙·拉斯金(Misha Laskin)和约安尼斯·安东诺格鲁于2024年创立,此前已与SpaceX签署协议获取Colossus 2数据中心算力,并与韩国新世界集团计划在韩国建设250兆瓦AI工厂。Beam将采用Apache 2.0协议开源,本月内发布模型权重、完整技术文档及微调工具。 【编辑点评】5010亿参数、230亿激活、Apache 2.0开源——这组数字组合背后是英伟达"AI工厂"愿景的第一次完整产品落地。Reflection AI拿到了SpaceX的算力、英伟达的芯片、韩国250兆瓦工厂的基建,这套资源配置不像是一家两年初创公司的家底,更像是硅谷+华盛顿+首尔联合押注的战略级项目。从技术路线看,Beam用更低的激活参数量(230亿对400亿)实现了与GLM-5.2持平的性能,推理效率上确实做到了"以小博大"。但更值得关注的是那个"自发学会浏览网页"的训练涌现——模型在没人教的情况下自己学会了调用外部工具,这既是能力的惊喜,也是安全的新课题。当中国开源模型在全球调用量上连续23周领先时,Beam的发布标志着西方阵营正式吹响了反攻号角。开源AI的东西方对决,进入白热化阶段。 来源:DoNews、今日头条、UC头条(引自IT之家) 2商业化出海智谱GLM-5.3上架AWS Bedrock,中国大模型首次以分成模式接入全球头部云平台 2026年10月6日 10月6日,亚马逊云科技(AWS)旗下大模型服务平台Amazon Bedrock官宣接入智谱GLM-5.3,AWS将基于模型调用量与智谱进行收入分成。据《科创板日报》独家获悉,除AWS外,智谱近期已与多家海外云厂商落地收入分成模式;国内方面,智谱已与阿里云百炼平台等头部云厂商签署类似分成协议,华为云已上架GLM-5.3,双方也已就同类分成合作达成意向。受此消息影响,智谱当日收盘报715.5港元/股,涨超7.59%,成交金额达25.05亿港元。值得注意的是,这已是一周内中国大模型第二次进入全球头部平台的结算体系。此前9月30日,美国AI基础设施公司Baseten宣布企业用户可在OpenAI编程工具Codex中调用月之暗面的Kimi K3和GLM-5.3。OpenRouter数据显示,平台内中国模型的全球调用份额已在7月下旬近28天达到约63.5%。高盛此前亦指出,与海外云厂商合作的好处在于,中国模型厂商获得分成的同时无需自行承担推理成本,从而带来毛利率提升。 【编辑点评】从"卖API"到"分账单"——智谱这一步跨出去,中国AI出海的商业模式正式换挡。过去国产模型出海是"我给你接口、你给我钱"的简单买卖,现在变成了"你帮我卖、我们分成"的深度绑定。这个变化的意义在于:Anthropic约46亿美元的收入中,近一半来自云市场渠道——也就是说,AWS Bedrock、Azure这些云平台是AI公司规模化变现的主通道。智谱现在走的,正是这条被验证过的路。一周之内,Kimi K3进入OpenAI Codex的付费结算、GLM-5.3上架AWS Bedrock——两家中国公司、两条通道、同一个信号:中国模型不再只是"调用量领先",而是开始在全球主流采购体系里拿到座位。当然,产业人士的提醒也值得听:模型同质化严重、地缘合规风险悬而未决,这条通道能走多远,还要看接下来12个月的政策风向。 来源:财联社(科创板日报)、证券之星(中国基金报)、ZAKER 3融资上市可灵AI拟最早2027年赴港上市,目标融资超10亿美元,中金高盛瑞银入选保荐人 2026年10月6日 10月6日,据多方消息确认,快手旗下视频生成大模型公司可灵AI正积极推进赴港上市筹备工作,预计最早于2027年启动上市程序,目标融资规模不低于10亿美元。目前已初步确定由中金公司、高盛及瑞银担任其香港首次公开发行的联席保荐人与承销商。此次上市并非临时起意——早在今年5月即有市场传闻,7月2日快手公告披露可灵AI已完成近30亿美元外部股权融资,投后估值达180亿美元,创下全球视频生成大模型领域单轮融资纪录。财务数据显示,可灵AI商业化进程加速明显:2026年第一季度营收逾6.5亿元,同比增长超300%;第二季度营收升至8.5亿元以上,同比增长逾200%,其中约七成收入来自海外市场。截至6月底,可灵AI全球注册用户突破1亿,服务覆盖224个国家和地区。此外,可灵AI全新模型Kling 4.0将于10月正式上线,单次原生生成最长达30秒,支持4K、1080p的10-bit HDR格式高规格输出。 【编辑点评】180亿美元估值、30亿美元单轮融资、七成收入来自海外——可灵AI的这组数据放在一起看,已经不只是一个"快手内部孵化项目"的体量了,而是一个独立的全球化AI公司。更值得注意的收入结构:七成海外意味着可灵在Sora、Runway等国际竞品的家门口抢到了真金白银,而不只是在国内市场内卷。从产品节奏看,Kling 4.0即将上线4K 30秒原生生成,这已经把AI视频从"短视频玩具"推向了"商业级制作工具"的门槛。中金+高盛+瑞银的保荐人阵容,则是国际资本市场对这家公司定价能力的一次背书。如果顺利上市,可灵AI将成为港股AI视频赛道的定价锚——不只是快手的一次分拆,更是整个AI视频生成行业估值逻辑的风向标。 来源:中关村在线、今日头条(澎湃新闻) 4技术突破开源推理引擎Strata发布:12GB消费级显卡稳定运行1250亿参数大模型 2026年10月6日 10月6日,开发者Niko1221开源发布Strata推理引擎。该引擎支持在12GB及以上显存的消费级GPU上运行量化版Qwen3.8-Flash-Next模型(1250亿参数+510亿嵌入表),原生支持262K token超长上下文。Strata的核心技术是三级分层卸载:将MoE模型的全部24576个专家载入系统内存,仅将高频使用的专家缓存进显存,CPU与GPU并行计算互不等待;同时将28.8GB的n-gram查找表放在SSD上,通过OS页缓存按需读取。此外,引擎内置MTP投机解码技术,每次最多起草3个token,平均接受2.4至3.2个,加速1.6至1.8倍。实测数据:在NVIDIA GeForce RTX 5070(12GB显存)+ Ryzen 5 7600 + 64GB内存配置下,2比特量化版Q2_0达到94 token/s推理速度,3比特量化版IQ3_S为53 token/s;AMD Radeon RX 9070 XT(16GB显存)环境下Q2_0达到60 token/s。硬件最低要求为12GB以上显存NVIDIA/AMD显卡、32GB内存、80GB SSD空间,支持Windows 10/11或Linux系统。该项目采用MIT协议开源。 【编辑点评】94 token/s,12GB显卡,1250亿参数——这三个数字放在一起,Strata做的事情已经不是"优化",而是"重新定义门槛"。过去本地跑大模型的第一道门槛是显存,动辄需要24GB甚至48GB的专业卡,普通玩家和中小企业根本够不着。Strata的思路很巧妙:不硬塞,拆开跑——把模型"请进"内存,只让最常用的专家住在显卡上,CPU和GPU各干各的活。这本质上是用系统架构的巧劲弥补单硬件的不足。更重要的是它跑的是千问3.8-Flash-Next——一个真正能干活的大模型,不是玩具级的演示。当一张2000多块的游戏卡就能在家跑千亿参数模型时,"AI必须上云"的叙事开始松动了。当然,32GB内存起步、视觉路径精度存疑等问题还需更多独立验证,但方向已经清晰:算力正在从机房走回桌面。 来源:DoNews、搜狐网、今日头条(引自IT之家) 5前沿模型Reka AI发布190亿参数全模态模型Rho-1:单网络统一文本、图像、视频与机器人控制 2026年10月6日 Reka AI正式发布190亿参数的全模态模型Rho-1,在单一神经网络内统一处理与生成文本、图像、视频以及机器人控制动作。不同于当前行业主流的"多模型分工+路由调度"架构,Rho-1不做任务路由,而是把所有模态信息当作token放进同一个上下文窗口,由单一网络统一处理。训练层面,Rho-1仅投入320张H100显卡、历时约三个月完成训练,算力用量远低于当前头部模型。该模型无需外部工具调用、无需多模型路由切换,支持实时视频生成、动态指令响应与机器人连续动作输出。Rho-1为世界模型与具身智能领域提供了一条全新技术路线——实现"内容生成+实体控制"一体化,大幅降低了通用具身AI的研发落地门槛。 【编辑点评】190亿参数、320张H100、三个月——Rho-1用极其克制的资源做出了一件行业一直在尝试但没做成的事:一个模型,同时能写字、画图、生成视频、控制机器人。当前主流做法是给每个模态配一个专门的模型,再用一个路由层决定"这个问题交给谁"。Rho-1直接把路由层砍掉了,所有模态一视同仁地扔进同一个网络。这个设计如果成立,意味着两件事:一是训练成本大幅下降,不需要维护多个模型和复杂的调度系统;二是具身智能的门槛被拉低——以前要同时搞定视觉、语言、运动规划三套系统,现在一个190亿参数的模型就能做。当然,"能做"和"做得好"之间还有距离,但这条"万物皆token"的技术路线,可能是通往通用具身AI的最短路径之一。 来源:CSDN博客、CSDN博客(AI日报) TODAY'S QUOTE "要造一艘大型火箭,需要时间。" —— Misha Laskin,Reflection AI CEO,2026年10月 INFORMATION SOURCES DoNews 今日头条 UC头条(IT之家) 财联社 证券之星 ZAKER 中关村在线 DoNews 搜狐网 CSDN博客 来了AI新闻早班车 每日精选AI行业资讯 · 智能时代不掉队
来了AI新闻早班车
早上好!今天是2026年10月7日,星期三。国庆假期最后一天,AI行业依然密集释放重磅信号:英伟达投资的Reflection AI正式发布5010亿参数开放权重模型Beam,采用稀疏激活架构,单任务仅激活230亿参数,直指中国开源模型阵营;智谱GLM-5.3正式上架AWS旗下Amazon Bedrock平台,中国大模型首次以按量分成模式接入全球头部云厂商的企业付费体系,商业化出海迎来里程碑突破;快手旗下可灵AI被曝正筹备赴港上市,目标融资超10亿美元,中金、高盛、瑞银已入选联席保荐人;开源推理引擎Strata横空出世,让12GB消费级显卡稳定运行1250亿参数大模型,本地部署门槛被拉到历史新低;Reka AI发布190亿参数全模态模型Rho-1,在单一神经网络内统一文本、图像、视频生成与机器人控制。以下为今日精选5条AI资讯。