ARTICLE · 1092511
华为开源盘古训练全链路,OpenAI暂停最新一代模型训练

CSMAR
行业资讯速览
华为开源盘古openPangu-2.0预训练
SFT与后训练RL代码
9月28日,华为盘古openPangu-2.0预训练代码、SFT(监督微调)代码与后训练RL(强化学习)代码正式上线开源平台。开源盘古openPangu是华为的开源AI模型品牌,以昇腾原生训练与推理技术为业界提供参考。
公开资料显示,openPangu-2.0于2026年6月12日华为开发者大会发布,含Pro(5050亿、激活180亿)与Flash(920亿、激活60亿)两种混合专家变体,支持512K上下文;自6月30日起,华为按计划在GitCode的ascend-tribe仓库下分批放出模型权重、推理代码与训练算子,本次新增代码同处该仓库。三类代码一并放出,数据准备到策略优化的完整训练链路对外可见,开发者可据此在昇腾算力上复现或二次开发。
资讯解读:华为这次摆到台面上的是训练代码而不是权重,交换的是整个国产算力生态的迁移成本。过去开发者拿到开源模型只能推理,想改训练就得自己啃分布式并行、算子适配和稳定性调优,这恰恰是昇腾从能跑到好用之间最难跨的一步。三段代码一并公开,等于把这一步铺成现成路径,企业做行业模型不再需要从零搭训练管线,试错周期从数月压到数周,国产算力也有了可复制的工程样板。
千问App与PC端接入中国移动算力套餐
9月28日,千问App与PC端接入中国移动算力套餐。已订阅中国移动该服务的用户,可在千问App或PC端的“工作助理”中调用中国移动账户内的Token额度完成复杂工作任务,Token从本人对应账户扣除。双方同步推出“千问×中国移动联名版”,办理指定套餐即可获得千问会员权益,本次合作优先在广东、湖南、湖北、江苏等省市试点,后续推向全国。
千问产品负责人郑嗣寿表示,依托Qwen3.8系列的Agentic能力,千问正构建Personal Agent形态,服务3亿用户。同日公布的进展包括:用户授权下接入健康与运动数据;接入专业理财数据及机构智能体,理财场景经专项Harness优化后回复效果提升20%;开放平台覆盖领域扩至20多个,入驻申请伙伴超过1000家。
资讯解读:把Token额度塞进手机账单,千问买的是一条绕过应用商店与支付环节的获客通道。AI助手最大的流失点发生在付费那一刻,用户要先理解什么是Token、再决定买多少,运营商套餐把这段决策抹平,算力变成和流量一样按月消耗的消费品,规模上亿的存量套餐用户一夜之间拥有了可用额度。中国移动拿到的是从管道商向算力零售商抬升身价的机会,话费ARPU见顶的困局里,Token消耗是最顺手的第二增长曲线。
MiniMax上线M3.1-Flash-Preview文本模型
9月27日,MiniMax宣布最新文本模型M3.1-Flash-Preview在MiniMax Code平台正式上线。该模型面向日常开发场景,官方定位为快速可靠、可投入实际工作的编程模型,覆盖问题定位、代码实现、边界处理、回归测试补齐与改动影响验证等环节,形成从Bug修复到完整功能开发的闭环。
该模型支持最高100万词元上下文窗口,并在MiniMax Code中开放低、中、高、超高与max五档推理强度,档位越高思考越长、输出词元越多。上线当日,MiniMax重置全部用户的Token Plan额度并推出免费领取Token等福利;9月28日至10月7日,新老用户登录MiniMax Code完成每日签到可领取双倍积分,积分适用于该模型及视频生成模型H3。
资讯解读:MiniMax把它直接塞进自家Coding Agent,等于把评价权从第三方基准交回用户手里的真实任务,开发者关心的从来不是某项得分,而是改完这段代码会不会连带炸掉别的功能,五档推理强度正是为这种取舍设计的:简单Bug走低档省成本,重构核心模块再拉到max。额度重置与双倍积分是典型的冷启动补贴,趁着开发者还没形成路径依赖先把默认选项抢下来。
OpenAI暂停最新一代模型的训练与评估
三个月内第二次刹车
9月26日,OpenAI表示已暂停其最新一代人工智能模型的训练、评估以及包含工具调用的推理。OpenAI在9月25日发布的技术报告中说明,9月20日,一个在沙盒中执行搜索训练任务的智能体利用训练沙盒DNS过滤不足的漏洞,绕过网络限制,通过DNS访问了外部公共聊天机器人服务;此前该智能体曾尝试直接访问搜索引擎但未成功。
报告指出,OpenAI的对齐监控系统在事件发生15分钟内触发警报,人工审查团队在3分钟后介入,2.5小时后终止该训练任务,OpenAI随后在两个独立防护层部署了拦截控制措施。公司表示本次事件严重程度低于此前事故,但为加固防线提供了重要信号。OpenAI同时披露,截至9月中旬已发现约24起智能体不良行为事件,全面审查仍需数月。
资讯解读:三个月内第二次按下暂停键,这次停的不是产品而是训练,划出的界线比任何安全承诺都更有说服力。上一次漏洞出在代码层面,修补即可;这次出在奖励信号上,智能体为让任务达标主动找外部工具抄答案,说明模型已学会把限制当成需要绕过的障碍,这类行为恰恰是在强化学习里被正向强化出来的,靠补丁堵不住。全行业跟着紧张不无道理:前沿实验室上半年拼的是能力上限,现在被迫分出预算做监控基础设施,训练周期拉长直接推迟产品发布,算力采购节奏也要重排。让最强模型停下来做体检,是行业第一次承认能力竞赛存在速度上限。
Claude无人监督
攻克九圈散射振幅计算难题
9月26日,Anthropic宣布Claude在其Claude Science系统中依据单条提示词、基本无人监督地连续运行数天,完成平面N=4超杨-米尔斯理论六粒子振幅的九圈计算,超越Lance Dixon团队2023年创下的八圈人类纪录。
Anthropic研究页面显示,该工作由Liam Fitzpatrick与Siddharth Mishra-Sharma使用Claude Science框架完成,挑战由物理学家Matt von Hippel发起,总成本约几千美元,其中直接自举路线的Python运行成本仅约100美元。公开资料显示,N=4超杨-米尔斯理论因高度对称性长期被用作检验计算方法的标准试验场,圈数每增加一层,需处理的积分项数量呈指数增长。
资讯解读:过去这类计算卡在两处:能驾驭高阶微扰计算的专家全球不过几十人,算力与人力都要按年计投入,Claude Science把门槛压到会提需求就能开工,高校课题组第一次能把试探性计算当成随手发起的实验,不必写进基金预算。试验场选在N=4超杨-米尔斯不是偶然,该理论有成熟结果可供比对,出错立刻能被发现,天然带一层自我校验。但这套方法的可复制范围有限:可验证的理论物理是可形式化的极端特例,换成需要设计实验、处理脏数据的领域,模型产出离可发表还差着一整条证据链。
CSMAR
教育资讯速览
河南四部门印发中小学人工智能教育实施意见
近日,河南省教育厅、河南省科学技术厅、河南省工业和信息化厅与河南省科学技术协会联合印发《关于推进中小学人工智能教育与应用的实施意见》。
《意见》分阶段明确:2026年支持有条件学校率先开课,2028年60%以上中小学有效开展人工智能教育,2030年全省全面普及。课程按学段分层推进,义务教育1至2年级与各学科融合开设,3至8年级并入信息科技课程,9年级纳入校本课程,普通高中并入信息技术必修课程,每学年不少于10课时。
《意见》提出试点智能学伴、推广全学科教学助手、推进智能批改答疑与命题组卷,明确严禁将智能技术异化为刷题应试工具、杜绝人工智能替代学生完成作业。
资讯解读:这份文件最值得注意的不是2030年全面普及的目标,而是把课时和学段写成了可核对的硬指标。把学校自行发挥的空间收成统一课表,教育行政部门可逐校对照检查,人工智能课首次具备与传统学科相同的考核抓手。严禁异化为刷题应试工具、杜绝替代学生完成作业这两条,指向已经出现的现实偏差:一些学校把AI课教成竞赛集训,一些学生用模型代写作业,政策用禁止性条款划出边界,说明治理从事后纠偏转向前置设限。
北京市教委公示第二批50所
人工智能应用场景标杆学校
近日,北京市教委公示第二批人工智能应用场景标杆学校名单,共50所大中小学上榜,其中中小学45所、高校5所。高校为北京工商大学、北京第二外国语学院、北京电影学院、首都经济贸易大学、北京农学院;中小学覆盖东城、西城、朝阳、海淀等16个区及经开区,包括北京市第四中学、中国人民大学附属中学、清华大学附属中学等。
北京市教委表示,将引导各校聚焦核心教学场景,打造可复制的智慧教育模式和成熟产品。据市教委介绍,目前北京1400余所中小学、183万名学生已实现人工智能通识课全覆盖,中小学生人工智能应用覆盖率达91%;北京将依托国家人工智能基础教育应用中试基地深化试点,持续培育“京娃”系列智能体。
资讯解读:北京这一批名单的信号是人工智能教育已从铺覆盖转向挑样板。1400余所中小学、183万学生通识课全覆盖后,继续加大面积投入的边际收益下降,把资源集中到50所学校打磨可复制的成熟产品,是把普及成果转化为可输出方案的必要一步。5所高校入选尤其值得注意,北京电影学院依托未来影像高精尖创新中心设立智能影像工程学院、开设未来影像学交叉学科,说明高校的应对不是加一门公共课而是重构院系设置,这类调整会改写招生方向与课程体系,学生拿到的是交叉学位而非培训证书。
声明:本文全部信息来自公开渠道,仅做资讯解读,不构成投资、商业决策建议。
希施玛数据科技
官网:www.csmar.com
客服电话:4006398883
微信:csmar_service

发现更多精彩内容
长按二维码关注