夜雨聆风学习资料网

ARTICLE · 1029545

“AI才女”罗福莉直播展示“钞能力”:每小时“烧掉”超20万元!雷军此前给出“定心丸”:今年投160亿元

“AI才女”罗福莉直播展示“钞能力”:每小时“烧掉”超20万元!雷军此前给出“定心丸”:今年投160亿元

“沉默近半年,我们一直在用这段时间研究一个问题:强化学习(RL)到底可以走多远。”9月17日凌晨,小米MiMo大模型团队负责人罗福莉在社交平台发文分享了小米大模型的最新进展。

据罗福莉透露,目前小米MiMo-V2.6正处于强化学习中间阶段,其团队正在进行三方面的扩展:一是计算资源(每步约20亿个Token,1568个 Prompt × 16次Rollout,完全异步);二是环境和测试框架(多任务智能体强化学习,一次运行中混合多个框架);三是评估计算(代理式组内信用分配,带有测试用例和基于量规的奖励)。小米MiMo团队将在接下来的几周内逐步开源相关细节。

值得注意的是,罗福莉还直接晒出了MiMo-V2.6的实时训练页面,让外界首次看到这一代模型强化学习阶段的部分训练状态。训练页面包含MiMo-V2.6-Pro、MiMo-V2.6-Flash两个版本,具体展示了模型训练进度、Token消耗、训练成本、样本数量以及多个内部指标变化。

据界面新闻,截至17日下午,两个版本累计训练成本超过135万美元,其中MiMo-V2.6-Pro时长为1天21个小时,耗费超93万美元,平均每小时耗费超2万美元;MiMo-V2.6-Flash训练时长1天16小时,耗费超42万美元,平均每小时耗费超1万美元。综合计算,两个版本训练合计每小时花费约3.1万美元,折合人民币超20万元

▲罗福莉 图据罗福莉微信公众号

罗福莉1995年出生于四川宜宾,本科就读于北京师范大学计算机专业,硕士毕业于北京大学计算语言学研究所计算语言学专业。求学期间,她于2019年在人工智能领域顶级国际会议ACL上发表了8篇论文,其中2篇为第一作者。

据红星新闻报道,一名熟悉罗福莉家庭情况的宜宾罗氏宗亲研究会人士告诉记者,罗福莉出生在宜宾市某村一个普通家庭,父亲是电工、母亲是教师,妹妹现在是医生。“几年前,罗福莉的叔叔说她在做人工智能底层设计,我当时不敢相信我们宜宾罗氏有如此高精尖领域的科技人才,但我在北大校友通讯录里找到了罗福莉的名字,后来在北大官方网站见识到这位学霸,她的确是罗氏家族的骄傲。”

她的职业生涯始于阿里巴巴达摩院,她主导开发了多语言预训练模型VECO,并推动了AliceMind的开源工作。2022年,罗福莉加入DeepSeek母公司幻方量化从事深度学习相关工作,后又担任DeepSeek的深度学习研究员,参与研发DeepSeek-V2等模型,被称为“AI才女”。

2025年初,据证券时报报道,小米创始人雷军曾希望用千万元年薪挖角罗福莉,邀请她到小米带领团队从事AI大模型研究,该消息一度登上微博热搜。对于雷军的邀约,报道称,当时罗福莉还在考虑要不要加入小米。

去年11月,罗福莉官宣加入小米公司。她在朋友圈发文称:“智能终将从语言迈向物理世界。我正在Xiaomi MiMo,和一群富有创造力、才华横溢且真诚热爱的研究员,致力于构建这样的未来,全力奔赴我们心目中的AGI。”据悉,Xiaomi MiMo是小米首个推理大模型。

一个月后,身为MiMo大模型负责人的罗福莉完成加入小米后的首秀。她在小米“人车家全生态”合作伙伴大会上,介绍了小米大模型的具体情况,并谈及自己对AI的相关看法。

她在活动中指出,下一代智能体系统核心围绕Agent执行与Omni(全能)感知,涵盖记忆、推理、自主规划、决策、执行多个维度,应当从回答问题走向完成任务,并且应当统一多模态感知,为理解物理世界打基础。

图片来源:小米“人车家全生态”合作伙伴大会

今年3月,罗福莉与月之暗面创始人兼CEO杨植麟、智谱华章CEO张鹏等AI顶流们参加了一场圆桌论坛,谈起当时火热的OpenClaw(龙虾),罗福莉将其当做一种AI框架的革命性与颠覆性事件看待,并且因为是开源,有利于整个社区参与深度改进。“另外从技术角度来说,它保证了模型下限,同时又拉升了上限,在绝大部分场景,它的任务完成度已经非常接近Claude最新模型。”

罗福莉还表示,在接下来一年里,AGI进程中最关键的一件事是“自进化”。 她认为,借助强大的模型与Agent框架,在可验证的约束条件下让模型持续迭代优化,模型便能自主学习和进化,拿出更优方案。她预测,未来一到两年内,大模型叠加自进化框架,将对科学研究带来指数级加速,这并不仅仅是替代人力,而是让AI像顶尖科学家一样探索未知。

小米也在3月推出Xiaomi MiMo-V2-Pro、Xiaomi MiMo-V2-Omni与Xiaomi MiMo-V2-TTS三款自研大模型。

三款模型中,MiMo-V2-Pro是旗舰文本基座,专为高强度Agent工作场景而生,主打推理、规划与工具调用。MiMo-V2-Omni是全模态Agent基座,原生融合文本、视觉与音频感知,打通从理解到执行的完整链路。MiMo-V2-TTS是语音合成大模型,目标是为Agent赋予有温度、有情感的声音表达能力,构成全栈的最后一环。

其中,MiMo-V2-Pro作为旗舰基座模型,专为Agent场景深度优化,针对复杂多样的智能体架构进行了监督微调和强化学习,具备更强工具调用与多步推理能力,并最终交付结果。从架构上看,该模型总参数规模突破1万亿(1T),其中激活参数为42B,采用改进后的混合注意力机制(Hybrid Attention),在保证推理效率的同时大幅提升模型容量。其上下文窗口进一步扩展至100Token,可以支持超长任务链和复杂工作流。

同步亮相的MiMo-V2-OmniMiMo-V2-TTS,则补齐了感知与表达的两块拼图。前者的核心价值在于实现了音频、图像、视频的对齐。后者支持细粒度控制的情感表达引擎,让Agent具备了更接近人类的表达能力。

小米创始人雷军彼时在社交平台发文表示:AI领域,我们今年的研发和资本投入就将超过160亿元。”他还介绍,大模型Mimo-V2-Pro在全球大模型综合智能排行榜Artificial Analysis上,位列全球第八。按大模型品牌来排名,排在全球第五,超过了xAlGrok。

(免责声明:文章内容和数据仅供参考,不构成投资建议。投资者据此操作,风险自担。)

编辑|段炼 杜恒峰
校对|梁露月
本文转载自界面新闻、红星新闻、证券时报、每经网

推荐阅读

共和党中期选情不妙,马斯克等19位美国富豪纷纷砸钱,支持特朗普!前20大金主中,仅索罗斯一心支持民主党

霉霉丈夫等多名球星遭遇庞氏骗局!主犯系38岁非法移民,7年骗取2.5亿元,挥霍无度:坐私人飞机、坐拥纽约等地高档公寓

12:0全票通过,加息25个基点!美联储时隔3年2个月重启加息,美股跳水!16名官员预判年内还要加息,专家:美国经济或将迎艰难一年

主播穿正装戴国徽,自称“村干部助农卖山货”,官方通报:都是假的,已对4名主播及MCN公司立案调查

南方医科大学坠亡学生与导师聊天记录曝光:导师转账2.2万元帮忙,多次关心鼓励;家属:“导师压榨”“只给3天假”等均为谣言

相关学习资料

返回首页浏览学习资料