乐于分享
好东西不私藏

元以AI早报-2026年06月13日

元以AI早报-2026年06月13日
1.HDC 2026华为发布HarmonyOS 7 鸿蒙正式迈入AI原生时代
2.阿里清华团队ViT³模型入围CVPR最佳论文决选 突破视觉Transformer算力瓶颈
3.2026智源大会聚焦世界模型 明确人工智能向物理世界演进路径

元以AI早报

01
HDC 2026华为发布HarmonyOS 7 鸿蒙正式迈入AI原生时代
📱 华为HDC 2026发布HarmonyOS 7与openPangu 2.0📊 鸿蒙生态累计设备破13亿,HarmonyOS 6升级率达98%🤖 鸿蒙升级AI框架,华为目标AI领域赶超世界第一
华为在HDC 2026开发者大会上正式发布HarmonyOS 7系统与盘古大模型openPangu 2.0,标志着鸿蒙生态从早期的生态搭建阶段,正式走向原生智能架构的全面演进。目前鸿蒙生态累计设备总量已突破13亿台,其中HarmonyOS 6终端数量突破6600万,升级率达到98%,生态成长速度远超行业预期。openPangu 2.0推出两个版本,其中Pro版总参数量505B,Flash版总参数量92B,华为还预告今年秋季将在自研麒麟芯片上支持端侧30B模型部署,余承东亲自带队AI与盘古大模型团队,目标实现从中国第一到世界第一的赶超。HarmonyOS 7升级了系统级智能体框架2.0,以小艺为核心打造系统级AI管家,实现“意图即服务”的全新交互,复杂任务成功率超90%,同时发布《鸿蒙智能安全白皮书》构建Agent时代安全框架,新增AI防诈、无障碍功能优化等实用体验。AI改写了操作系统竞争规则,没有历史代码包袱的鸿蒙,正在探索下一代操作系统的全新答案。
信息来源:https://mp.weixin.qq.com/s/Py2ke8BdMYHefcMqAp9R5g
02
阿里清华团队ViT³模型入围CVPR最佳论文决选 突破视觉Transformer算力瓶颈
🔍 阿里清华联合提出的ViT³入围CVPR2026最佳论文决选
💡 首次引入测试时训练,破解视觉Transformer核心痛点
📊 性能提升显存大降,为多模态大模型降本开辟新路径
阿里巴巴联合清华大学团队提出的ViT³模型,从CVPR 2026的16092篇投稿中脱颖而出,成功入围最佳论文决选,入围率不足千分之一。该研究首次系统性将测试时训练机制引入视觉领域,破解了当前视觉Transformer的核心痛点:当输入高分辨率图像、长视频这类复杂多模态数据时,token数量激增,传统Softmax Attention的计算和显存成本会呈二次增长,难以适配落地需求。ViT³通过在线学习机制动态压缩上下文信息,在保持线性计算复杂度的前提下实现了性能突破,公开实验数据显示:在RTX 3090上处理1248×1248分辨率图像时,ViT³-T的推理速度达到同类基准DeiT-T的4.6倍,GPU显存消耗降低了90.3%,仅用约十分之一的显存就实现了更高处理速度。该成果打破了“更好性能必然对应更高算力”的行业惯性,为降低多模态大模型部署成本、推动视觉智能在各领域规模化落地开辟了新路径。
信息来源:https://mp.weixin.qq.com/s/-LlryKjaW1jS_UouZwAU7Q
03
2026智源大会聚焦世界模型 明确人工智能向物理世界演进路径
📍2026年智源大会在北京举办,汇聚千余AI顶尖人士
🔍智源提出世界模型是下一代大模型及物理AGI方向
🆕大会发布多项原创成果,大咖研讨指明物理AGI路径
作为全球人工智能领域公认的创新风向标,2026年智源大会在北京举办,汇聚全球各地顶尖AI专家、科技企业代表,上千位产学研顶尖人士共同探讨AI从数字世界走向物理世界的下一程发展方向。本次大会上,智源研究院明确提出,人工智能正沿着大语言模型向多模态大模型再向世界模型的方向演进,世界模型是下一代大模型技术方向,也是通往物理世界通用人工智能的必由之路,核心跃迁方向是从“预测下一个词元”升级为“预测下一个物理状态”。智源研究院本次发布悟界·Physis-v0.1、悟界·Emu3.5等多项原创成果,展示了覆盖医疗辅助诊断、科学发现、药物研发、个人服务、生物安全风险防控等领域的智能体矩阵,两位图灵奖得主到场分享核心观点,行业领军者围绕AI技术跃迁展开深度讨论,为行业指明了通往物理AGI的清晰路径。
信息来源:https://mp.weixin.qq.com/s/T8GXNRVVJEfQFviK1gnzDA
04
谷歌开源DiffusionGemma扩散文本模型 开辟低延迟本地化AI生成新路径
🔓 Google DeepMind 2026年6月开源DiffusionGemma大模型
⚙️ 适配消费级显卡本地运行,吞吐达传统模型4倍
🗺️ 补齐高速实时本地AI缺口,开辟LLM双线新格局
Google DeepMind于2026年6月10日正式开源实验性文本扩散大模型DiffusionGemma,主打极速并行文本生成,打破了市面上绝大多数大模型沿用的自回归逐字生成的“打字机”模式瓶颈。该模型移植了图像领域成熟的扩散生成逻辑,通过全局并行迭代去噪,可一次性输出完整段落,最大化压榨GPU算力。它采用MoE稀疏专家架构,总参数量26B,推理时仅激活8个专家,有效运算参数仅3.8B,平衡了推理性能与部署门槛。关键数据层面,其4bit量化版本仅需18GB显存,RTX 4090、5090这类消费级显卡即可本地完整运行;同等硬件条件下,吞吐速度稳定达到传统自回归Gemma模型的4倍,H100单卡可达1000+ token/s,延迟大幅降低,完美适配单人实时交互场景。该模型并非要替代高精度自回归大模型,而是补齐了高速实时本地AI的重要拼图,开辟了LLM双线发展的新格局。
信息来源:https://mp.weixin.qq.com/s/vb7-84pfMGbOZB_WtJpEzQ
05
通义千问推出足球预测AI助手 验证大模型在高噪声复杂场景下的推演能力
⚽ 阿里通义千问推出可精准预测足球赛事的AI助手
🧠 验证了AI处理复杂不确定信息的能力已成熟
🏛️ 可借鉴该经验探索AI在公共治理领域的应用
阿里通义千问推出足球预测AI助手,在2026世界杯揭幕战及后续赛事中精准命中比分、红牌分布及关键进球节点,展现出色的高噪声环境推演能力。该应用并非简单的数据罗列,而是基于球队状态、战术风格、裁判尺度及对抗强度等多维变量进行动态建模,体现了大模型从通用问答向复杂场景因果推演的能力跃升。体育赛事作为高度不确定性的现实世界缩影,其预测成效验证了AI在处理非结构化信息与长期依赖关系上的成熟度。此类产品形态的成功落地,标志着AI正加速融入大众生活与娱乐产业,催生出新型人机协作模式。政府部门可借鉴此经验,探索AI在宏观经济预警、公共卫生监测及应急管理模拟等公共治理领域的应用,建立面向复杂系统的数字孪生推演平台,提升政策制定的前瞻性与科学性。
信息来源:https://mp.weixin.qq.com/s/45HIA5U4gBRLp6_H_MRMlQ
06
Kimi K2.7 Code编程模型发布开源 长上下文与智能体执行能力显著提升
🚀 Moonshot AI开源Kimi K2.7 Code,减30%token消耗提性能
📊 多项基准测试显示该模型代码及智能体性能提升
💡 降低代码开发门槛,推进AI辅助编程产业落地
Moonshot AI正式发布并开源Kimi K2.7 Code编程模型,相比K2.6模型,该模型显著提升了长上下文编程场景的指令遵循能力与长程编程任务性能,同时大幅改善了长程任务中的过度思考倾向,平均token消耗减少30%。在内外部代码能力基准测试中,该模型性能提升明显:Kimi Code Bench v2提升21.8%、Program-Bench提升11%、MLS Bench Lite提升31.5%。模型代码能力的进化也带动了智能体能力的提升,在Kimi Claw 24/7 Bench、MCP Atlas等评估Agent自主化执行能力的基准测试中,性能整体提升10%左右。长上下文编程能力的突破直接降低了大规模代码库维护与重构的技术门槛,有效提升了开发者利用AI辅助编写、调试及生成文档的效率。随着软件工程复杂度持续攀升,模型对长程逻辑的把握能力已成为决定AI编程工具实用性的核心指标,此次更新也进一步推进了AI辅助编程的产业落地。
信息来源:https://mp.weixin.qq.com/s/MUbflqdRbbzh0z4y65oRNw
07
华为云完成MiniMax M3模型昇腾算力适配 夯实国产AI算力底座支撑
💻 华为云完成MiniMax M3开源首发适配,基于昇腾算力
🤖 M3性能达国际前沿,验证国产AI芯片集群能力
📝 需完善算力规划统一标准,助推实体经济智能化升级
华为云宣布完成与MiniMax原生多模态旗舰模型M3的开源首发适配,基于昇腾算力底座提供Tokens支持,打通从底层算力到企业生产力的应用闭环。MiniMax M3采用稀疏注意力架构,支持百万级上下文窗口,在代码生成、SVG绘图及端到端智能体评测中达到国际前沿水平。此次软硬件协同优化验证了国产AI芯片集群在承载超大规模多模态模型推理时的稳定性与扩展性。在全球算力供应链波动背景下,本土算力厂商与模型企业的深度绑定,有助于缩短技术迭代周期,降低企业数字化转型的初期投入成本。政策层面应继续强化算力基础设施的统筹规划,推动异构算力兼容标准的统一,鼓励云服务提供商搭建开放的模型适配平台,促进中小型企业低成本调用先进AI能力,加速智能制造、跨境电商等实体经济板块的智能化升级。
信息来源:https://mp.weixin.qq.com/s/K6Ah9ZfK1-kKR6LAh00_jg
08
Claude Fable 5安全防线遭破解 暴露大模型对齐机制缺陷与信任危机
🔓 安全研究员绕过Claude安全分类器,曝光隐形降智机制
⚠️ 大模型安全存明显漏洞,防线失守将引发多种严重后果
📝 国际AI监管转向强制合规,我国需加快完善AI安全体系
知名安全研究员公开披露成功绕过Anthropic旗下Claude Fable 5的安全分类器,获取高危敏感内容输出权限,同时曝光该模型曾内置针对同行研究的隐形降智机制,引发全球AI社区强烈反响。尽管Anthropic事后致歉并调整拦截策略,但事件暴露出当前大模型在内容过滤、意图识别及防御鲁棒性方面仍存在明显漏洞。随着AI智能体逐步获得系统级权限与自动化执行能力,安全防线失守可能导致数据泄露、恶意操作及产业链攻击等严重后果。国际监管趋势正从倡导自律转向强制合规,欧盟人工智能法案等法规已明确高风险AI系统的审计要求。我国需加快构建覆盖模型训练、部署上线及日常运营的全生命周期安全评估体系,建立国家级AI漏洞应急响应机制,督促企业落实算法备案与透明化报告制度,筑牢人工智能发展的安全底线。
信息来源:https://mp.weixin.qq.com/s/F1WF-FPkGABrx1IM4aVvhA
09
估值近万亿AI巨头CEO仅1个直属下属!居然还不是技术背景?
📊 9650亿估值AnthropicCEO极致扁平化仅1名直属下属
👩💼 唯一直属幕僚长背景多元,曾预判AI冲击知识工作
🧭 创始人兄妹拆分职责,CEO专注AGI核心研究引热议
最新估值9650亿美元的AI巨头Anthropic,爆出了一个颠覆认知的管理模式:创始人兼CEO Dario Amodei竟然只有1名直属下属,对比英伟达黄仁勋直接管理60人、OpenAI奥特曼直接管理6人,这个极致扁平化操作让硅谷都直呼没想到。这位唯一直属下属是首席幕僚长Avital Balwit,她并非技术出身,本科主修政治与社会思想,拿到罗德奖学金赴牛津研究AI安全,还曾是出版过儿童读物的自由作家,25岁时就发文预判AI会冲击大量知识工作,提出“AI不需要超过最优秀的人类,只需要超过企业愿意雇佣的普通人”,引发行业热议。更有意思的顶层AI圈八卦是,她的未婚夫是被OpenAI解雇的前研究员Leopold Aschenbrenner,也就是业内尊称的“AI股神”,他创办的对冲基金起步规模2.25亿美元,一年就暴涨至55亿美元,最新管理规模已经突破200亿美元。实际上这套极简管理是Dario和身为联合创始人总裁的妹妹拆分了CEO职责,所有高管都向妹妹汇报日常运营,Dario只专注战略、文化和前沿研究,抽身聚焦AGI的核心思考,这种极致管理模式也引发了科技圈的广泛讨论。
信息来源:https://mp.weixin.qq.com/s/PpJlXjO8S05NvlmWkN_TyQ
10
全球企业AI支出转向投资回报率考量 中国大模型凭性价比加速出海
🔄 全球AI行业转折,企业从追采用率转向求投资回报率
💡 企业普遍采用多模型策略,优化AI预算分配
🚢 DeepSeek性价比突出,API调用量飙升出海迎机遇
当前全球企业正在经历从盲目追求AI采用率,到务实追求AI投资回报率的行业转折,多家机构数据印证了这一趋势变化。战略咨询公司贝恩调查全球951家年收入超1亿美元的企业后发现,AI支出超万亿美元的企业中,有40%仅节约了10%及以下的成本,远低于预期,不少企业因此陷入沉重成本压力,过去企业竞相消耗Token拥抱AI的模式已经不可持续,如今开发者普遍采用多模型策略,将复杂高风险任务交给昂贵的欧美闭源大模型,日常任务用低成本开源模型,以此优化预算分配。在此背景下,中国DeepSeek凭借推理效率的工程优化推出极具竞争力的定价,调整价格后输入(缓存命中)每百万Tokens仅需0.025元人民币,美国云端平台Vercel数据显示,5月DeepSeek旗下模型API调用量从不足1%飙升至17%,成为欧美昂贵大模型的热门替代,中国大模型出海正迎来结构性性价比机遇。
信息来源:https://mp.weixin.qq.com/s/JeJB0njeA1aQxeTFauOvDw

早报内容及素材均来自网络公开渠道,版权归原作者所有,仅作信息分享使用。

—— END ——