ARTICLE · 1030504
三分钟聊AI | 9月18日:vivo押注个人化智能,Union Alpha匿名上线,百度首发产业智能体OS

Agent手机爆发前夜,vivo把答案押在"个人化智能"
2026年9月,vivo在开发者大会上发布Agent OS阶段性落地架构,首次将手机定义为Agent终端,强调“个人化智能”将成为AI手机竞赛下半场的核心。vivo推出“大模型+Harness+智能体安全架构”,将手机6000多项原子能力转化为AI可调用的服务,并发布蓝心小V Pro模式、小V Cowork及升级后的蓝心智能开放平台。在端侧模型方面,vivo修正此前判断,预研蓝心30B MoE端侧大模型,通过稀疏架构按需加载,目标在2028年底实现规模化落地。行业普遍认为,Agent手机竞争已从单一功能比拼转向模型、系统、硬件、生态与个人数据协同的系统级竞争。
CoRL 2026 重磅开源!Sharpa 世界联觉模型实现真实扰动鲁棒手内操作
Sharpa Robotics 团队提出世界联觉模型(WSM),相关成果被 CoRL 2026 高分收录并已开源。该模型将视觉几何、触觉接触、本体感觉与动作历史统一为可复用的世界模型状态,结合干净深度重建、动作条件循环推理与 PPO 非对称 Actor-Critic,在 22 自由度五指灵巧手上实现扰动鲁棒、物体 ID 无关的通用手内旋转。实验显示,WSM 可从未见物体和噪声深度中恢复稳定操作,9 种物体预训练后迁移至 49 种新物体,掉率由 6% 降至 0.3%;真实硬件上支持多物体连续转动、过程扰动恢复、y 轴旋转及工具使用,且优于开环、纯触觉等主流基线。
Al Agent安全不能只靠Prompt了:上海AI Lab探索Agent安全进化新范式
上海人工智能实验室联合复旦大学、上海交通大学、香港科技大学和浙江大学,围绕AI Agent执行过程中的安全风险提出SHE与SafeEvolve两项工作。SHE将安全Harness拆解为System Prompt、Rule Bank、Safety Memory和Tool Policy四类组件,从完整执行轨迹中定位风险环节并迭代更新约束,使Agent-SafetyBench上的平均攻击成功率从17.1%降至5.5%,任务可用性从31.6%提升至47.6%,且安全边界可迁移至其他Agent模型。SafeEvolve则进一步将验证过的Harness经验转化为Policy model的决策能力,通过Safety Prompt和分层SkillBank实现按需检索,并采用Harness-use SFT进行训练。相关成果为Agent安全从静态配置走向动态进化提供了新范式。
神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra
当地时间9月16日,OpenRouter上线匿名模型Union Alpha,定位面向研究、编程和智能体工作流的多模态模型,提供256K上下文窗口和131K最大输出,支持图文输入、工具调用及JSON输出,并以免费形式开放。该模型未公布开发团队、参数量及基准测试成绩,上线首日处理Token约20亿,累计已超1000亿。网友实测反馈不一,有人称其性能接近GPT-6 Astra,在DeepSWE得分74;也有人认为速度缓慢或无法完成任务。关于其真实身份,外界猜测涉及OpenAI、GLM、Qwen、Mistral等,均未获证实。
百度智能云首发产业智能体操作系统,要实现 AI 的商业和技术飞轮
2026年9月16日,在人民日报文化科技有限公司与百度公司联合举办的2026智能经济论坛上,百度智能云推出行业首个产业智能体操作系统及百度搭子开发平台。系统从OS层级连接企业数据、知识和工具,调度云上算力,让通用、专业和定制三类智能体在统一规则下协作,避免形成新的“智能体烟囱”。搭子开发平台向企业开放与百度搭子同源的Harness能力,提供生产级运行环境,降低定制智能体的开发和维护成本。此举旨在让智能体进入企业核心业务,将大模型转化为经济价值,并带动百度云与AI基础设施需求增长。
硬件调试进入 Web 时代:浏览器成了新的工程师工作台
2026年9月,硬件调试工具ESP32 Bit Pirate发布,将浏览器变为嵌入式工程师的工作台。该项目基于低成本的ESP32-S3微控制器,利用Web Serial和WebUSB等HTML5 API,实现从浏览器直接完成固件烧录、串口交互与调试。其固件支持多款ESP32-S3开发板及开放载板,可处理I2C、SPI、UART、CAN等有线协议,并支持BLE、Wi-Fi嗅探、Sub-GHz、RFID及LoRa等无线功能,同时提供JTAG/SWD调试接口。配套的端到端操作指南降低了使用门槛,并支持通过Python脚本实现自动化测试,为低成本硬件调试提供了新的技术路径。
OpenAI把AI推向物理世界,这家公司已造好引擎,下一站1000万小时...
9月3日,OpenAI发布GPT-6 Astra,在ARC-AGI-3基准测试中拿下99.9%的成绩,接入真实双臂机器人后,20次任务成功19次,显示大模型正从数字世界向物理世界延伸。与此同时,Dyna Robotics将第一人称视角的人类经验数据扩展至100万小时,其Dyna-2模型在未见任务中表现出更强泛化能力;Genesis AI的GENE-26.5也采用同类数据进行训练。这些进展背后,数据公司Maxinsights浮现:作为Dyna-2和GENE-26.5的数据合作伙伴,其已建立覆盖六大洲的采集网络,累计交付超过200万小时训练数据,并于今年3月进入中国市场。行业正兴起“以自我为中心的数据浪潮”,机器人训练开始大规模吸收人类真实活动经验。
对话vivo高管:端侧大模型、Harness与「个人化AI」的下一步
今年开发者大会上,vivo提出“个人化智能”的AI Phone路线,将AI从单点功能升维为系统级能力。基于MoE混合专家架构,vivo已训练30B参数端侧大模型,推理时动态内存占用降至2—4GB,但该能力仍处工程验证阶段,预计2028年前后逐步成熟。同时,vivo将Harness执行中台嵌入蓝心小V及系统进程,使其不绑定具体模型,而将任务调度、执行逻辑和用户记忆长期沉淀。vivo认为,其差异化在于端侧Harness对OS的深度调度,以及手机对用户照片、文件等专属上下文的预理解,从而让AI主动走在用户需求之前。vivo AI全球研究院院长周围等高管介绍了上述进展。
2400万人围观,前OpenAI研究员做了个「闭嘴」模型
前OpenAI研究员Diogo Almeida结束两年隐身状态,发布新模型Jev。该模型放弃自由文本生成,直接输出带类型和置信度的结构化概率决策,可并行计算,官方称速度提升20至200倍、成本最高降至原来的1/400,输出token目前免费。Almeida曾参与InstructGPT和GPT-4早期RLHF工作,如今通过TypeSafe公司提出RLCD训练方法,强调“校准”而非“人类偏好”。外部测试中,Jev在0.35秒内完成一项写作质量判断,而Fable 5.1用时8.83秒。此举引发对AI是否必须“会聊天”的反思,展示模型作为软件内部可调用组件的可能性。
20所全球顶尖高校联手造了一个“科学IDE”,想用科研经验训练AI
全球20所顶尖高校的研究者联合推出项目ScienceIDE,旨在将科研代码、运行环境、科学验证与模型训练打通,使AI在真实科研任务的执行、试错与修正中获得反馈。项目由AItonomy Foundation主导,PhAI Labs、Qwen等参与支持。研究发现,在1769个缺陷任务中,有976个程序能顺利编译运行并正常结束,但最终科学结论错误,占比高达55.2%,表明仅以“程序是否跑通”作为成功标准会严重误导AI训练。ScienceIDE将科学验证纳入学习闭环,并揭示真正难点在于代码库内部状态与约定,而非公开公式或常数,为科研领域AI的发展提供了新思路。
🔗 文章来源
Agent手机爆发前夜,vivo把答案押在"个人化智能" https://www.tmtpost.com/8143272.html
CoRL 2026 重磅开源!Sharpa 世界联觉模型实现真实扰动鲁棒手内操作https://mp.weixin.qq.com/s/TAv9M8MP3_HG6sK6IwFkDQ
Al Agent安全不能只靠Prompt了:上海AI Lab探索Agent安全进化新范式https://mp.weixin.qq.com/s/j_hHnNDSVQQA42SDR8p6TA
神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra https://www.infoq.cn/article/EsH2bUAoMNQx6Nt7vytC?utm_source=rss&utm_medium=article
百度智能云首发产业智能体操作系统,要实现 AI 的商业和技术飞轮 https://www.infoq.cn/article/jXliIdDVTYDAtm73EoSU?utm_source=rss&utm_medium=article
硬件调试进入 Web 时代:浏览器成了新的工程师工作台 https://www.infoq.cn/article/t5xEQSTQCB0glKSrppNT?utm_source=rss&utm_medium=article
OpenAI把AI推向物理世界,这家公司已造好引擎,下一站1000万小时...https://mp.weixin.qq.com/s/X9a87Lk0Y5Dvunx43POFVQ
对话vivo高管:端侧大模型、Harness与「个人化AI」的下一步https://mp.weixin.qq.com/s/vZPTaGJiNCl4LmdyCX8EoQ
2400万人围观,前OpenAI研究员做了个「闭嘴」模型https://mp.weixin.qq.com/s/k2GEzGT0CoLJ-49_5P3JIg
20所全球顶尖高校联手造了一个“科学IDE”,想用科研经验训练AIhttps://mp.weixin.qq.com/s/H1Kap0VTXVcXM3JRyoPMjw