ARTICLE · 1048951
AI周报:谷歌Gemini 4 Pro生图效果惊艳;苹果AI服务器曝光;豆包手机消费者版发布:键指纹直唤;生数科技正式发布Vidu S2

“ 特斯拉更新:豆包大模型语音助手扩至更多车型 ”

谷歌最强 Gemini 4 Pro开测SVG生图惊艳
谷歌正在以 'gemini-3.8-flash' 的名称在 Arena 等基准平台上测试其最强模型 Gemini 4 Pro,内部代号为 Argon。
测试版本中,Gemini 4 Pro 在生成 SVG 图片方面表现出色,尤其是对复杂结构和几何关系的理解能力令人印象深刻(以下视频中提示词是用 three.js 创建一只美丽的机械蝴蝶)。
ChatGPT正式入驻Word:免费用户也能用
OpenAI 推出 ChatGPT 官方 Word 插件,面向全球所有账号开放,包括免费用户。该插件为写作者提供了多项功能,如整理笔记、生成摘要、调整语气等,同时付费和企业用户可获得更高级的功能。
然而,插件的使用有分层限制,并且与 Codex 等工具共用额度。
Claude Opus 5.2深夜灰度上线:响应更快,还治好了“偷懒病”
Claude Opus 5.2 在灰度测试中表现出色,响应速度、输出质量以及自主迭代能力均显著提升,展现了 Anthropic 在 AI 模型优化上的强大实力。

苹果AI服务器曝光:代号Baltra、搭自研M8 Ultra
苹果计划重返服务器市场,开发企业级 AI 服务器,并与博通合作开发 AI 服务器芯片 Baltra,同时考虑采用英伟达 NVLink Fusion 技术以提升性能。

豆包手机助手消费者版发布:AI键指纹直唤,跨应用Agent再升级
9月14日,豆包手机助手消费者版在交互、记忆、Agent 执行及安全等方面全面升级,推动手机 AI 从“问答”走向“自动办事”。

千问上线Qwen3.8-Omni-Flash:30项评测平均提升超26%
阿里通义千问推出新一代全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频与视频输入及 1M 长上下文,性能在多项评测中显著提升。该模型强化了音视频处理能力,并优化了 API 价格,同时开源了相关工具以支持更复杂的工作流。

阶跃星辰发布Step5 Preview,单任务成本仅为Claude Opus5的1/8
阶跃星辰发布了新一代旗舰基座模型 Step5 Preview,重点面向 AI 编程、软件工程、专业知识工作及金融等场景,提升模型在真实世界 Agentic 任务中的综合表现。
该模型在 AA 综合智能指数中跻身全球开源模型前三,单任务成本仅为 Claude Opus5 的1/8,计划于10月中旬开源。Step5Preview 采用稀疏 MoE 架构,总参数量600B,激活参数仅27B,支持100万 Token 上下文窗口,并原生支持文本与视觉输入,在软件工程、专业工作流和金融等场景针对复杂任务进行了优化。

生数科技正式发布Vidu S2,支持实时编辑、动态参考图
生数科技正式发布 Vidu S2 视频大模型系列,涵盖 Avatar 和 Editing 两大核心模型,并探索 VR 头显空间视频生成与编辑能力,展现了强大的技术实力和应用前景。


特斯拉推送更新:豆包大模型语音助手扩至更多车型
特斯拉推出新版软件更新,引入豆包大模型语音助手并扩展至更多车型,同时对多项功能进行了优化和升级,提升了用户体验和安全性。

智界RX获批L3级自动驾驶道路测试牌照
9月16日,智界汽车宣布,智界 RX 获批 L3 级自动驾驶道路测试牌照。
华为常务董事、产品投资评审委员会主任、终端 BG 董事长余承东表示,智界 RX 目前正在公开城市快速路等复杂道路有序开展实测。
小米汽车累计路测超4000万公里
9月16日,第24届亚洲质量网组织大会上,小米创始人、董事长兼 CEO 雷军发表主题演讲,首次系统披露小米质量管理体系。
雷军介绍,截至8月31日,小米累计投入2696辆测试车,路测里程超4000万公里,覆盖高寒、高温、高原等极端环境,上市后仍持续泛化测试。

