乐于分享
好东西不私藏

AI资讯日报-第八十五期

AI资讯日报-第八十五期
点击蓝字,关注我们
今日热点摘要AI INFORMATION

OpenAI推GPT Live升级实时语音交互,Anthropic扩展Cowork至多端办公

Meta上线Muse Image入驻社交平台,支付宝“碰一下”升级线下Agent入口

腾讯开源Hy3,MoWorld实现国产NPU实时推理,灵波与视觉模型持续开源

美国放行GPT-5.6公开发布,中国模型海外调用占比上升,Momenta港股上市

淘宝闪购AI下单一周破亿,社区转向关注Agent治理、成本控制与工程质量

关键发布与产品迭代

GPT Live · OpenAI 发布新一代实时语音模型 GPT Live,已用于 ChatGPT Voice。其全双工架构支持边听边说、自然插话,并强化同传翻译等低延迟场景,标志语音交互从“回合制”向更接近真人对话升级。
Claude Cowork · Anthropic 将 Claude Cowork 扩展到网页与移动端,支持任务跨设备接力、后台持续运行和手机审批。官方称超九成用例并非编程,而是运营与内容工作,显示 AI Agent 正加速进入通用办公场景。
Muse Image · Meta 推出超级智能实验室首个图像模型 Muse Image,已免费接入 Meta AI,并登陆 Instagram 与 WhatsApp。其支持对话生成、擦除路人、文本渲染、二维码生成及房间重设计,图像创作正进一步社交化。
支付宝碰一下 · 支付宝宣布“碰一下”完成 AI 升级,已连接 4亿用户、超 3000万线下触点,并推出“碰设备Agent”“碰万物Agent”和 AI 开放底座,试图把支付入口升级为线下商家经营网络与 Agent 交互入口。
Grok 4.5 · 社区消息显示,Grok 4.5 已接入 OpenClaw 生态,无需额外更新即可通过 X Premium 或 SuperGrok 账户调用。该模型被定位为接近 Opus 级别、适合 agentic workflow 的高性价比选项,强化了多模型编排空间。
Hy3 · 腾讯正式发布开源模型 Hy3,采用 295B MoE 架构、支持 Apache 2.0 商用协议,并在 OpenRouter 提供两周免费调用。多方评测认为其在编程、Agent 与长上下文任务上已具备对标更大参数模型的能力。

科研进展与技术突破

MoWorld · 魔芯科技与浙大团队发布 MoWorld,称其为首个 Flash World Model,并在国产 NPU 平台实现超 50FPS 实时交互推理,典型成本较同规模 GPU 方案下降 70%,推动世界模型从演示迈向实时可用。
LingBot-VLA 2.0 · 蚂蚁灵波开源 LingBot-VLA 2.0,基于约 6万小时 预训练数据,覆盖 20+ 机器人构型,并引入未来预测与空间感知增强。其在 GM-100 等基准上领先 GR00T N1.7 与 π0.5,瞄准“一脑多机”的通用具身能力。
SurgMotion · 中科院香港创新研究院联合多家机构发布手术视频基础模型 SurgMotion,参数规模达十亿级,依托千万帧级 SurgMotion-15M 数据集训练。其在 17 项手术视频理解任务上平均提升 16.5%,并已成 Hugging Face 下载量第一的手术视频基座。
Solvita · 南京大学、清华等团队提出竞赛编程 Agent 框架 Solvita,通过 Planner、Solver、Oracle、Hacker 四角色闭环与图结构知识网络,在 Codeforces 评测中将能力推至 CF rating 3500+,跻身全球前十级别。
MrFlow · 北航、南洋理工与 ETH 团队提出图像生成加速方法 MrFlow,用“低清草稿—像素超分—高清补绘”的三阶段流程,在 Qwen-Image 等模型上把端到端生成时间从 49.32 秒降至 4.77 秒,实现约 10.35 倍 提速。
LingBot-Vision · 蚂蚁旗下 Robbyant 开源 LingBot-Vision 视觉模型家族,以边界建模作为原生预训练信号,在深度估计等密集感知任务上,用 11 亿参数 超越 70 亿参数 级 DINOv3,且训练语料规模仅约后者三分之一。

行业政策与资本趋势

GPT-5.6 · 美国商务部正式放行 GPT-5.6 大规模公开发布,OpenAI 本周将同步推出 Sol、Terra、Luna。此举意味着先进模型正从临时管控转向制度化评估,也让监管与发布节奏的联动成为 AI 产业新变量。
Anthropic · Anthropic 宣布租下纽约曼哈顿一栋 16 层 办公楼,并计划将当地员工数在年内翻倍至 1000人。这一扩张显示其正把纽约打造为与旧金山并行的核心据点,加速吸纳金融、媒体与企业客户侧人才。
中国模型出海 · 行业数据显示,自 2 月以来美国企业对 DeepSeek、智谱 GLM 等中国模型的调用占比明显抬升,在 OpenRouter 上周占比常态化超 30%、峰值达 46%。高性价比正推动国产模型进入国际企业工作流。
OpenAI · OpenAI 正招聘具备投行经验的主题专家,年薪 18.5万至20.5万美元 并附带股权激励,目标是把 AI 更深嵌入估值、建模、尽调和交易执行流程。华尔街正成为大模型企业争夺的重点企业市场。
Momenta · 自动驾驶公司 Momenta 登陆港交所,发行价 295.6 港元/股,市值超 700亿港元,募资规模约 68亿港元。其以“物理AI第一股”身份上市,凸显资本市场对世界模型与自动驾驶基础设施的持续押注。
SpaceX · SpaceX 向 FCC 申请部署 10 万颗 第三代卫星星座,规模较已授权二代系统扩大近 10 倍,并申请扩展至 W、D 高频段。若获批,其卫星网络将从连接服务升级为 AI 时代的全球通信底座。

落地实践与案例复盘

Claude Cowork · Anthropic 对 Cowork 使用场景的分析显示,90%+ 会话并非写代码,而是业务运营与内容创作,其中两类任务合计约占 50%。这说明知识工作者正在把 Agent 当作持续执行型协作者,而非单次问答工具。
OpenClaw · 有企业用户分享,已在内部部署企业版 OpenClaw,供 30 名用户 使用约 40 个 Agent,月均总成本约 5 万美元。案例显示 Agent 已可自动处理客户沟通与运营任务,但错误 cron 与技能配置会迅速推高支出。
淘宝闪购 · 淘宝闪购高管透露,与通义千问联合推出的即时零售智能体上线仅 一周,AI 下单量即突破 1亿单。这一数据表明,对话式购物已从演示阶段进入高频交易场景,AI 正改写电商需求表达与履约入口。
Claude Code · Claude Code 被披露在 2.1.91 至 2.1.196 版本存在未公开检测机制,涉及时区与代理信息回传。Anthropic 已在 7 月 2 日移除相关功能,事件也触发企业侧禁用与安全审查,提醒开发工具落地需兼顾透明与合规。
Vibe Coding · 一家名为 Slopfix 的团队打出“每周收费 1 万美元 删除 AI 代码”口号,宣称曾把 10 万行 AI 生成代码压缩到 3.5 万行。争议背后折射出 AI 编程进入第二阶段:产能不是终点,可维护性与工程质量才是付费点。

开源与工具生态

sqlite-utils 4.0 · Simon Willison 发布 sqlite-utils 4.0,新增数据库迁移、嵌套事务与复合外键支持,并给出升级指南。对开发者而言,这让 SQLite 工具链从轻量数据操作进一步走向可维护应用基础设施。
Proxima v5.0.0 · 社区发布 Proxima v5.0.0,主打在本地调用网页端 ChatGPT、Claude、Gemini、Perplexity 作为自主系统 Agent,同时提供 40 个 MCP 工具,强化文件、浏览器与终端联动,瞄准低 API 成本自动化。
Rowboat · 开源桌面 AI 助手 Rowboat 以本地优先为核心,支持将邮件、会议记录、协作内容索引为知识图谱,并集成浏览器、邮件、会议记录和代码模式。其纯 Markdown 本地存储模式,瞄准隐私敏感与长期记忆场景。
Proactivity Plugin · Refix 团队开源 proactivity-openclaw 插件,为 OpenClaw 增加目标跟踪、行动日志、节奏调整和发送护栏能力。它让 Agent 不再只会“被唤醒”,而能围绕未完成目标持续推进,适合长链路任务自动化。
Voice Call Plugin · 开发者开源 openclaw-voice-call-realtime,让 OpenClaw 具备打电话、语音留言、电话树处理、通话内工具调用及摘要回传能力,并明确反对 SaaS 化收费外包。它补齐了 Agent 跨语音渠道执行的关键一环。
GPU Price Finder · 有开发者发布命令行工具 gpu-price-finder,可实时比价 H100、A100、L40S、4090、5090 等 GPU 容量,并按区域、等级和最高预算过滤。对训练与推理团队而言,这类基础设施价格透明工具能直接影响成本决策。

社媒观点与社区动向

Kenton Varda · Cloudflare 创始人之一 Kenton Varda 表示,已在团队内部暂停使用 AI 自动撰写 PR、commit 和 issue 描述,因为这些文本常堆砌代码细节,却遗漏帮助审阅者理解设计意图的高层框架。
AI 编程质量 · 围绕 YC 负责人日更 3.7 万行代码 的说法,开发者社区给出反例:其个人站点被指触发 169 次请求、加载 6.42MB 资源,对比 Hacker News 首页仅 7 次请求、12KB。讨论焦点已从“写得快”转向“写得稳”。
Steam 玩家 · 一项面向 3800 名 Steam 玩家的调查显示,43% 受访者可接受游戏开发使用 AI,仅 8.1% 表示绝不会玩含 AI 的游戏;同时近 九成 用户会查看商店页的 AI 披露信息,说明透明度比一刀切立场更关键。
AI 推理成本 · 一篇行业分析提出,API 与自建推理的盈亏关键不是口号,而是 GPU 利用率;其模型给出临界点约为 52%,低于这一水平自建反而更贵。对 CTO 而言,这类测算正在重塑“该不该自建”的成本认知。
OpenClaw 社区 · OpenClaw 社区近期讨论从“怎么接模型”转向“怎么治理 Agent”:包括成本可视化、审计插件、目标持续跟踪、浏览器代理场景与企业部署经验。社区热度证明,开源 Agent 平台正从爱好者实验逐步走向生产环境。

免责声明:本平台旨在传递与分享更多科技创新政策及科研资讯,部分资料来源于网络,仅提供交流平台,不为其版权负责。如涉及侵权或其他问题,请联系我们及时修改或删除。