OpenAI 大规模异常封号 / Claude 化学分析媲美专业软件 / 通义 Qwen-VLA 进军机器人 / 字节 Octo
AI DAILY NEWS
AI 日报
2026-06-06 · 8 条资讯
产品
OpenAI 系统故障导致部分用户账号被错误封禁
OpenAI 披露一起系统故障事件,部分用户账号因技术问题被错误封禁。该公司在官方账号中表示正在恢复受影响用户的访问权限,同时处理由此引发的订阅和积分补偿问题。事件在社交媒体上引发广泛关注和讨论。此次事件暴露了大规模 AI 平台在账号管理系统上的脆弱性,也提醒用户在依赖单一平台时需关注数据备份和账号安全。
研究
Anthropic 发布 Claude 化学能力评测:Opus 4.7 在 NMR 光谱分析上媲美专业软件
Anthropic 发布新科学博客,展示 Claude 在化学领域的突破能力。核磁共振光谱分析是化学家理解分子结构的核心工具,需要复杂的信号解析和结构推断。测试显示,Claude Opus 4.7 在 NMR 光谱分析任务上达到甚至超越专业 NMR 软件的性能。这一结果表明大语言模型正在从文本处理向科学推理纵深发展,有望加速药物研发和材料科学中的分子分析流程。
模型发布
阿里通义发布 Qwen-VLA:视觉-语言-动作统一模型进军机器人领域
阿里通义实验室发布 Qwen-VLA,这是一个统一的视觉-语言-动作模型,将机器人操作、导航和轨迹预测三大能力整合到单一架构中。该模型打破了传统机器人系统中感知、规划和控制分离的技术范式,使机器人能够通过统一的神经网络完成从视觉理解到物理动作的全流程。同日发布的还有多模态模型 Qwen3.7-Plus。Qwen-VLA 标志着中国 AI 实验室在具身智能领域的前沿布局。
政策
OpenAI 表态将遵守美国行政令:AI 模型发布前须完成内部审查
OpenAI 宣布将遵守美国行政令关于 AI 模型发布前审查的要求,在公开部署前完成内部审查流程。OpenAI 全球负责人 George Osborne 对 CNBC 表示,作为拥有前沿强大 AI 模型的领先实验室,OpenAI 并非被动等待指令,而是主动提出了审查方案。这一举措意味着新模型的发布节奏可能放缓,以换取更强的安全监管。此事反映了 AI 行业正在从自由放任转向接受更系统的政府监管框架。
研究
新基准 Agents’ Last Exam 发布:超千项经济任务测试 AI Agent 真实工作能力
全新 AI Agent 基准测试 Agents’ Last Exam 正式发布,由 250 多名行业专家参与构建,包含超过 1000 项具有经济价值的真实任务。该基准映射到美国联邦职业分类体系,覆盖多种行业和岗位场景。测试结果显示,最难层级在主流 AI 框架上的平均通过率仅为 2.6%,表明当前 AI Agent 在处理真实世界复杂工作任务方面仍有巨大提升空间。这一基准为衡量 Agent 实用能力提供了标准化参照。
产品
字节跳动发布 Dreamina Octo:AI Agent 驱动的视频创作工作流
字节跳动发布 Dreamina Octo 用户手册,这是与视频生成模型 Seedance 2.0 配合使用的 AI Agent。Dreamina Octo 采用「Vibe Create」交互范式,用户通过自然语言描述创意需求,AI Agent 自主完成从构思到视频生成的完整工作流。该产品标志着 AI 视频创作从单次生成工具向智能创作助手的演进。
产品
NVIDIA Nemotron 3 Ultra 上线 Perplexity:5500 亿参数开源模型面向 Pro 用户开放
Perplexity 宣布 NVIDIA 最新开源模型 Nemotron 3 Ultra 已面向所有 Pro 和 Max 用户开放。该模型采用 MoE 架构,参数规模达 5500 亿,专为长时间规划和工具使用的 Agent 任务优化,推理速度提升最高 5 倍,成本降低约 30%。此前该模型被评为美国最智能的开源权重模型,快速部署表明前沿开源模型正加速进入商业化应用。
产品
Google 发布本周 AI 更新:Nano Banana 2 正式上线,多智能体科研系统 Co-Scientist 亮相
Google 发布本周 AI 更新。Nano Banana 2 和 Nano Banana Pro 正式上线,用户可通过 Gemini API 和 Google AI Studio 访问。同时亮相的 Co-Scientist 是面向结构化科学研究的多智能体系统,能自主生成和优化科学假设。从基础模型到科学应用的全栈布局显示出 Google AI 战略的持续深化。
MintPick AI精选 · 每日为你精选 AI 领域重要资讯
夜雨聆风