乐于分享
好东西不私藏

AI资讯日报-第八十四期

AI资讯日报-第八十四期
点击蓝字,关注我们
今日热点摘要AI INFORMATION

腾讯发布开源混合专家模型Hy3,支付宝上线AI开放平台,微信加码AI小程序资源支持

苹果推进Siri AI跨设备交互,谷歌Gemini 3.5 Pro或将主打超长上下文与深度思考

Anthropic披露Claude内部J-space,字节与高校推进长程智能体、世界模型等研究

行业侧AI渗透率持续提升,微软裁员转向AI,GitLab称软件交付仍受测试治理掣肘

应用与生态方面,视频模型带动商业收入,Reddit强化治理,多项开源工具与框架发布

关键发布与产品迭代

Hy3 · 腾讯正式发布新一代开源混合专家模型 Hy3,总参数 295B、激活参数 21B,支持 256K 上下文,性能对标更大规模旗舰开源模型;同时提供 FP8 量化版本并开放 API 接入,进一步降低企业部署与推理成本。
支付宝AI开放平台 · 支付宝上线 AI开放平台 并启动邀测,支持商家将小程序、API 封装为 MCP 插件、Skill 或 Agent,一次接入即可分发至“阿宝”、手机、车机、AI眼镜与 IoT 终端,首批覆盖餐饮、出行、文旅等高频场景。
微信AI小程序 · 腾讯云开发加码微信 AI 小程序成长计划,向开发者免费追加最高 10亿 Token 大模型额度,AI 生图额度由 1 万张提升至 10 万张,并升级至 混元Hy3 与 Hy Image 3.0,资源包有效期 6 个月,覆盖全行业申请者。
Siri AI · 苹果在 iOS 27 / watchOS 27 测试版中继续推进 Siri AI:iPhone 端新增语速与表现力滑杆,Apple Watch 首次上线独立 Siri AI 应用并同步对话记录,显示其正把语音助手从功能入口升级为跨设备智能交互层。
Gemini 3.5 Pro · 多方爆料显示谷歌将于 7 月 17 日发布 Gemini 3.5 Pro,主打 200 万上下文窗口与“深度思考”模式,目标面向复杂智能体工作流、长时程任务与高阶编程场景,意在正面竞争最新一代高推理模型。

科研进展与技术突破

J-space · Anthropic 发布研究称,Claude 内部自发形成可被读取和干预的“J-space”工作空间,能承载未说出口的中间概念并参与推理;团队还开源 Jacobian Lens 代码,这为解释模型潜在意图、审计安全风险提供了新工具。
LingBot-Vision · 蚂蚁灵波发布并开源 LingBot-Vision,提出“空间原生”视觉预训练路线;配套的 LingBot-Depth 2.0 基于 1.5 亿数据训练,在 16 项深度补全评测中拿下 12 项第一,重点改善玻璃、镜面与细小物体的空间感知能力。
EdgeBench · 字节 Seed 发布长程智能体评测集 EdgeBench,包含 134 个真实任务、覆盖 6 大领域,单任务要求持续运行至少 12 小时,累计交互数据约 3.8 万小时;研究显示前沿模型学习速度在 2025 年 9 月至 2026 年 5 月间约每三个月翻倍。
Fast-LeWorldModel · 西交大提出 Fast-LeWorldModel,以“动作前缀并行预测”替代逐步 rollout,显著提升世界模型规划效率;在相同协议下平均成功率由 85.8% 升至 90.5%,加入自一致性后达 92.0%,动态模块耗时从 31.4 秒降至 8.0 秒。
MemGUI-Agent · 浙大与快手提出面向长程手机 GUI 任务的 MemGUI-Agent,并开源平均步数更长的数据集 MemGUI-3K。其核心是把上下文压缩、UI 事实记忆与步骤描述纳入统一动作空间,在 MemGUI-Bench 与 MobileWorld 等长任务基准上刷新 open-data 最优成绩。
Skill-Omni · openJiuwen 发布多模态 Skill 范式 Skill-Omni,可把网页截图、视频关键帧与操作脉络转成 Agent 可复用经验。系统支持从网页或 B 站视频自动生成多模态 Skill,并通过按需读取机制减少上下文负担,面向 GUI 自动化与图像编辑等视觉任务。

行业政策与资本趋势

Anthropic · TeraWulf 与 Anthropic 签署 20 年数据中心租赁协议,肯塔基项目容量上限达 401 兆瓦,预计 2027 年下半年启用、2028 年初满产,TeraWulf 由此锁定约 190 亿美元长期合约收入,显示头部模型公司仍在加码算力基础设施。
AI终端 · 国家发改委披露,国内重点行业 AI 渗透率已超过 80%,预计今年 AI 手机、AI 电脑销量将首次超过传统产品;同时全国已布局 30 多个国家级人工智能中试基地,推动央国企开放超 1000 个应用场景。
微软裁员 · 微软宣布裁员约 4800 人,占全球员工总数 2.1%,其中 Xbox 当天裁撤 1600 人;公司同时强调 AI 正在改变工作方式,并在过去一年完成超 4000 人内部转岗,反映大厂正将组织资源重新向 AI 业务集中。
GitLab · GitLab 2026 AI 问责报告指出,78% 开发者承认 AI 提升了编码速度,但 79% 认为整体软件交付并未同步加速,原因在于测试、审查与治理环节形成新瓶颈;85% 受访者认为 AI 代码的可追溯与问责机制仍明显不足。
Big Tech监管 · Cory Doctorow 发表长文呼吁美国各州检察长与国际反垄断机构联手约束 Big Tech,认为在特朗普与科技巨头绑定背景下,州级执法和跨国协作将成为抗衡平台垄断与 AI 权力集中的现实路径。

落地实践与案例复盘

Seedance 2.0 · 36氪披露,字节视频生成模型 Seedance 2.0 已成为火山 MaaS 收入核心来源,火山今年相关收入过半来自该模型;其主力客户为 AI 短剧与广告制作公司,部分客户一次性签下千万级乃至 5000 万元框架采购,验证视频模型的高单价与商业闭环能力。
Australian Payments Plus · OpenAI 分享 Australian Payments Plus 的企业落地案例:其通过 ChatGPT Enterprise 与 Codex 处理支付体系中的复杂协同工作,在保证人工判断仍处于核心环节的前提下,提升任务推进速度与交付质量,反映代码与流程协作型 AI 在金融科技场景中的现实价值。
妈祖大模型 · 国家发改委在 WAIC 相关发布中提到,气象预警大模型 妈祖(MAZU) 已在全球 40 多个国家落地应用,重点服务洪涝、台风等极端天气监测与预警,显示中国 AI 正从实验室能力走向跨国公共服务输出。
Reddit · Reddit 披露,其将大语言模型与自动化系统结合后,日均可拦截 2300 万条垃圾浏览信息与 2.5 万条新垃圾帖子/评论,垃圾接触量下降 20%,并撤销近 200 万次机器刷票,展示了“以 AI 治理 AI”的平台运营成效。

开源与工具生态

sqlite-utils 4.0 · Simon Willison 发布 sqlite-utils 4.0,首次将数据库 schema migration 正式并入主库,并新增嵌套事务 db.atomic()、复合外键支持等关键能力;其还借助 Claude Fable 5 等模型排查出 4 个发布阻断问题和 10 个额外缺陷,体现 AI 辅助开发在工具质量提升上的价值。
Avernet · 蚂蚁集团 inclusionAI 开源多智能体协作基础设施 Avernet v0.1,聚焦 Agent 的注册、发现、邀请、共识和可追踪执行,兼容 OpenClaw 与第三方 Agent 引擎,并提供 Docker 与本地部署路径,补齐多智能体“协作层”短板。
OfficeCLI · 开源工具 OfficeCLI 提供面向 AI 智能体的 Office 文档操作能力,可将 docx、xlsx、pptx 实时渲染为 HTML/PNG,让智能体通过“渲染—观察—修正”的闭环处理文档,支持接入 Claude Code、Cursor、Windsurf 等开发环境。
LongCat-2.0 · 美团宣布开源基础大模型 LongCat-2.0,并强调其在五万卡国产算力集群上完成训练与推理,是首个依托国产芯片完成全流程训练推理的基础模型;模型权重、推理引擎与技术文档同步上线,采用 MIT 协议开放商用。
n8n Agent工具链 · n8n 连续发布三篇面向生产环境的指南,覆盖 AI Agent Memory、Context Engineering 与 AI Security Monitoring,强调通过可视化工作流统一管理记忆、上下文与安全告警,把 AI 应用从 demo 推向可审计、可观测的工程化部署。
github-code · Simon Willison 展示实验性 github-code Web Component,该组件由 GPT-5.5 辅助生成,可将 GitHub 某段代码链接直接嵌入网页并按行号提取显示,虽无语法高亮,但为文档化代码片段和开发者内容发布提供了轻量新方案。

社媒观点与社区动向

Claude Sonnet 5 · Claude Sonnet 5 上线后在社区遭遇集中吐槽,用户批评其频繁反驳、道德说教、上下文泄露与任务分发质量下降,反映前沿模型在“更强能力”之外,交互风格、稳定性与安全策略同样会直接影响口碑与生产效率。
AI泡沫争论 · 长文《Let AI Burn》猛烈抨击生成式 AI 行业依赖资本补贴、循环融资与基础设施狂热,质疑 OpenAI、Anthropic 及超大规模数据中心的商业可持续性,并反对任何形式的产业纾困,折射出社区对 AI 泡沫和财政风险的激烈分歧。
weread-skill · 即刻用户分享 weread-skill 使用体验:把已读与待读书目全部放入微信读书书架,再交由 Agent 进行筛选、回顾与比较,折射出“个人知识管理”正从人工整理转向由智能体辅助阅读与决策的新范式。
预测与理解 · 社区观点认为,LLM 的核心能力并非简单复述,而是通过持续预测下一个 token 抓住结构;对应到人类学习,真正的理解不是解释过去,而是能判断什么会变、什么不会变,这为理解 AI 与人的认知差异提供了简洁视角。
AI成熟期 · 有创作者提出,当 AI 真正进入成熟期时,人们将不再刻意提“AI”本身,而会像水电一样把它视为基础设施;这类讨论说明社区对“AI 从炫技到日用”的产业拐点已形成越来越清晰的判断。

免责声明:本平台旨在传递与分享更多科技创新政策及科研资讯,部分资料来源于网络,仅提供交流平台,不为其版权负责。如涉及侵权或其他问题,请联系我们及时修改或删除。