💡 AI HOT 精选日报 · 2026-05-17 · 共 20 条
模型发布/更新
1.社区协作再创佳绩,vLLM支持万亿级模型 — X:蚂蚁百灵 (@AntLingAGI)
vLLM 项目团队又一次展示了 Day0 协作能力,这次成功支持了万亿级参数模型的推理。社区协作的效率已经在多个项目中得到验证。
2.SANA-WM:一个用于生成1分钟720p视频的26亿级开源世界模型 — Hacker News 热门(buzzing.cc 中文翻译)
NVIDIA 开源了 SANA-WM,一个 26 亿参数的世界模型,能生成长达 1 分钟、720p 分辨率的视频。代码和权重已在 GitHub 发布,目标是降低高质量长视频生成的研究门槛。Hacker News 上收获 107 点赞。
3.Ring-2.6-1T开源并上线OpenRouter,专为智能体工作流设计 — X:蚂蚁百灵 (@AntLingAGI)
蚂蚁百灵的 Ring-2.6-1T 万亿参数推理模型正式开源,同步上线 OpenRouter 平台,5 月底前调用可享 75% 折扣。模型定位不是聊天问答,而是执行实际任务——规划步骤、调用工具、维持多轮上下文、完成复杂工作流。背后用了 Async RL 和 IcePop 训练方法。
产品发布/更新
4.Codex新增键盘快捷键自定义功能 — X:Tibo (@thsottiaux)
Codex 在周末推送了一波更新。键盘快捷键现在支持自定义,可以根据自己的操作习惯重新绑定。在设置里调整就行,不用硬记默认键位。
5.Notion推出开发者平台及CLI工具 — X:Oran Ge (@oran_ge)
Notion 正式推出开发者平台。配套发布了 CLI 终端工具、Workers 计算服务、数据库同步能力和一系列 Agent API。开发者可以在 Notion 基础设施上直接跑代码、接外部数据、搭自动化工作流。未来非技术人员也能通过 AI Agent 在 Notion 上搭建应用。
6.按需定制快捷键,优化工作流效率 — X:OpenAI Developers (@OpenAIDevs)
OpenAI Developers 账号回应社区反馈,Codex 键盘快捷键已支持自定义。可以按照自己的习惯重新绑定,不用迁就默认布局。
行业动态
7.美国开始出现人工智能相关岗位的大规模裁员 — Hacker News 热门(buzzing.cc 中文翻译)
彭博社报道,美国 AI 相关岗位正在经历一轮大规模裁员。AI 技术对就业市场的冲击从理论预测进入了实际发生阶段,具体数字和涉及的行业范围还在持续扩大。
8.研究人员利用Anthropic Mythos工具构建macOS内核漏洞,绕过苹果M5芯片内存完整性执行安全系统 — X:Kim (@kimmonismus)
三名安全研究员用 Anthropic 的 Mythos 工具做出了一个 macOS 内核漏洞利用程序,能绕过苹果 M5 芯片的 MIE(内存完整性执行)安全机制。MIE 是苹果花了五年、投入巨资为 M5 和 A19 芯片打造的核心安全防线,目标是根除内存损坏类漏洞。团队 4 月 25 日发现漏洞,5 月 1 日就完成利用开发,随后飞到苹果园区当面提交。攻击不走指针操作,纯数据方式,从非特权用户的系统调用就能拿到根权限。技术报告等苹果出补丁后再公开。
9.突发!OpenAI 大规模重组,总裁 Brockman 夺权挂帅 — IT之家(RSS)
OpenAI 宣布了公司史上最大规模的组织调整:ChatGPT、Codex 和 API 三条产品线合并成一个统一组织。联合创始人 Greg Brockman 正式接手产品全局,成为实际掌权者。ChatGPT 原负责人 Nick Turley 被调离核心岗位。调整目标是把资源集中起来,押注"智能体时代"。内部还在秘密开发一款集成多项功能的"超级应用"桌面产品。另一边,Anthropic 估值已飙到 9000 亿美元,OpenAI 压力不小。
10.杭州基地启用,机器人有了国家级职业技能训练场 — IT之家(RSS)
国家人工智能应用中试基地(具身智能方向)5 月 16 日在杭州正式挂牌,相当于给机器人建了一个国家级训练场。基地集合了场景体验、技术展示、研发合作和产业赋能功能,帮具身智能技术从实验室走向实际应用。杭州 5 月 1 日起施行了国内首部具身智能机器人地方法规,在研发、平台建设和场景开放上提供政策支持。目前杭州已集聚机器人相关企业 700 多家,2025 年具身智能集群产值达到 1068 亿元。
11.OpenAI 与马耳他合作,向所有公民提供 ChatGPT Plus — OpenAI:官网动态(RSS · 排除企业/客户案例)
OpenAI 跟马耳他政府达成合作:向该国所有公民免费提供 ChatGPT Plus。这是第一次有国家给全民发 ChatGPT Plus 订阅。合作还配套了 AI 技能培训,帮民众学习负责任地使用 AI。预计这会明显拉升马耳他的 AI 普及水平。
论文研究
12.智能体驱动系统Articraft实现3D资产生成自动化,开源万件数据集降低门槛 — X:Berry Xia (@berryxia)
剑桥大学团队推出了 Articraft,一个由 AI 智能体驱动的 3D 资产自动生成系统。它能全自动产出带关节、可运动的交互式 3D 模型——AI 智能体自己写代码、执行、根据物理反馈迭代优化,原来要几周的工作量被大幅压缩。团队还开源了 Articraft-10K 数据集,包含 1 万多个物体,覆盖 250 个类别,全部仿真就绪。对机器人和物理 AI 领域来说,高质量 3D 资产的数据门槛被拉低了不少。
技巧与观点
13.藏师傅PPT Skills更新,AI自动美化截图 — X:歸藏 (@op7418)
藏师傅的 PPT Skills 产品更新了新增截图美化能力。不消耗 GPT-Image 2.0 额度,根据截图的尺寸、长宽比和当前 PPT 模板配色,自动配背景图实现美化,功能上对标 CleanShot X。遇到长截图等特殊尺寸,AI 会自动裁剪并排成两列展示。
14.MagicPath与Codex深度整合,设计开发流程合二为一 — X:Berry Xia (@berryxia)
MagicPath AI 的 CEO 演示了产品与 Codex 的深度整合。MagicPath 可作为原生画布直接在 Codex 里运行,拖拽设计 UI 后 Codex 能实时感知项目并自动生成代码,省去了在 Figma 和 IDE 之间来回切换。安装就一条命令的事。设计-开发-迭代的闭环被压缩到了单个窗口里。
15.Codex实现多设备远程控制与上下文共享 — X:歸藏 (@op7418)
Codex 不光能通过 ChatGPT 连手机,还能远程控制另一台电脑。在 ChatGPT 界面直接管理多台设备,切换项目就能访问不同机器的上下文和文件。另外还支持通过 SSH 连远程 VM,多设备协作的灵活性不错。
16.Show HN: 烧吧,宝贝,烧吧(那些代币) — Hacker News 热门(buzzing.cc 中文翻译)
开发者发布了一个叫"Burn, Baby, Burn"的开源工具,功能直接:销毁代币。用户主动减少代币总供应量,理论上能提升剩余代币的稀缺性。项目在 GitHub 上开源,Hacker News 热度 100 点。
17.Anthropic《Founder's Playbook》:AI提高创业失败率的警示 — X:Berry Xia (@berryxia)
Anthropic 出了一份叫《Founder's Playbook》的内部手册,结论有点反直觉:AI 会提高创业失败率,不是降低。AI 能快速生成原型,容易让创始人把"能跑起来"当成"有市场需求",加上确认偏误和研究引擎进一步强化错误方向。手册把创业分成 Idea、MVP、Launch、Scale 四个阶段,分析了每个阶段 AI 放大的风险——原型不等于验证、Agentic 技术债、创始人变成决策瓶颈。最终判断:AI 把执行成本打下来之后,判断力成了最稀缺的资源。真正的护城河是把垂直领域知识沉淀成专属 Skills。
18.工具使用代理认知与行动脱节机制研究 — X:Elvis Saravia (@omarsar0, DAIR.AI)
DAIR.AI 的 Elvis Saravia 分享了一篇可解释性论文,研究工具使用代理的"知道但做不到"问题。通过探测隐藏状态发现,模型经常能识别出该调用工具了,实际调用却失败,认知-行动不匹配率在 26% 到 54% 之间。问题卡在认知到行动的过渡阶段,认知本身没问题。内部探测方向可以解码,但最后层的 token 机制让信号旋转,和实际产生的行动几乎正交。常见的归因(提示不到位、训练不充分)可能忽略了后期层的几何结构,这也解释了为什么工具使用提示的 A/B 测试经常碰到性能天花板。
19.Eric Jang分享从零构建AlphaGo的经历与见解 — X:Marc Andreessen (@pmarca, a16z)
Eric Jang 花了几个月从零复现了 AlphaGo——就是 2016 年推动他进入深度学习领域的那个 AI 突破。他最初的认知是"自我对弈训练的搜索增强神经网络",真正动手做之后理解深了不少。他的体会是:前沿深度学习研究虽然烧钱,但特定能力的实现成本降得很快。2026 年训练一个强大的围棋 AI 只需要几千美元租算力,不需要 DeepMind 那种级别的资源。他把过程录成了播客,公开了教程和代码,还谦虚地说自己只是围棋和 AlphaGo 的学徒。
20.最新开源成果(#21):开源模型盛宴!Gemma 4、DeepSeek V4、Kimi K2.6、MiMo 2.5、GLM-5.1 等。基于CAISI的V4评估。 — Nathan Lambert:Interconnects(RSS)
本月开源 AI 模型发布密度很高:Gemma 4、DeepSeek V4、Kimi K2.6、MiMo 2.5、GLM-5.1 扎堆上新。这些模型都在 CAISI V4 评估框架下跑了成绩。多家团队几乎同时推出旗舰级更新,开源社区迭代速度确实猛。
📬 每日 AI 资讯精选 · 数据来源 [AI HOT](https://aihot.virxact.com)
夜雨聆风