夜雨聆风学习资料网

ARTICLE · 1153431

AI热点及产品速报 · 10-10

AI热点及产品速报 · 10-10

热点及相关数据采集时间为2026-10-09

Product Hunt 日榜(美西时区 2026-10-09)· 北京时间 2026-10-10 上午抓取

分数与位次取自 PH 日榜页快照,10 款严格单调递减(273→88),与位次自洽。hunted.space 当日全量页只返回约 35KB 的 JS 空壳(0 个产品链接),本期无法交叉校验。

本期共 10 款编号产品,全部带名次,无无编号推广位混入;官网 10/10 确认。界面图为各产品官网(或官方公告页)首页 1440×900 实拍(PH 官方图床图库直链当日取不到)。

一、今日 AI 热点(12 条)

1OpenAI GPT-6 全量上线:取代 GPT-5.6 Sol 与 Luna,集成 Astra 安全技术

北京时间 10 月 9 日,OpenAI 正式向全球 ChatGPT 用户全面上线 GPT-6,取代此前的 GPT-5.6 Sol 与 GPT-5.6 Luna,免费及付费用户均可使用。新模型集成了 Astra 安全技术,重点强化对网络攻击、生物风险、暴力内容等滥用场景的防护,并提升抵御越狱攻击的能力。同期上线的还有 Intelligent UI:ChatGPT 的回答不再只有文字,而是图表、图片与可点按钮组成的视觉工作区。评论认为,这次更新把行业竞争从"谁的模型更强"推进到"谁能更安全、更稳定、更商业化地服务全球用户"。

来源:新浪科技(2026-10-09)、University 365 AI News(2026-10-09)

2OpenAI 年化营收口径修正为约 500 亿美元,比此前少 200 亿,IPO 推迟至 2027 年

《金融时报》10 月 8 日援引向投资者披露的财务文件报道,OpenAI 截至 9 月底的年化营收接近 500 亿美元,比 8 月至 9 月间流传的 680 亿至 700 亿美元少约 200 亿。差异来自统计口径:Anthropic 按云合作伙伴收取的全额计入营收、把平台分成记为成本,而 OpenAI 只计自身份额;此前的高口径是投资者为对标 Anthropic 做的"总额化"换算。OpenAI 同时强调三季度总营收运行率增长 77%、企业业务增长 107%。消息落地后周四纳指收跌 1.4%,英伟达跌约 3%、甲骨文跌约 5.5%、CoreWeave 跌 8%。公司已于 6 月秘密提交 IPO 申请,高管口径把上市时点推迟到 2027 年,当前估值约 8520 亿美元面临重估。

来源:Financial Times(2026-10-08)、Reuters、CNBC、Axios、新浪财经(2026-10-09)

3谷歌云发布通用 Gemini 工作智能体:给目标而不是指令,可在云端连跑数天

10 月 8 日,Google Cloud CEO Thomas Kurian 在 Gemini at Work 2026 上发布 Gemini 智能体:一个同时覆盖问答、知识工作、图像与媒体生成、代码编写与运行的通用工作 agent,收在同一个提示框里。它的设计前提是你给"目标"而不是"指令"——它自己规划、选用公司技能与工具、连接 Workspace、Microsoft 365、Slack、Jira、Salesforce、BigQuery、Snowflake 或任意 MCP server,把成品交回你的文档、收件箱或开发环境。执行发生在云端,因此关掉电脑后任务仍可继续数小时乃至数天;可派生带自己 @agents 邮箱、日历与 Drive 空间的"同事 agent",每个 agent 有独立身份、审计轨迹、沙箱与按项目的实时支出上限。底层多模型,除 Gemini 外已可调用 Anthropic 的 Claude 并做智能路由控成本。金融与法律行业版处于预览。官方博客同时披露:过去一年近 500 家 Google Cloud 客户各自处理超过 1 万亿 token,近 80% 客户在用其 AI 产品。VentureBeat 引述谷歌云发言人确认,目前为面向部分客户的私有预览。

来源:Google Cloud 官方博客(2026-10-08)、VentureBeat、大河财立方、blog.google(2026-10-08/09)

4OpenAI 发布 GPT-6.1 Sol Ultrafast:速度最高提升 8 倍,价格是标准版 6 倍

OpenAI 在 API、Codex 与 ChatGPT Work 三个平台同步推出 GPT-6.1 Sol Ultrafast 版本,官方口径为运行速度最高提升 8 倍。定价为标准版的 6 倍——输入每百万 token 12 美元、输出每百万 token 60 美元,并支持美国与欧盟的数据驻留合规,适用于 Pro500 用户、企业版与教育版方案。把"快"单独拆成一档高价 SKU,是这一轮模型定价里比较新的写法。

来源:AIbase、腾讯新闻(2026-10-09)

5Anthropic 启动 Cyber Mission:关键基础设施防御计划 + 免费开源安全扫描

10 月 8 日,Anthropic 宣布长期网络安全计划 Anthropic Cyber Mission,从两条线起步。第一条是关键基础设施:Critical Infrastructure Defense Program(CIDP)把前沿模型、驻场工程师与威胁研究送到守护电网、水系统、交通网络与政府系统的一线,创始伙伴包括埃森哲、博思艾伦、CrowdStrike、德勤、Dragos、日立、Insane Cyber、Nozomi Networks、Palo Alto Networks、普华永道与罗克韦尔自动化。第二条是开源软件:OSS Scanner 为开源项目免费提供由 Anthropic 最强模型执行的定期安全扫描,采用 opt-in。Anthropic 同时坦率评估了早前的 Project Glasswing——合作方确实挖出大量漏洞,但尚未把网络风险降到足够低,因为"发现漏洞从未像今天这样容易,而验证、排序和修复依然困难";该项目已并入扩展后的 Cyber Verification Program。

来源:Anthropic 官方公告(2026-10-08)、The Verge、金色财经(2026-10-09)

6Anthropic 三年投入 1.5 亿美元给联邦 Genesis Mission,向 15 家以上机构开放 Claude

Anthropic 承诺在三年内向联邦 Genesis Mission 投入 1.5 亿美元,让 Claude 覆盖包括 NASA、NIH、NSF 在内的 15 家以上联邦机构,并把 Project Glasswing 之外的能力延伸到聚变能源、量子计算等优先方向。该承诺在白宫科技政策办公室的峰会现场宣布,Anthropic 将为数百个 Genesis Mission 研究项目提供 Claude、Claude Code 与 API 额度,并为刚接入的机构提供培训与支持。同期 Claude Haiku 5.5 成为 API 默认 Haiku 模型、上下文 1M;Claude Code 新增 onFailure: "block" 选项,让失败的 hook 直接阻断动作。

来源:白宫 OSTP「Science: A New Golden Age」峰会、Anthropic 官方(2026-10-08)、观点网(2026-10-09)

7Anthropic 新版使用政策 11 月 12 日生效:禁止对 Claude 的持续虐待,并收紧自主物理动作

这是自 2024 年基线以来的首次大改,11 月 12 日生效。最受关注的一条是禁止对 Claude 进行"持续且不必要的虐待或残忍行为";Anthropic 说明终止对话仍是主要执行机制,对是否会封禁用户未予置评,并强调只适用于用户毫无明显目的地反复施暴的极端情况,不适用于常见的不满、反驳、黑暗创意主题以及模型测试与研究。政策同时新增整合后的"欺骗性活动与虚假行为"条款、取消对个性化政治定向的一刀切禁令(保留禁止欺骗、压制投票与滥用个人数据),并对可能造成伤害的自主物理硬件提出新要求:必须有合格人员观察与干预、Claude 断开时进入安全状态。

来源:Anthropic 官方、The Verge(2026-10-09)、AI Law Wiki(2026-10-08)

8微软把 Windows 重做成"混合智能之家":MXC 正式商用,1370 亿参数模型跑进本地

10 月 7 日微软在旧金山的 Windows 与 Surface 活动上宣布:Windows 成为"混合智能之家",agent 按需在本地运行、需要更强能力时调用云端。核心是 Microsoft Execution Containers(MXC)在 Windows 11 上正式商用——组织定义 agent 能碰哪些文件与网络,由执行环境在运行时强制,而不是由模型自己决定;隔离级别从轻量进程容器到独立 Windows 会话、WSL 容器乃至 MicroVM。每个 agent 有独立于用户的身份(本地或 Entra),因此封掉一个 agent 不必连带吊销人的权限。OpenAI Codex、GitHub Copilot、OpenClaw、Replit、LM Studio、NVIDIA OpenShell、Unsloth 已支持,Claude Code、Perplexity、Manus 等在接入。本地侧,MAI Code 1.1 Flash(1370 亿总参 / 68 亿激活)以约 3bit 量化压到 53GB、256K 上下文;Surface Laptop Ultra 搭载 RTX Spark,最高 128GB 统一内存、约 1 PFLOPS,可本地跑 1200 亿参数以上模型。

来源:Windows Experience Blog(2026-10-07)、VentureBeat、Technology Magazine、IT-Connect(2026-10-07/08)

9Mistral Large 4("Le Chonk")开放权重:1 万亿参数,主打网络安全,权重 10 月 27 日放出

Mistral 发布迄今最大模型 Mistral Large 4,内部代号"Le Chonk":1 万亿总参数的原生多模态 MoE,每 token 激活约 49B,支持 100 万 token 上下文,覆盖 160 多种语言(含全部欧盟官方语言)。训练从零开始,用约 3800–4000 张 NVIDIA Grace Blackwell 在欧洲自有数据中心跑了约两个月。定价 API 预览为每百万 token 输入 1.36 美元、输出 4.18 美元。Mistral 重点强调网络安全:Artificial Analysis Cyber Index 全球前五,复现并修补真实开源漏洞的测试得 82%,Cybench 40 道夺旗题解出 93%。开放权重定于 10 月 27 日发布,中间三周用于与网络安全公司、审查过的伙伴及政府机构一起对限制更少的变体做红队。需要注意的是,上述基准均为厂商自报,独立评测尚未落地;另有与 Surge AI 合作的盲评显示其代码质量 3.74 分,低于 Claude Opus 5 的 4.22 分。

来源:Mistral 官方、Reuters / AFP、The Next Web、VKTR(2026-10-06 至 10-08)

10USA Today 起诉 OpenAI:19 家报纸索赔超 2.5 亿美元,并要求销毁相关模型

10 月 8 日,USA Today Co.(原 Gannett)及其旗下 19 家报纸与新闻网站在纽约南区联邦法院起诉 OpenAI(案号 1:26-cv-08892),指控其未经许可复制数十万篇文章用于训练,并在模型输出中复现其报道、移除版权管理信息。诉状要求超过 2.5 亿美元赔偿、禁令,以及销毁包含其内容的模型与训练数据集——这是《纽约时报》2023 年就提出过、但从未实现的救济方式。诉状援引《华盛顿邮报》的分析称,原告域名在 C4 数据集中占超过 1.22 亿 token,另有 16 万条以上出现在 OpenAI 自建的 WebText 中。代理律师 Steven Lieberman 同时代表 Daily News Plaintiffs,该群体参与的合并诉讼已于 9 月进入即决判决阶段。

来源:Reuters、The Verge(2026-10-08)、Digital Watch Observatory

11国内:豆包 App 上线生活缴费、豆包工作推无限画布;智谱 GLM-5 系列路线曝光

字节跳动旗下豆包 App 新增"生活缴费"功能,用户直接输入或语音说出"交水费""交电费"即可弹出服务卡片完成缴费,据《读佳》报道其正在搭建覆盖出行、缴费的民生办事能力矩阵。豆包工作同步上新,把图片、视频与 HTML 自动汇入同一块无限画布,并在模型列表中提供可自主调整推理强度的豆包 2.1 Lite。另一条来自行业披露、尚未获官方确认:智谱 AI 新一代旗舰 GLM-5.4 与 GLM-5.5 参数量达万亿级别,采用两条并行技术路线研发。

来源:AIbase / 腾讯新闻(2026-10-09)、《读佳》、AITOP100(2026-10-09)

12苹果官宣 10 月 13 日「Welcome home」发布会:首款带屏家庭中枢有望登场

苹果全球营销高级副总裁 Greg Joswiak 于美东时间 10 月 8 日在 X 发布预热视频,确认将于 10 月 13 日美东上午 9 点(北京时间 13 日 21 点)在纽约举办主题为「Welcome home」的特别活动,这是 John Ternus 出任 CEO 后苹果在智能家居线的首次重要动作。外界预计发布三款产品:全新带屏家庭中枢(暂称 HomePad,约 6 英寸方形屏、桌面与壁挂两种形态、运行 homeOS、靠摄像头与存在传感器识别家庭成员并推送个性化内容,预估 350 美元)、第二代 HomePod mini(N1 网络芯片、Wi-Fi 7 / 蓝牙 6 / Thread)与新 Apple TV 4K(A19 系列芯片、内存加大)。需说明的是,上述硬件规格与价格目前来自 Mark Gurman 等爆料与系统代码线索,苹果官方尚未确认;另有消息称 10 月 27 日前后还有一场面向 iPad mini、MacBook Pro 与 iMac 的活动。

来源:财联社(2026-10-09)、36 氪、环球网科技 / MacRumors(2026-10-09)

二、Product Hunt 日榜完整榜单(采集时间 2026-10-09,10 款)

B1 · Zernio

面向产品与 agent 的营销基础设施

273 分 · zernio.com

F2 · Busabase

给 AI agent 用的通用记录系统

242 分 · busabase.com

C3 · Playground by Google Labs

用 Google AI 创建、游玩并分享你自己的游戏

167 分 · labs.google

A4 · Together Link

在你自己的 harness 里用开源模型

154 分 · together.ai/link

E5 · Odyssey 3

实时模拟物理的世界模型

139 分 · odyssey.systems/meet-odyssey-3

A6 · Gemini Agent for Google Cloud

同时跑在 Gemini 与 Claude 上的工作 agent

126 分 · cloud.google.com/blog/products/ai-machine-learning/welcome-to-gemini-at-work-2026

B7 · Staffcoder

像真正的工程师那样练

99 分 · staffcoder.com

C8 · Refs

给你的视频更好的参考片

96 分 · refs.video

B9 · AgentSDR

开源 AI SDR

88 分 · agentsdr.ai

A10 · OpenPilot

开源桌面 AI agent,模型随便你选

88 分 · openpilot.in

三、六大品类拆解(各品类 Top2–3)

A · AI 模型与 Agent

Together Link #4 · 154 分

A · AI 模型与 Agent

在你自己的 harness 里用开源模型

一条命令把编码 agent 接到 Together AI 上的开源模型。它的核心主张是"什么都不用换":你保留现有的 agent、登录态、设置、历史与工作流,Together Link 只负责把会话路由到开源模型,并告诉你这一趟花了多少钱。工具本身免费开源,模型用量按 Together AI 的按 token 计价结算。

功能与亮点

· 支持 Claude Code、Claude Desktop、Codex、ChatGPT Desktop、OpenCode、Pi

· 可选单个开源模型,也可用 Auto Router 自动路由任务

· 可访问 Kimi K3、GLM 5.3、DeepSeek V4.1 Flash、MiniMax M3 等模型

· 每次被代理的会话都给一张「花费收据」,可跨会话追踪用量与支出

· 一条命令安装,无需手改 agent 配置;随时可切回原设置

· 工具免费开源,只有模型使用按 Together AI 计价

官网:together.ai/link

Gemini Agent for Google Cloud #6 · 126 分

A · AI 模型与 Agent

同时跑在 Gemini 与 Claude 上的工作 agent

谷歌云的单一通用工作 agent:你给的是目标而不是指令——它自己规划、调用公司的技能与工具、连接 Workspace、Microsoft 365、Slack、Salesforce、Jira 或任意 MCP server,然后把做好的文档、演示稿或代码交回来。与"答完就停"的聊天助手不同,它在云端持续运行数小时乃至数天,能派生出带自己邮箱与日历的"同事 agent",并按硬性的支出上限把每个任务路由到合适的模型。

功能与亮点

· 单个提示框覆盖问答、知识工作、图像与媒体、写代码与跑代码

· 同事 agent 拥有自己的 @agents 邮箱、日历、Drive 与目录身份,只看得到你共享给它的内容

· 云端常驻:长任务跨设备跨会话连续执行,一份记忆贯穿网页、移动端、桌面与命令行

· 底层多模型:Gemini 加 Anthropic 的 Claude,配合智能路由控成本

· 每个 agent 有独立身份、审计轨迹与沙箱,并按项目设实时支出上限

· 内嵌在 Gmail、Docs、Sheets、Slides、Chat 与 Calendar 中工作,并主动建议可交办的任务

· 金融服务与法律行业版处于预览;VentureBeat 引述谷歌云发言人称目前为面向部分客户的私有预览

官网:cloud.google.com/blog/products/ai-machine-learning/welcome-to-gemini-at-work-2026

OpenPilot #10 · 88 分

A · AI 模型与 Agent

开源桌面 AI agent,模型随便你选

一个免费、MIT 许可的桌面 AI agent:接上任意 OpenAI 兼容的模型(OpenAI、OpenRouter、Ollama、LM Studio 都行),指定一个文件夹,它就在那里读写文件、跑命令。敏感动作需要你批准。目前 Windows 可用,macOS 处于早期测试。官网的自述是"自带 LLM"——建文件、跑终端、搜网页、把项目做出来,没有供应商锁定。

功能与亮点

· 免费、MIT 许可的桌面 agent

· 支持任意 OpenAI 兼容模型:OpenAI、OpenRouter、Ollama、LM Studio

· 选定文件夹后在其中读写文件与执行命令,范围可控

· 敏感动作需人工批准

· Windows 已可用,macOS 早期测试版

· 官网定位:Bring your own LLM,无供应商锁定,可建文件、跑终端、搜索网页

官网:openpilot.in

B · 生产力与效率工具

Zernio #1 · 273 分

B · 生产力与效率工具

面向产品与 agent 的营销基础设施

把渠道集成这件苦活整包吃掉。Zernio 的口径是:与其为每个渠道各做一套集成、各过一遍授权与平台审核,不如接一次——全部走官方平台 API,大多数团队当天就能上线。一个 API 覆盖 16 个社交平台、7 个广告网络、统一收件箱、短信、RCS、iMessage、WhatsApp,以及可以在 Zernio 内部直接购买的 57 个国家的号码(含电话与短信)。你可以在代码里用 REST API,也可以让你的编码 agent 通过它托管的 MCP server 与 CLI 做同样的事。

功能与亮点

· 一个 API 覆盖 16 个社交平台 + 7 个广告网络 + WhatsApp / iMessage / 短信 / 电话

· 全部基于官方平台 API,团队当天上线,不必逐个过审核

· 号码与通话能力在 57 个国家可直接于 Zernio 内购买

· 自带托管 MCP server 与 CLI:agent 能自行连接账号、投放、发消息、打电话

· 官网自述为 20 万名开发者所构建的产品提供营销基础设施;免费档最多 2 个账号

· 这是 Zernio 的第 4 次 Product Hunt 发布

官网:zernio.com

Staffcoder #7 · 99 分

B · 生产力与效率工具

像真正的工程师那样练

一个强调动手的编码练习平台:练的是真实工程工作,而不是算法题。选一个技术栈(React、Next.js、Django、Spring Boot、Docker、Kubernetes、AI agent 等),打开一个挑战,在带真实终端、文件系统与实时预览的完整浏览器 IDE 里把它做出来——不需要安装任何东西。目前有 1000+ 个挑战,覆盖 39 条以上学习路径,前端、后端、全栈、移动端、DevOps、数据、QA 与 AI 工程都有。

功能与亮点

· 1000+ 挑战 / 39 条以上学习路径,覆盖 React、Next.js、Django、Spring Boot、Docker、K8s、AI agent

· 浏览器内完整 IDE:真终端 + 文件系统 + 实时预览,零安装

· 每个挑战跑在独立容器中,自带 agentic 与 AI 对话(maker 答复)

· 免费档每周 1 小时使用时长与部分 AI 额度;Pro 每月 10 美元含 1 美元 AI 额度

· 每个技能按模块划分,模块内含教学视频与挑战,完成"golden challenges"可加速通关

· maker Shashank 有 13 年编程内容从业经历,曾为 HackerRank 的招聘测试出题;compete 与 practice 板块即将上线

官网:staffcoder.com

AgentSDR #9 · 88 分

B · 生产力与效率工具

开源 AI SDR

maker 的原话是他"受够了烧钱却几乎不动销的拓客工具"。他把栈拆开看,真正起作用的只有两样:自己的数据(卖给谁、对方怎么回)和底层平台(Google / Microsoft 发邮件、LinkedIn、WhatsApp)。中间那些工具大多只是包一层现成 API,再叠上按席位、按联系人的费用,并把定制能力锁在付费墙后面。AgentSDR 就是他按自己想要的样子做出来的开源版本:统一线索库、内置丰富化、原生邮件序列、多渠道触达,外加一个自动给回复分类并起草答复的 AI CRM。

功能与亮点

· 统一线索库:所有联系人与公司只有一个真相来源

· 接入 15 家数据供应商的丰富化能力,另可加自定义 AI 研究列

· 原生邮件序列,直接通过你自己的 Google Workspace 邮箱发出

· 多渠道触达:LinkedIn 邀约与消息、WhatsApp、录音电话

· 统一 AI CRM:跨渠道回复汇入同一收件箱,自动分类并生成一键批准的 AI 草稿

· 自带密钥自托管:Google / Microsoft Workspace、Unipile、OpenRouter、Cloudflare R2

· 零坐席限制、零按联系人计费、MIT 100% 开源(GitHub: Kandid-ai/AgentSDR);当前为 v0.1

官网:agentsdr.ai

C · 设计创作工具

Playground by Google Labs #3 · 167 分

C · 设计创作工具

用 Google AI 创建、游玩并分享你自己的游戏

Google Labs 是 Google 公开测试早期 AI 产品与功能的实验场(NotebookLM、搜索增强、Workspace 助手等均出自此处)。这次的 Playground 是一个实验性 AI 游戏平台:不写代码,描述你的想法、选一个类型,AI 几分钟内生成一个可以玩的游戏;想改规则、角色、物理或画面,用聊天说一句就行。做完可以分享给朋友、发布到社区画廊,也可以去玩别人做的。底层由 Google 的 Gemini、Nano Banana 与 Lyria 三个模型驱动。

功能与亮点

· 描述想法 + 选类型,AI 几分钟生成可玩游戏,无需代码

· 改规则、角色、物理、画面全部通过对话完成

· 由 Gemini、Nano Banana、Lyria 三个模型共同驱动

· 可分享给朋友或发布到社区画廊,也能玩别人的作品

· 这是 Google Labs 在 Product Hunt 的第 16 次发布

官网:labs.google

Refs #8 · 96 分

C · 设计创作工具

给你的视频更好的参考片

Claude 会写、会编码、会设计,但让它做一支发布片,你拿到的是"它看过的所有发布片的平均值"。导演解决这个问题靠参考片,Refs 就是这个思路:一个收录 3000 多部真正打动过人的影片的库,每一部都逐镜头测量过,并写成带配方 prompt 的 15 格蓝图。一条命令把它接进 Claude Code、Codex 或 Cursor,让它按真实的东西来分镜。

功能与亮点

· 库内含 2,449 部(官方描述口径 3000+)影片:创始人发布片、产品短片、动态字体、three.js 世界

· 已逐镜头测量 60,539 个镜头,每部写成 15 格蓝图:钩子、节拍、镜头、字体、色彩、声音、脚本

· 每部影片配一个可直接交给 Claude 的 recipe prompt

· Formulas 归纳同一格式强片的共性;Recommended 给出 SaaS、App、AI 工具真会去抄的片子

· 以 MCP 形式接入 Claude Code、Codex、Cursor,一条命令装上

· 库里包含 Linear、Runway、Vercel、OpenAI、Perplexity 等公司的发布片;Refs 自己的发布片就是这么做的

· 浏览免费;Pro 每月 16 美元解锁全部镜头、配方、Formulas 与 MCP

官网:refs.video

D · 旅行 · 日常 · 生活

本期无入选产品

E · 工业应用

Odyssey 3 #5 · 139 分

E · 工业应用

实时模拟物理的世界模型

Odyssey-3 是一个基础世界模型:从一个 prompt 生成可交互环境,并实时预测当你或 agent 在其中行动时环境会怎么变。它的 Pro 版本在 Physics-IQ Verified 的 video-to-video 上拿到 66.1(best-of-8 采样),官方称为目前公开的最高分,image-to-video 为 54.7。同一套基础模型加装小型动作解码器或策略后,被适配到机械臂、人形机器人与汽车上。

功能与亮点

· Physics-IQ Verified video-to-video 66.1(best-of-8),官方称最高公开成绩;image-to-video 54.7

· 实时交互:蒸馏出的少步版本快到足以支撑实时使用

· 机械臂:几十小时示范后完成"把麦片倒进碗里""合上螺丝盒",还出现了示范里没有的补救行为

· 人形:Flexion 在其上训练的控制策略在环境变化时优于被测 VLA 基线,并在让基线失效的光照变化下继续工作

· 驾驶:冻结主干、仅用 20 小时驾驶数据训练的策略,在印度真实道路上开过车

· 合成数据:100 步训练后即可同时生成驾驶场景的三个机位;研究预览在 experience.odyssey.systems

官网:odyssey.systems/meet-odyssey-3

F · 数据 · 硬件 · 协作

Busabase #2 · 242 分

F · 数据 · 硬件 · 协作

给 AI agent 用的通用记录系统

不同的 agent,同一个底座。Busabase 是一个给人也给 AI agent 用的通用数据库与工作区:业务记录、文档、skills 与应用放在同一处,下一个任务可以直接接着上一个的结果往下做。它解决的是 maker 在客户那里反复看到的问题——换一个项目或换一个 agent,上下文与指令就得从零重建,业务人员为了把东西整理好甚至得先学 Git。团队的判断是:agent 应该是无状态的,公司知识与工作内容留在一个共享底座里。

功能与亮点

· 官方用「人 : agent : 数据 = M : N : 1」概括定位:多人多 agent 维护同一份数据

· Shared Playbooks:把 Skills、流程、编码规约与自定义提示集中成一个可浏览目录,接入的 agent 开工前先查阅

· 权限分 read / proposal / changeRequest:agent 可以提交 CRM 修改但不能自己合并,审阅者能逐字段对照查看、看到谁提的

· Team Insights 记录改动、提案、审阅与活跃趋势,区分人与 agent 来源

· Instant AirApps:让 agent 把工作区数据直接变成仪表盘、简报或内部业务应用

· 通过 MCP / OpenAPI / CLI 接 Claude Code、Codex、Grok Bot、Muse、OpenClaw、Manus、Hermes、Buda

· 开源,可自托管 / Personal Desktop / Cloud 三种形态

· 与 agent memory 的区别(官方口径):它不自动导入或记忆每段对话,只存你或 agent 显式保存的东西

官网:busabase.com

四、趋势洞察(5 条)

1. 前两名同时在做同一件事:给 agent 一个能落手、能记账的底座

第 1 名 Zernio(273 分)把渠道集成整包吃掉,配一个托管 MCP server 让 agent 自己连账号、投放、发消息、打电话;第 2 名 Busabase(242 分)把业务记录、文档与工作方法收进一个共享库,让换 agent 时上下文不重置。一个解决"手伸不出去",一个解决"脑子记不住",合起来才是 agent 真正在你的系统里干活的两个前提——它们排在票数的前两位,与当天热点里谷歌云发布通用工作 agent 是同一件事在三个价位上的投影。

2. 「审批」被写进了三种产品的默认流程,而不是当作附加说明

Busabase 把权限拆成 read / proposal / changeRequest,agent 可以提交 CRM 修改但永远不能自己合并,审阅者逐字段对照后才批准;OpenPilot 让敏感动作一律等你点头;Gemini Agent 给每个 agent 独立身份、审计轨迹、沙箱与按项目的实时支出上限。三款形态完全不同、价格从免费到企业订阅,但都把"谁能批准、批准了记不记得住"做成了默认配置。这与微软在同一周把 MXC 推上正式商用是同一个信号:agent 的边界正在由操作系统和应用层共同强制,而不是靠提示词约束。

3. 开源在这一期不是立场,而是一种定价方式

AgentSDR 用"零坐席费、零按联系人计费、MIT 开源"直接对标 Clay、Smartlead 与 HubSpot,把不可压缩的成本(数据供应商、云、模型)留给用户自付;Together Link 本身免费开源,只在模型用量上按 token 收钱,还给每次会话一张花费收据;OpenPilot 干脆免费、模型自带。三家的共同结构是:自己那层做成零边际,把钱留在真正有边际成本的地方。相比之下,Refs 与 Staffcoder 走的是 16 美元 / 10 美元的低月费加免费档——榜单下半段的定价明显比上半段克制。

4. 唯一一款碰物理世界的产品,靠的是"能控制"而不是"能生成"

Odyssey 3(139 分)是本期唯一进入工业应用类的产品,也是唯一与真实机器直接相关的:它进榜的理由不是生成视频更像真的,而是同一个基础模型加装小型动作解码器后,能操控机械臂、驱动人形策略、在印度真实道路上开车。这与同期热议的世界模型叙事有一个细微但关键的差别——评测口径从"画面像不像"换成了"动作能不能用"。Physics-IQ 66.1 这类分数被放在首屏,说明买家关心的已经是控制精度。

5. 榜单结构:10 款里 8 款给工程师或增长团队,旅行·日常·生活继续空着

按品类数:A 类 3 款(Together Link、Gemini Agent、OpenPilot)、B 类 3 款(Zernio、Staffcoder、AgentSDR)、C 类 2 款(Playground、Refs)、E 类 1 款(Odyssey 3)、F 类 1 款(Busabase),D 类无入选。10 款全部带名次,无无编号推广位混入。与前几期相比,C 类靠 Google 与 Refs 撑住了 2 款、E 类回来了 1 款,但"给干活的人省时间"依然是绝对主力——这也是周五榜单量级偏小时的常态结构:能上榜的产品不多,且几乎都指向同一个买家。

数据来源:producthunt.com/leaderboard/daily/2026/10/9(页面直接给出 Score / Comments / External URL 字段);产品描述与 maker 首帖来自各产品 PH 页面;官网域名由 PH External URL 字段与候选域名 title 比对双重确认;界面图为官网首页 1440×900 实拍。

未确认项:智谱 GLM-5.4 / GLM-5.5 万亿参数与双轨路线来自行业披露、官方未确认;苹果 10 月 13 日发布会的硬件规格与 350 美元价格来自爆料与系统代码线索、官方未确认;GPT-6.1 Sol Ultrafast 的「最高 8 倍」为 AIbase 转述的官方口径;Mistral Large 4 全部基准为厂商自报、独立评测尚未落地。

票数口径:取 PH 日榜页每条右侧第二个数为分数(273/242/167/154/139/126/99/96/88/88),与位次严格单调对应;第一个数按页面标注为评论数记录。

相关学习资料