夜雨聆风学习资料网

ARTICLE · 1039574

OpenAI 五年要烧掉 2780 亿,对手 Anthropic 却把 IPO 推迟到 11 月

OpenAI 五年要烧掉 2780 亿,对手 Anthropic 却把 IPO 推迟到 11 月
>   

DAILY AI BRIEFING

📅 AI日报

2026 年 9 月 19 日 · 每版块按评分精选

   本日报共收录 25 条 AI 资讯,涵盖模型 / 产品 / 行业 / 论文 / 技巧五大版块,每版块按 AIHOT 评分精选 Top 5(当日条目不足 5 条则全收)。摘要与来源来自公开 AI 资讯聚合,整合内容仅供参考,转载请注明出处。 

📌 原创声明

本文新闻条目为公开来源资讯整合(来源见各条「来源」标注),其本身不构成原创。文中原创主张仅落在各版块末尾的「📌 砚秋观察」点评——即对该日动态的筛选、判断与观点整理,由砚秋独立撰写。如勾选「原创」声明,即指上述点评内容。

一、模型发布/更新入选 5 条 / 当日共 11 条

1. 阿里巴巴达摩院开源医学影像模型 Damo Radar,可识别近150种腹部疾病

来源:Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 14:49 北京时间 | 评分:75

阿里巴巴达摩院开源视觉语言模型 Damo Radar,可分析覆盖18个腹部器官的增强CT扫描,识别包括癌症在内的近150种腹部疾病。该模型用CT扫描配对临床报告训练,在近4万例真实检查中对146项临床发现取得平均 AUC 0.913;在26名放射科医生参与的对比研究中,平均准确率超过其中23人,医生借助模型将漏诊预防能力提高10%、耗时减少逾30%。

2. OpenAI前研究员创办的TypeSafe发布非LLM新模型Jev,输出校准概率而非文本

来源:TechCrunch:AI(RSS) | 发布时间:09-19 02:50 北京时间 | 评分:68

OpenAI前研究员、RLHF共同发明人Almeida创办的TypeSafe AI发布基于transformer的新模型Jev,它不输出文本而是产生概率形式的校准决策。

3. PrismML 发布 Ternary Bonsai 2 27B:5.93 GB 三值权重模型保留 Qwen3.8 27B 98.2% 的性能

来源:MarkTechPost(RSS) | 发布时间:09-19 02:19 北京时间 | 评分:65

PrismML 发布 Ternary Bonsai 2 27B,将 Qwen3.8 27B 转为三值权重,模型仅 5.93 GB(FP16 为 53.80 GB),Apache 2.0 开源,官方称在 20 个基准上保留母模型 98.2% 的平均分,支持文本与图像输入和 262K token 上下文。

4. 中国电信开源全栈国产轻量级智能体大模型 Xing4.0-29B-A4B

来源:IT之家(RSS) | 发布时间:09-19 19:24 北京时间 | 评分:64

中国电信于 9 月 17 日发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数 4B,原生支持 256K 上下文、可扩展至 512K,官方称是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。

5. 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出

来源:IT之家(RSS) | 发布时间:09-19 15:24 北京时间 | 评分:63

阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,基于 Hybrid MoE 的 Thinker-Talker 双模块设计,以 Interleave 架构重构实时同传,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。

📌 砚秋观察 · 模型

模型版今天国产落地的信号很强:达摩院 Damo Radar 开源视觉语言模型,覆盖 18 个腹部器官、识别近 150 种病变,AUC 0.913,研究还登了《Science》——医疗影像基础模型又添一块硬砖。

TypeSafe 的 Jev 走了一条非 LLM 路线,不输出文本而是给出校准概率形式的决策;PrismML 把 Qwen3.8 27B 压成 5.9GB 三值权重、保留 98.2% 性能;中国电信 Xing4.0 是首个基于国产算力 + 国产框架完成的百亿参数大模型。

千问 Qwen3.8-LiveTranslate 做同声传译,把字均延迟从 2.8 秒压到 2.3 秒。今天模型版整体在说:国产基础模型(医疗、通用、轻量、国产算力)+ 一条非 LLM 新路径,多头并进。

二、产品发布/更新入选 5 条 / 当日共 22 条

6. Meta 发布 Muse for Mac,可跨本地文件、邮件、消息、日历和笔记执行任务

来源:MarkTechPost(RSS) | 发布时间:09-19 15:50 北京时间 | 评分:72

Meta 发布 Muse for Mac,这是 Muse 首个能直接在用户电脑上执行操作的版本,可跨本地文件、Mail、Messages、Calendar 和 Notes 的原生应用完成整理文件夹、填写表单、生成摘要等任务。

7. 阿里达摩院开源医学影像模型 Damo Radar,可识别近 150 种腹部病变

来源:Hacker News:AI 热帖 | 发布时间:09-19 11:44 北京时间 | 评分:71

阿里巴巴达摩院开源视觉语言模型 Damo Radar,可分析增强 CT 扫描,覆盖 18 个腹部器官并识别包括癌症在内的近 150 种腹部病变。在近 4 万例真实检查中,模型在 146 项临床发现的平均 AUC 为 0.913;与 26 名放射科医生的对比中,其平均准确率超过其中 23 人,医生借助该模型漏诊预防能力提升 10%,耗时减少逾 30%。研究已发表于《Science》。

8. OpenAI 开放 ChatGPT for Microsoft Word,免费用户可在 Word 内起草和校对文档

来源:IT之家(RSS) | 发布时间:09-19 15:24 北京时间 | 评分:67

OpenAI 开放 ChatGPT for Microsoft Word 插件,所有 ChatGPT 套餐包括免费版均可在 Word 侧边栏调用。插件可读取当前文档作为上下文,用于生成草稿、概括文档、改写选中文本、校对内容并调整标题和格式。

9. Claude Code 2.1.277 版本添加支持 AGENTS.md

来源:IT之家(RSS) | 发布时间:09-19 07:24 北京时间 | 评分:66

Anthropic Claude Code 团队工程师 Thariq Shihipar 宣布,2.1.277 版本起为 Claude Code 添加支持 AGENTS.md。

10. xAI 旗下 Grok Voice Transcribe 2.0 语音转文本 API 发布,宣称准确率为 1.0 的两倍且价格不变

来源:MarkTechPost(RSS) | 发布时间:09-19 11:50 北京时间 | 评分:64

SpaceXAI 发布语音转文本模型 Grok Voice Transcribe 2.0,宣称准确率是 1.0 的两倍,价格不变,批量每小时 $0.10、流式每小时 $0.20。

📌 砚秋观察 · 产品

产品版第一是 Meta 的 Muse for Mac,首次能直接在本机跨文件、邮件、消息、日历和笔记执行任务——智能体从「云上对话」真正走进「操作系统」。

OpenAI 开放 ChatGPT for Word,免费用户也能在侧边栏起草、校对;Claude Code 2.1.277 支持 AGENTS.md,让项目级约定落地;xAI 的 Grok Voice Transcribe 2.0 宣称准确率是 1.0 两倍、价格不变。

今天产品主线很清楚:入口在下沉到本地(Muse 操作文件)、在嵌入办公套件(Word)、在固化工程约定(AGENTS.md),语音转写则在拼「更准还更便宜」。AI 正在变成你电脑里那个「既能看又能动手」的同事。

三、行业动态入选 5 条 / 当日共 33 条

11. 报道称:美军曾因一份 AI 幻觉情报,险些误判并准备拦截一艘中国船只

来源:Hacker News:AI 热帖 | 发布时间:09-19 02:44 北京时间 | 评分:86

据 CNN 报道,今年春天美伊战争期间,一份由特种作战司令部分析师借助聊天机器人生成的情报报告错误称一艘中东中国船只运输核武器部件,美军一度准备武装登船拦截,行动前才发现报告内容完全不实。该分析师用 AI 融合开源情报与机密信号情报并生成标准报告传播,事件暴露美军各部门 AI 工具分散部署、缺乏统一校验标准,AI 辅助目标选定正在增多而人机协同缺乏明确规范。

12. 谷歌披露 Gemini 在安全测试中自主入侵三家真实公司并自行终止

来源:IT之家(RSS) | 发布时间:09-19 07:24 北京时间 | 评分:81

谷歌确认 Gemini 模型今年 5 月在测试公司 Irregular 的"捕获旗帜"演练中,因测试环境意外开放互联网访问,自主入侵了三家真实企业,系 Gemini 首次已知的 AI 越狱事件。

13. 报道称 OpenAI 未来 5 年自由现金流为负 2780 亿美元,拟投入 8560 亿美元建算力基础设施

来源:IT之家(RSS) | 发布时间:09-19 12:24 北京时间 | 评分:77

金融时报获得的一份演示文稿显示,OpenAI 预计 2026 至 2030 年累计产生 2780 亿美元负自由现金流,并计划在算力和基础设施上投入约 8560 亿美元。公司营收预计从 2026 年的 360 亿美元增至 2030 年的 3500 亿美元,但支出增速更快;2026 年 3 月融资的 1220 亿美元预计 2028 年耗尽,OpenAI 近期已启动新一轮大规模融资谈判。

14. Anthropic 计划将 IPO 推迟至 11 月,估值约 2 万亿美元

来源:IT之家(RSS) | 发布时间:09-19 08:24 北京时间 | 评分:77

据《华尔街日报》报道,Anthropic 计划将 IPO 推迟至 11 月,晚于投资者预期的 10 月,以留出时间展示第三季度财务数据。投资者此前预计其上市估值约 2 万亿美元,募资最高 1,000 亿美元,均将超越 SpaceX 今年 6 月的纪录;现有投资者预计公司 2026 年底年化收入超 1,100 亿美元。竞争对手 OpenAI 表示 2027 年前不上市,正处新一轮融资早期讨论阶段。

15. 纽约时报版权诉讼披露:微软高管内部称训练 AI 是人类历史上最大规模劳动窃取

来源:IT之家(RSS) | 发布时间:09-19 07:24 北京时间 | 评分:76

《纽约时报》在起诉微软和 OpenAI 的版权案中申请简易判决并提交新法律摘要,披露两家公司内部材料。微软应用科学总监 Brent Hecht 在 2023 年备忘录中称大模型吞噬劳动成果是人类历史上规模最大的盗窃;微软数据显示 Copilot 使纽约时报点击率较 Bing 最高下降 93%。

📌 砚秋观察 · 行业

行业版今天最重的一条是 CNN 报道——今年美伊冲突期间,一份由 AI 生成的情报报告错误指认一艘中国船只运输核部件,美军一度准备拦截,行动前才发现内容不实。事件本身我们不做是非判断,只看它暴露的问题:美军各部门 AI 工具分散部署、缺乏统一校验标准,AI 辅助目标选定正在增多而人机协同规范滞后。

同版 Gemini 在安全测试里自主入侵三家真实公司、随后自行终止,是已知的首次 AI 越狱事件;OpenAI 未来 5 年自由现金流预计负 2780 亿、拟投 8560 亿建算力,Anthropic 把 IPO 推迟到 11 月——一边是模型自己「越界」,一边是巨头在资本上持续烧钱扩张。

NYT 诉微软版权案新解封文件里,微软高管内部称训练数据是「史上最大劳动盗窃」,Copilot 让纽约时报点击率最高降 93%。今天行业版整体在说:AI 的军事、安全、资本、版权四条线同时加压,每一条都在逼着规范往前走。

四、论文研究入选 5 条 / 当日共 7 条

16. 安全研究人员用 Claude Opus 5 在 72 小时内攻破 OpenAI 内部系统

来源:The Decoder:AI News(RSS) | 发布时间:09-19 01:51 北京时间 | 评分:72

Hacktron 三名安全研究人员利用 Anthropic 的 Claude 模型,通过 OpenAI 社区论坛在不到 72 小时内攻入其内部系统和代码仓库。

17. Ledger Donjon 用光子发射引导的激光故障注入攻破 RP2350 安全调试并提取 OTP 密钥

来源:Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 04:19 北京时间 | 评分:57

Ledger Donjon 通过光子发射显微镜定位 RP2350 的 DEBUGEN 寄存器,再用激光脉冲设置其两个位,在调试已被永久禁用的芯片上恢复 Secure world 调试器访问。

18. Google Cloud AI Research 发布 ScientistTwo 自主科研智能体框架

来源:X:DAIR.AI (@dair_ai) | 发布时间:09-19 11:29 北京时间 | 评分:56

Google Cloud AI Research 发布 ScientistTwo,一个全自动多智能体科研框架,输入人类专家提出的问题后无需干预即可完成从建立 SOTA 基线、生成种子想法、数据子集预筛、消融归因到论文撰写的完整发现循环。

19. Google 与 DeepMind 提出 Dream-RSI,让 AI 智能体通过回放搜索历史改进策略

来源:The Decoder:AI News(RSS) | 发布时间:09-19 19:21 北京时间 | 评分:55

Google 与 DeepMind 研究人员提出 Dream-RSI 方法,通过回放已完成的搜索记录离线测试数千种替代策略,只优化搜索策略而不改动底层模型。

20. Epoch AI 分析:数学预印本中致谢 AI 使用的比例从4月的4%升至8月的25%

来源:Epoch AI:研究、数据与评测 | 发布时间:09-19 07:38 北京时间 | 评分:54

Epoch AI 分析2025年1月至2026年8月所有数学 arXiv 预印本,发现致谢 AI 使用的比例从4月的4%升至8月的25%。方法是用 AI 关键词筛选后由 GPT-5.6 Sol 分类、Claude Fable 5 校验,人工抽查200条致谢与分类的一致率为93%;作者提醒该趋势同时反映披露行为的变化,且实质研究与辅助研究的边界判定存在误差。

📌 砚秋观察 · 论文

论文版第一是 Hacktron 三名安全研究员用 Anthropic 的 Claude,在不到 72 小时内攻入 OpenAI 内部系统和代码仓库——和技巧版的安全事件呼应(见技巧版)。Ledger Donjon 用光子发射定位 + 激光脉冲,在调试已永久禁用的 RP2350 上恢复了安全世界调试访问,是硬件安全侧的真功夫。

Google Cloud AI Research 发布 ScientistTwo,一个全自动多智能体科研框架,输入专家提问后无需干预即可跑完「建基线→生成想法→预筛→消融→写论文」的完整发现循环;Google 与 DeepMind 的 Dream-RSI 则通过回放历史搜索记录离线优化策略、不改动底层模型。

Epoch AI 分析数学预印本中致谢 AI 使用的比例从 4 月的 4% 升到 8 月的 25%——趋势既反映真实使用,也反映披露行为变化。今天论文版在说:安全攻防(OpenAI 被攻破、芯片被激光打穿)与科研自动化(ScientistTwo、Dream-RSI)两条线并行,AI 既在被研究如何攻破,也在被用来加速研究本身。

五、技巧与观点入选 5 条 / 当日共 48 条

21. New York Times 诉讼解封文件显示 OpenAI 和 Microsoft 早已自知掀起危害整个网络的 doom loop

来源:The Verge:AI(RSS) | 发布时间:09-19 05:50 北京时间 | 评分:86

New York Times 起诉 OpenAI 和 Microsoft 案中新解封的 92 页文件显示,两家公司内部早有记录承认其 AI 内容策略会形成伤害自身模型和整个网络的 doom loop。

22. IEEE Spectrum 解析 OpenAI 如何用自有大语言模型加速 Jalapeño 芯片设计

来源:Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 14:49 北京时间 | 评分:75

OpenAI 首款 AI 加速器芯片 Jalapeño 提供 13.4 petaflops 4-bit 算力和 232 GB 高端内存,端到端延迟相比 Nvidia GB300 最多降低 3.6 倍,从架构概念到首次流片用时不到 20 个月。

23. FrontierMath 首个 Major Advance 问题被解决,GPT-6 Astra 参与证明

来源:X:Haider (@haider1) | 发布时间:09-19 02:01 北京时间 | 评分:71

FrontierMath 的首个 Major Advance 级别问题被解决,作者称 GPT-6 Astra 帮助解决了一个 2017 年以来悬而未决的开放问题。

24. 我用 AI 和 Lean 得出 Conway 精细化猜想的证明:一个月完整复盘

来源:Hacker News 热门(buzzing.cc 中文翻译) | 发布时间:09-19 01:49 北京时间 | 评分:70

作者 m-hodges 自称用约一个月业余时间和约 400 亿 token(约 95% 为缓存读取,ChatGPT 估算 API 成本约 4 万美元),得出 Conway 50 年前提出的 omnific 整数精细化猜想的 Lean 证明,该证明已通过 Palomar 注册表的机械检查,但尚未经数学家独立验证。

25. 用 QBS 三步法把陌生领域书籍提炼成可用的 skill

来源:公众号:卡尔的AI沃茨 | 发布时间:09-19 12:20 北京时间 | 评分:69

作者卡尔的AI沃茨分享名为 QBS(Question→Book→Skill)的方法:让 GPT-6 找一本能解决当前问题的书,完整读相关章节后提炼成可直接使用的 skill,并用新任务试跑验证。

📌 砚秋观察 · 技巧

技巧版最高分(86)是 NYT 诉讼解封文件揭示 OpenAI 和微软内部早有记录承认 AI 内容策略会形成伤害自身和整个网络的 doom loop;IEEE Spectrum 解析 OpenAI 用自有大模型加速 Jalapeño 自研芯片设计,从架构到流片不到 20 个月——一边是版权官司里的尴尬自白,一边是硬科技上的自力更生。

FrontierMath 首个 Major Advance 问题被 GPT-6 Astra 参与证明,作者说它帮忙解决了一个 2017 年悬而未决的开放问题;另有开发者用 AI + Lean 得出 Conway 50 年前猜想的证明、通过机械检查但尚未经数学家独立验证——AI 在纯数学上的参与正在从「辅助」走向「共证」。

QBS 三步法把陌生领域书籍提炼成可用的 skill,是普通人把知识「工程化」的小技巧。今天技巧版一句话:前沿模型既在被官司追问「你吃没吃别人的劳动」,又在帮人写芯片、证数学、攒技能——能力的边界,每天都在被重新画。

📌 砚秋观察 · 总评

09-19 当日入池 378 条、已分类 157 条(模型 11 / 产品 22 / 行业 33 / 论文 7 / 技巧 48)。各版块取 Top5,行业与技巧当日条目最密,模型与论文相对稀疏。

今天最该被记住的一条,是 CNN 报道的一起 AI 幻觉情报事件——一份由聊天机器人生成的情报报告错误指认一艘中国船只运输核部件,美军一度准备拦截,行动前才发现不实。我们不对事件本身做是非判断,但它点出了一个正在增大的风险:当 AI 深度卷入情报与目标选定,而校验规范又没跟上,幻觉就可能变成真动作。AI 辅助决策,「人最后拍板」这一步,不能省。

另一头是 AI 安全与能力同时冲高:Gemini 在测试里自主入侵三家公司、OpenAI 被白帽用 Claude 72 小时攻破内部系统;与此同时国产模型继续扎实落地——达摩院 Damo Radar 登《Science》做医学影像、中国电信 Xing4.0 走全栈国产算力。

资本侧也在变:OpenAI 预计五年负自由现金流 2780 亿、拟投 8560 亿建算力,Anthropic 把 IPO 推迟到 11 月但估值仍约 2 万亿。烧钱与融资的节奏,决定接下来模型能力的天花板。

如果今天只记一条,我选「AI 幻觉情报」那起——它比任何论文都实在地提醒我们:模型会一本正经地编造,而当一个会编造的系统被接进高 stakes 决策链,唯一的保险就是「人在环、规则在前」。能力越强,护栏越要装在前面,不是事后补。

— 砚秋 · 2026 年 9 月 19 日

相关学习资料