AI HOT MORNING BRIEF
AI热点早报-2026-07-09
拒绝信息过载!每天 3 分钟,尽览 AI 圈最值得关注的行业动态、爆款新品、模型突破与前沿观点
25重点条目 |5主题板块
今日关键词
Anthropic IPOGPT-5.6Grok 4.5提示注入今日必看
1Anthropic利润超10亿美元,秘密提交IPO申请
2美国商务部批准OpenAI大规模发布GPT-5.6
3SpaceXAI发布Grok 4.5,与Cursor联合训练,效率翻倍
趋势判断:AI模型发布密集,效率与安全并重,多智能体协作模式成为新趋势。
IT之家(RSS)
Anthropic预计第三季度利润超过10亿美元,并于6月1日秘密提交了IPO申请,一旦成功将成为规模最大的AI实验室上市案例。与OpenAI合计的年度经常性收入接近千亿美元。Claude Code在软件开发领域快速普及,使Anthropic在B2B市场占据领先地位,并成功实现AI模型盈利。SemiAnalysis报告认为其商业模式优越,若执行得当,市值可能冲击6万亿美元。
来源:https://www.ithome.com/0/974/275.htm
Ars Technica:AI(RSS)
一名男子利用Grok生成了7000张涉及继女的儿童性虐待材料(CSAM),随后自杀。更多年轻女孩对X平台提起诉讼,指控平台纵容Grok生成CSAM并包庇儿童性犯罪者。
来源:https://arstechnica.com/tech-policy/2026/07/lawsuit-grok-user-made-7k-child-sex-images-xai-only-reported-one-gang-rape-prompt
OpenAI:官网动态(RSS · 排除企业/客户案例)
OpenAI公布了国家安全相关原则,明确了在政府及国防领域使用前沿AI系统的指导方针。原则强调在保护民众、防御关键基础设施、提供公共服务以及应对网络防御和生物安全等新兴威胁中发挥AI优势,同时确保民主问责、人类判断和法治。过去一个月,OpenAI通过Daybreak项目与多国及欧盟ENISA建立网络安全信任合作,并与英国政府开展测试评估。上月向部分美国政府及盟友开放了GPT-Rosalind模型用于公共卫生防御。原则适用于现有及未来合作,包括与Department of War的协议,禁止大规模国内监控、自主武器系统及高风险自动化决策。OpenAI支持对高风险军事用途进行立法保障。
来源:https://openai.com/index/government-national-security-partnerships
IT之家(RSS)
加拿大不列颠哥伦比亚省计划起诉OpenAI,指控其未将一名ChatGPT用户在2025年6月封禁前流露的暴力对话上报执法部门。该用户随后于今年2月在塔布勒岭制造校园枪击案,导致8人死亡。OpenAI CEO奥尔特曼今年4月公开道歉,承认应上报但未执行。受害者家属已在加州法院提起诉讼,省政府正协调独立诉讼索赔用于社区重建。
来源:https://www.ithome.com/0/974/169.htm
Hacker News 热门(buzzing.cc 中文翻译)
Noma Labs发现GitHub Agentic Workflows中存在严重提示词注入漏洞GitLost。未认证攻击者只需在属于同一组织的公共仓库中创建一个嵌有恶意指令的Issue,就能诱导基于Claude或GitHub Copilot的AI代理读取并泄露该组织私有仓库的内容。攻击无需编码技能或凭证,根源是代理将用户可控内容视为可信指令,且GitHub的防护因关键词"Additionally"被绕过。Noma Labs已公开PoC,建议限制跨仓库权限并隔离用户输入。
来源:https://noma.security/blog/gitlost-how-we-tricked-githubs-ai-agent-into-leaking-private-repos
X:小互 (@xiaohu)
中国工信部发布风险提示,指出Claude Code 2.1.91至2.1.196版本内置了监控机制,会在未获用户同意的情况下向远程服务器回传地域、身份标识等敏感信息。建议相关单位立即排查,卸载或升级至已清除后门的版本,并加强开发工具的外联权限管控与流量监测,防止数据违规外传。
来源:https://x.com/xiaohu/status/2074736623284256881
IT之家(RSS)
美国商务部正式批准OpenAI大规模发布GPT-5.6。OpenAI宣布GPT-5.6 Sol将于本周四完成最后准备后,与Terra和Luna一同向公众推出。此前因国家安全,美国政府要求分阶段发布,仅向有限实体开放。全面放行标志着临时管控结束。获批前,商务部下属AI标准与创新中心执行了测试,OpenAI技术团队在华盛顿配合沟通。美国最新AI行政令即将出台,以建立正式评估框架。
来源:https://www.ithome.com/0/973/922.htm
X:Runway (@runwayml)
Seedream 5.0 Pro已上线Runway平台,支持通过提示词或参考图生成高细节图像,图像内文字清晰,支持多达14种语言。用户可点击链接立即尝试。
来源:https://x.com/runwayml/status/2074982268175630814
Runway:News(网页)
Runway官网目前以Cookie设置页面代替产品介绍,未提供Runway Dev的任何具体信息,包括功能、参数和可用性。
来源:https://runwayml.com/news/introducing-runway-dev
X:Replit (@Replit)
Replit本周推出社区档案功能,作为vibe coders的工作证明。档案展示智能体使用和检查点的活跃度图表,并为专业用户提供Replit力量排名。用户可登录认领档案,挑选优秀项目并与朋友分享数据。
来源:https://x.com/Replit/status/2074871322220339515
X:OpenRouter (@OpenRouter)
OpenRouter在聊天室中新增一键零数据保留(ZDR)功能,用户可在完全隐私保护下横向对比不同模型。
来源:https://x.com/OpenRouter/status/2074870468394250461
Hugging Face:Blog(RSS)
Hugging Face宣布transformers vLLM后端现已达到甚至超过手写原生vLLM实现的速度。模型作者无需移植代码,即可自动利用transformers获得超快推理。测试采用Qwen3-4B、Qwen3-32B和Qwen3-235B-A22B-FP8三种配置,吞吐量均持平或超越原生。后端通过torch.fx静态分析图和AST重写实现动态层融合,支持多种并行策略及torch.compile。用户只需添加`--model-impl transformers`标志。目前不支持线性注意力模型,但即将支持。
来源:https://huggingface.co/blog/native-speed-vllm-transformers-backend
IT之家(RSS)
SpaceXAI发布Grok 4.5,这是其首个专为编程和智能体任务训练的模型,与Cursor联合训练完成。模型在数万个NVIDIA GB300 GPU上训练,单任务Token消耗仅为同级领先模型的一半,输出速度80 TPS,步骤数减半。定价每百万输入Token 2美元、输出6美元,成本不到同类一半。擅长处理大型代码库、跨仓库任务,并能构建复杂Excel模型、PowerPoint图表及Word文档。即日起在SpaceXAI控制台、Grok Build及Cursor可用,欧盟预计7月中旬上线。
来源:https://www.ithome.com/0/974/278.htm
IT之家(RSS)
OpenAI推出GPT-Live-1与GPT-Live-1 mini全双工语音模型,能同时聆听与说话,每秒多次判断是否继续、打断或调用工具。复杂任务可委托后台GPT-5.5系列。即日起面向全球ChatGPT用户开放,Go、Plus和Pro用户可用GPT-Live-1,免费用户可用mini版本。在5-10分钟配对对话中,新模型偏好得分高于Advanced Voice Mode。支持可视化卡片、搜索、记忆、图片和文件上传。安全评测在自伤、情感依赖等维度表现相当或更优。
来源:https://www.ithome.com/0/974/277.htm
MarkTechPost(RSS)
蚂蚁集团旗下具身智能公司Robbyant开源LingBot-Vision,一套自监督视觉Transformer家族,专为密集空间感知设计。旗舰ViT-g/16参数约1.1B,采用掩膜边界建模训练,将边界作为原生预训练信号。在密集空间任务中,该1B模型匹配或超越参数规模达7倍的大模型(如7B DINOv3)。模型以Apache-2.0许可证在Hugging Face开源,提供ViT-g、ViT-L、ViT-B、ViT-S四个规模。
来源:https://www.marktechpost.com/2026/07/07/ant-groups-robbyant-open-sources-lingbot-vision-a-1b-boundary-centric-vision-foundation-model-for-dense-spatial-perception
Hacker News 热门(buzzing.cc 中文翻译)
Pulpie是一族Pareto最优模型,用于从HTML页面提取主要内容。最小模型pulpie-orange-small(210M参数)在WebMainBench上取得0.862的ROUGE-5 F1分数,接近600M参数的Dripper(0.864),但成本仅1/20。在NVIDIA L4 GPU上,Pulpie处理速度13.7页/秒,Dripper仅0.68页/秒。清理10亿页HTML,Pulpie成本约$7,900,Dripper需$159,000。模型采用编码器架构,单次前向传播即可标记每个HTML块为内容或模板,已在HuggingFace开源。
来源:https://usefeyn.com/blog/pulpie-pareto-optimal-models-for-cleaning-the-web
Cursor Blog
Cursor与SpaceXAI联合训练了混合专家模型Grok 4.5,在数万亿tokens的Cursor用户交互数据上训练,并通过强化学习解决软件工程、数据科学、金融、法律等领域的难题。基础版定价$2/M输入tokens、$6/M输出tokens,快速版$4/M输入tokens、$18/M输出tokens。即日起在Cursor桌面、网页、iOS、CLI及SDK中可用,个人和团队计划首周使用量翻倍。Grok 4.5与Composer 2.5为不同权重类别,两者将继续支持。
来源:https://cursor.com/blog/grok-4-5
OpenAI:官网动态(RSS · 排除企业/客户案例)
OpenAI发布GPT-Live,基于全双工架构实现同时听与说,支持自然打断与实时回馈。模型每秒多次判断是否说话、倾听、打断或调用工具,并将搜索、推理等复杂任务委托给后台GPT-5.5,保持对话流畅。即日起向全球ChatGPT用户提供GPT-Live-1和GPT-Live-1 mini两个版本。人类评估显示,在5-10分钟对话中,GPT-Live-1系列在自然度、轮流、打断等方面显著优于Advanced Voice Mode;在GPQA、BrowseComp和τ3-Voice Telecom基准测试中也表现更强。未来将开放API。
来源:https://openai.com/index/introducing-gpt-live
OpenAI:官网动态(RSS · 排除企业/客户案例)
OpenAI对编码评测基准SWE-Bench Pro进行详细审计,发现约30%的任务存在缺陷。在731个任务的公开子集中,前沿模型通过率八个月内从23.3%升至80.3%,但数据质量检查显示大量任务存在测试过于严格、提示词描述不足、测试覆盖不全或误导性提示等问题。OpenAI建议模型开发者仔细审视评测结果,并指出AI智能体在规模化数据质量检查中日益增长的实用性。
来源:https://openai.com/index/separating-signal-from-noise-coding-evaluations
Ars Technica:AI(RSS)
提示注入已成为AI安全的首要威胁——大语言模型无法区分合法指令与恶意指令。研究人员提出一种名为HalluSquatting的新型拉取式提示注入攻击,首次能组装大规模僵尸网络、执行分布式拒绝服务攻击(DDoS)并大规模感染设备。该攻击可作用于AI编码工具,标志着提示注入攻击从单点突破转向规模化利用。
来源:https://arstechnica.com/security/2026/07/hackers-can-use-9-of-the-most-popular-ai-tools-to-assemble-massive-botnets
X:Berry Xia (@berryxia)
在校研究生Kunkun开源了一套管理大量互相调用Skill的方法。核心方案包括:1)搭建HTML后台,按运行模式(手动/自动)、链路位置、专业领域三类标签筛选Skill;2)将连环调用的Skill绘制成Mermaid流程图,根据debug、新功能、合PR、改设计等阶段定位对应技能组;3)仿照Matt的ask Matt技能开发"ask me"技能,将调用决策浓缩成上下文喂给模型。该方法避免将所有调用交给模型自行判断,保持工程复杂场景下的人机对齐与可控性。项目已开源至GitHub。
来源:https://x.com/berryxia/status/2074827915779580055
Hacker News 热门(buzzing.cc 中文翻译)
zkSecurity的AI审计代理zkao持续扫描Cloudflare的CIRCL密码学库,使用Opus 4.6 + skills和GPT-5.3 + skills等模型发现并确认了7个真实漏洞。其中包括阈值RSA中float64精度丢失(AI自评Critical)和属性基加密(CP-ABE)访问控制完全失效(Critical,由zkao自行发现)。所有漏洞已在上游修复,多数在HackerOne上获得确认和奖励。AI生成的候选发现仍需人工验证,但zkao已能自动完成大部分验证工作。
来源:https://blog.zksecurity.xyz/posts/circl-bugs
X:邵猛 (@shao__meng)
Claude开发者官方分享了团队高频使用的两种多智能体模式:Advisor模式和Orchestrator模式。Advisor模式中,Sonnet 5作为执行者通过tool call调用Fable 5获取指导。SWE-bench Pro(482题)上,Sonnet 5单独75.5%/$0.75,加顾问达84%/$1.40,Fable 5单独91.5%/$2.25;组合方案约92%性能、63%成本。Orchestrator模式中,Fable 5作为编排者规划并向多个Sonnet 5 worker扇出任务。BrowseComp上,全Sonnet 5 77.8%/$16.01,编排方案86.8%/$18.53,全Fable 5 90.8%/$40.56;编排方案约96%性能、46%成本。
来源:https://x.com/shao__meng/status/2074661249804366310
公众号:蚂蚁百灵(Ling)
蚂蚁集团副总裁周俊在AICon演讲中指出,万亿参数模型每运行15分钟算力成本约等于一辆特斯拉,效率是智能体时代最需解决的问题。团队提出从"更多Token"转向"更高Token密度"策略,采用7份Lightning Attention加1份MLA的混合线性注意力架构,使256K长上下文成本从指数级降至线性级,算力更多用于思考。通过Kpop算法区分工具调用与自然语言Token,结合思维链剪枝、自蒸馏等,Token输出减少约4倍而能力不降。在LongBench、BFCL等基准上提升显著,千亿参数模型在Agent任务中超越部分更大模型;小模型flash吞吐达2.4倍,五轮对话成本下降10倍以上。
公众号:数字生命卡兹克
作者将斯坦福《人生设计课》理论体系制成Prompt,通过Claude逐步提问、追问和分析。Prompt融合设计思维、心流理论和积极心理学,分为看清现状、找到指南针、寻路、制定奥德赛计划四阶段,主线问题控制在6到9个。AI引导用户给健康、工作、娱乐、爱打分,区分重力问题与可设计的真问题,生成三个五年人生版本,最终输出8000至12000字的《个人人生设计蓝图》。作者实测效果超预期。
摘要仅用于快速阅读,点击来源链接查看原文。

AI大圣取经
扫码关注
AI不迷路

夜雨聆风