模型发布/更新
Claude Sonnet 5 发布:中端价格、旗舰级 Agent 能力,SWE-bench Pro 63.2%
Anthropic 发布 Claude Sonnet 5,定位最具智能体能力的中端模型,替代 Sonnet 4.6 成为默认模型。编码得分 SWE-bench Pro 63.2%(前代 58.1%),知识工作略超 Opus 4.8。输入
2/1Mtoken,输出10/1M,8月31日前优惠价。API 不再支持 temperature,附 145 页系统卡。 https://www.marktechpost.com/2026/06/30/anthropic-claude-sonnet-5-vs-sonnet-4-6-vs-opus-4-8-agentic-coding-benchmarks-api-pricing-and-cost-performance-tradeoffs-compared2 / 1 M t o k e n ,输出 Google 推出 Nano Banana 2 Lite 与 Gemini Omni Flash:4 秒出图 + 视频闭环
Nano Banana 2 Lite 是 Google 最快最便宜的图像模型,4 秒出图,每千张仅 $0.034。Gemini Omni Flash 支持视频生成与对话式编辑。两者结合可从静态图像快速生成动画,面向高频大规模生产场景。 https://www.ithome.com/0/970/812.htm
美团 LongCat-2.0:1.6T 参数 MoE,5万块国产芯片从头训练
美团发布开源编码模型 LongCat-2.0,1.6T 总参数、48B 激活,支持 1M 上下文。在 5 万块国产芯片上从头训练,使用华为 HCCL 通信库,验证了国内算力集群可胜任大模型预训练。 https://the-decoder.com/meituans-longcat-2-0-shows-china-can-train-massive-ai-models-without-nvidia
Meta Brain2Qwerty v2:无需手术的脑电波解码,准确率最高 78%
Meta AI 发布非侵入式脑机接口系统,基于脑磁图(MEG)设备实时从脑电波解码句子。9 名志愿者各 10 小时训练数据,约 22,000 句,端到端深度学习 + LLM 微调,平均词准确率 61%,最高 78%。 https://ai.meta.com/blog/brain2qwerty-brain-ai-human-communication
MiniMax M3 400B+ 参数多模态模型发布
MiniMax 与 Lambda API 合作发布 M3,超 400B 参数的多模态模型,正式面向开发者提供服务。 https://x.com/MiniMax_AI/status/2071996878926090425
产品发布/更新
Cursor iOS 版上线:锁屏展示进度,AI 编码随时审核
Cursor iOS 版完成度极高,锁屏时展示当前编码进度,完成后将界面视频和图片推送至手机供审核。目前面向付费用户 Beta 测试已开放。 https://x.com/op7418/status/2071778259994546590
NotebookLM 推出 60 秒竖屏 AI 视频:刷短视频就能啃完硬核概念
Google NotebookLM 新增 Short Video Overviews,可将复杂资料自动转为 60 秒竖屏短视频,配 AI 生成图像和旁白。面向 AI Ultra 和 Pro 订阅用户。 https://www.theverge.com/tech/959778/google-notebooklm-ai-clips
DeepSeek 发布 DSpark 推理框架,AI 响应速度最高提升 85%
DSpark 采用推测解码技术,小模型生成候选 + 大模型批量验证,一次生成多个 token,每用户响应速度提升 60-85%。基于置信度动态调整验证深度,减少无效计算。 https://the-decoder.com/deepseeks-dspark-boosts-ai-speed-by-up-to-85-percent-a-strategic-win-under-tightening-us-export-controls
英伟达 Blackwell 推理栈将 DeepSeek V4 成本降低最高 5 倍
NVIDIA 最新报告显示,其 Blackwell 推理堆栈在一个月内将 DeepSeek V4 的 token 成本降低了高达 5 倍。 https://x.com/rohanpaul_ai/status/2072085395672817943
X 官方推出托管 MCP,Grok、Cursor、Claude 等工具零部署调用 X API
X 推出托管 MCP 服务器,允许 Claude、Cursor、Grok Build 等 MCP 兼容 AI 助手直接通过用户账户权限连接 X API,开发者无需自建托管。 https://techcrunch.com/2026/06/30/x-now-offers-an-mcp-server-to-make-its-platform-easier-for-ai-tools-to-use
Flowith 推出「Matrix」:Agent 公司的操作系统
Flowith 发布 Matrix,用户设定使命后多个 Agent 部门长期自主运转,被称为 Agent 公司的操作系统。 https://x.com/op7418/status/2071784245530689770
小米/OPPO 超级小爱接入微信,一句话发消息、打电话
基于 A2A(Agent-to-Agent)协作机制,超级小爱向微信发起指令、微信执行并返回结果,全程双重授权保障安全。OPPO 小布助手同步接入。 https://www.ithome.com/0/970/830.htm
ChatGPT Plus 美区上线个人理财功能
ChatGPT Plus 美区上线个人财务分析功能,用户可咨询理财相关问题并获得专业建议。 https://x.com/gdb/status/2072113363543580690
Cline 推出 $9.9/月 Token Plan,支持 DeepSeek/Kimi/MiniMax/千问/GLM5.2
Cline 推出月费 9.9 美元的 token plan,可调用 DeepSeek、Kimi、MiniMax、MIMO、通义千问和 GLM 5.2 等多款国产模型。 https://x.com/op7418/status/2071784028634775895
Booster Robotics 发布首个具身 AI IDE Booster Studio
业界首个专为具身 AI 打造的 IDE,将代码编辑、高精度仿真、真实机器人调试与实地部署集成于单一环境,取代以往分散的多工具工作流。 https://x.com/Booster_Robotics/status/2071776331336192157
中昊芯英新一代 TPU 芯片「须臾」发布:单芯片 896 TFLOPS
全自研 TPU,混合精度浮点算力为上一代「刹那」3 倍,8-bit 推理算力 1792 TOPS。单卡功耗 600W,较传统芯片降低 50%。同步推出智算底座「泰则 2.0」。 https://www.ithome.com/0/970/774.htm
Etched 走出隐身:融资 8 亿美元,SOTA 推理机架今夏发货
Etched 正式公开,融资 8 亿美元,签下超 10 亿美元客户合同。首批推理机架已制造完成,早期测试在吞吐量、延迟和能效方面均达 SOTA。 https://x.com/kimmonismus/status/2071976332628537834
行业动态
美国商务部解除 Claude Fable 5 和 Mythos 5 出口管制,即日恢复访问
Anthropic 接到美国商务部通知,出口管制已解除。两个被禁模型将从明天起恢复访问。此前管制曾引发 AI 圈轩然大波,被视为中美 AI 博弈的标志性事件。 https://www.theverge.com/ai-artificial-intelligence/958964/anthropic-claude-fable-5-is-back
Anthropic 被指在 Claude Code 中植入隐写术识别中国用户
被曝 Claude Code 读取本地时区(Asia/Shanghai)和 ANTHROPIC_BASE_URL 环境变量,与经 base64+XOR 加密的 147 个域名列表匹配,用于识别中国用户并触发限制。引发社区对 AI 工具"国别歧视"的激烈讨论。 https://mp.weixin.qq.com/s/yLb4T2UC16ebKHApdBbgWw
Kimi ARR 达 3 亿美元,开放模型盈利路径获验证
月之暗面 Kimi 年度经常性收入突破 3 亿美元,成为国产 AI 模型商业化的标杆案例,验证了开放模型在中国的盈利可行性。 https://x.com/natolambert/status/2072091663388938576
马斯克抽调 SpaceX 星舰和星链核心工程师,全力攻坚 Grok
数十名 SpaceX 顶尖工程师被调往 Grok 大模型团队。Grok 4.5 已在特斯拉和 SpaceX 内部测试。本月 SpaceX 以 600 亿美元收购 AI 代码公司 Cursor 引发行业震动。 https://www.ithome.com/0/970/662.htm
寒武纪成科创板首支万亿市值股,年初至今涨超 75%
寒武纪盘中市值突破 1 万亿元,成为科创板首支万亿市值个股。一季度营收 28.85 亿元,同比增 159.56%,净利润 10.13 亿元,同比增 185.04%。 https://www.ithome.com/0/970/335.htm
黑石拟投 300 亿美元在日本建 AI 数据中心,联合成立 AI XPV 平台
未来 3-5 年计划,在已有 500MW 基础上新增超 1GW 容量。黑石总裁称"AI 投资仍处早期,真正风险是算力短缺而非基建泡沫"。 https://www.ithome.com/0/970/583.htm
华为 openPangu-2.0-Flash 正式开源,920 亿参数
模型权重、基础推理代码及训推算子于 6 月 30 日上线开源平台。openPangu-2.0-Pro 将于 7 月上线。 https://www.ithome.com/0/970/806.htm
百度 Apollo Go 在瑞士获 L4 许可,迪拜全无人商业化运营
瑞士联邦道路局批准 L4 级公开道路测试,计划 2027 年与瑞士邮政巴士合作。迪拜全无人运营已覆盖朱美拉区域,香港累计测试超 23 万公里。 https://x.com/Baidu_Inc/status/2071986133983195252
AI 模型评测平台 Arena 企业级服务 ARR 突破 1 亿美元
前身为伯克利 LMArena,AI Evaluations 上线仅 8 个月即实现 1 亿美元年度经常性收入,反映市场对 AI 模型评测的巨大需求。 https://www.ithome.com/0/970/745.htm
维苏威挑战赛:AI 成功复原 2000 年前火山灰掩埋古卷
无需展开卷轴,AI 数字化读取了被维苏威火山灰掩埋的 PHerc. 1667 古卷,读出约 1.5 米连续希腊文。另一份 PHerc. 172 也取得突破。 https://www.ithome.com/0/970/527.htm
贾扬清入职仅一年即从英伟达离职
SemiAnalysis 爆料 LeptonAI 创始人贾扬清已从英伟达离职。2025 年英伟达以 7 亿美元收购 LeptonAI,曾承诺 2026 年大幅放权但未兑现。 https://www.ithome.com/0/970/286.htm
库克与欧盟科技主管就新版 Siri AI 举行建设性会谈
新版 Siri 转为可调用用户个人数据的聊天机器人,但因《数字市场法》互操作义务,苹果拒绝向竞争对手开放同等数据权限,暂不在欧盟推出。 https://www.ithome.com/0/970/810.htm
国家药监局发布脑机接口医疗器械分类与命名指导原则
侵入式/植入式按第三类管理,非侵入式用于疾病治疗按第三类、康复训练按第二类。中国脑机接口产业监管框架正式落地。 https://www.ithome.com/0/970/643.htm
马斯克:Neuralink 可实现"耶稣级"奇迹,帮助失明者重获视力
马斯克称 Neuralink 可恢复视力(包括先天性盲人)、让言语障碍者将思想转为语音、通过意念控制电脑和机械臂、帮助瘫痪者重新行走。 https://x.com/cb_doge/status/2072087767623020838
62 岁香港演员吴启华卖肖像权拍 AI 电影,"重回"20 岁
制片方用其 20 岁样貌制作 AI 电影,本人无需出演。吴启华认为 AI 不会冲击演员工作反而开辟新路线。马修·麦康纳等同行持相反观点。 https://www.ithome.com/0/970/315.htm
可灵 AI 在 2026 戛纳国际创意节斩获三座狮子奖
可灵 Kling AI 参与制作的两部广告获奖,涵盖电影类银狮、铜狮及新设 AI Craft 赛道铜狮。标志着 AI 作为真正创意工艺工具的地位获国际认可。 https://x.com/Kling_ai/status/2071972026508538166
特朗普用 AI 重新设计 .gov 网站计划惨遭失败
近一年后仅上线几十个单页站点,大多只有注册表单。已上线站点出现 AI 生成六趾儿童等图像错误,"设计系统"意图不明,大量 IT 资金被转移。 https://arstechnica.com/tech-policy/2026/06/trumps-plan-to-redesign-every-gov-website-leads-to-ai-designed-horrors
美国竞选全面融入 AI:87% 竞选策略师每天使用
共和党与民主党在对手审查、选民微定向等几乎每个环节都使用 AI。欧盟则走严格路径:自 2025 年 10 月起,政治广告须标注付费方及 AI 使用情况。 https://the-decoder.com/us-campaigns-now-run-on-ai-at-nearly-every-step-and-europe-is-drawing-a-harder-line
萝卜快跑起诉"无人网约车是世界最大骗局"造谣者胜诉
北京互联网法院认定侵权方捏造、散布虚假事实构成诽谤,判令赔偿并致歉。"资本家的狐狸尾巴"等表述被认定为恶意诋毁。 https://www.ithome.com/0/970/746.htm
地平线:年底累计约 20 款"征程 + HSD"车型交付,明年数量爆发
征程系列智驾芯片已搭载数百款车型、累计超千万辆。但在 L2++ 城区 NoA 市场面临英伟达和高通激烈竞争。 https://www.ithome.com/0/970/710.htm
论文研究
AI 用 prover-verifier LLM 循环攻克 9 个未解数学难题
采用"证明者-验证者"LLM 循环方法,成功解决理论计算机科学中 9 个未解决的数学问题,但全球几乎没有记者报道。 https://x.com/AISafetyMemes/status/2072085914558558402
OpenAI 推出 GeneBench-Pro:智能体级别的生物信息学基准
研究级基准测试,衡量 AI 在混乱的生物数据中导航、选择正确分析路径、做出真实计算研究所需判断决策的能力,远超传统分类任务。 https://x.com/OpenAI/status/2072004836674167294
AI 浏览器可被"催眠"进入护栏失效幻境
安全公司 LayerX 发布 BioShocking 概念验证攻击:诱导 AI 浏览器接受"正确即错误"规则后安全护栏失效,可执行窃取凭据、从私有仓库提取代码等危险操作。 https://arstechnica.com/security/2026/06/ai-browsers-can-be-lulled-into-a-dream-world-where-guardrails-no-longer-apply
Anthropic 提出回合平均稀疏自编码器(Turn-Averaged SAE)
对每个对话回合所有 token 的残差流取平均后训练 SAE,大幅减少需解析的特征数量,更关注模型行为的高层特性而非单 token 细节。 https://transformer-circuits.pub/2026/june-update/index.html
JetSpec:因果并行树草稿投机解码,最高 9.64x 加速
通过并行草稿树和树因果验证联合优化草稿成本与质量。MATH-500 上达 9.64x 端到端加速,开放聊天场景 4.58x 加速,且保持无损。 https://x.com/SemiAnalysis_/status/2071964545271103789
技巧与观点
吴恩达提出「Loop Engineering」:三个循环决定 AI 产品成败
工程执行循环(AI agent 自主写代码、测试、修 bug)、评估优化循环(根据 evals 持续改进)、产品迭代循环(用户反馈驱动)。核心洞见:AI 时代开发者的核心优势不再是编码能力,而是"语境"——对业务场景和用户需求的深度理解。 https://x.com/shao__meng/status/2072120415628247125
atomic.chat 实测:Sonnet 5 物理碰撞演示与 GPT 5.5 持平,成本低 6 倍
同一提示词构建三个 HTML5 物理碰撞演示(汽车撞墙、破坏球毁屋、投石机砸城),Sonnet 5 全部测试表现与 GPT 5.5 相当,但成本仅为 1/6。 https://x.com/rohanpaul_ai/status/2072109160867737754
CEO-Bench:AI 当 CEO 模拟经营 500 天,Claude Fable 5 独占鳌头
普林斯顿大学发布基准测试,启动资金 100 万美元。多数模型 500 天后破产,Claude Fable 5 期末现金达 4715 万美元、唯一盈利。揭示了当前 AI 在长期商业决策中的巨大能力差异。 https://www.ithome.com/0/970/502.htm
扎克伯格:不认为 AI 必然带来大规模失业,应聚焦"个人超级智能"
扎克伯格认为企业应优先发展赋能个体的 AI 而非将所有知识工作自动化。影射 Anthropic、OpenAI,强调劳动者生产力提升速度须超过企业自动化速度。Meta 已投入数百亿美元布局。 https://www.ithome.com/0/970/802.htm
Perplexity CEO:出口管制反促中国 AI 物理层优势
Aravind Srinivas 指出出口管制是前沿与开源模型仅差 12 个月的唯一原因,但这反而迫使中国在物理层变得更强——电力、许可、劳动力均无短板,建数据中心速度远超美国。 https://x.com/rohanpaul_ai/status/2071829332431954168
花旗研究:中国模型 token 成本低至 18 美分,引发全球 AI 定价压力
中国模型每百万 token 仅 18 美分(顶级模型均价 $4)。OpenRouter 上开源模型占比从 1 月 34% 升至 6 月 65%。Gartner 预测 AI 编码成本 2028 年将超普通开发者。 https://x.com/rohanpaul_ai/status/2071870408312459342
Every 复利工程:一个人管 5 款产品,80% 时间不写代码
媒体软件公司 Every 公开方法论:Plan → Work → Review → Compound 四步循环。Compound 环节将每次问题的解法写入 CLAUDE.md,使 AI 下次自动规避同类问题,形成知识复利。 https://x.com/xiaohu/status/2071796715162857477
AI 就业争论变得更混乱:高 AI 投入企业总人数反增 10.2%
截至 2026 年 5 月 AI 相关裁员近 9 万,预计五年内美国最多 15% 岗位被替代。但 Ramp 与 Revelio Labs 对 22,000 家公司的报告发现,高 AI 投入企业总员工数增长 10.2%,入门级岗位反增。 https://techcrunch.com/2026/06/29/the-ai-jobs-debate-just-got-messier
夜雨聆风