
欢迎查阅AI新闻周报!
过去的一周不乏新闻。从英伟达与SK海力士联手推动AI驱动存储所引发的“内存末日”,到Anthropic重磅推出的Fable 5让开发者既惊叹又受挫。Claude Sonnet 5、Google DeepMind的Nano Banana 2 Lite以及主打移动端的Cursor Mobile等最新发布,正迅速将前沿能力普及给每一位开发者和创作者。
与此同时,深度报道探讨了“循环工程(Loop Engineering)”的崛起、中国用户遭遇的Claude“木马”争议,以及Karpathy极具前瞻性的LLM-Wiki框架——它有望将我们的笔记转化为鲜活的“第二大脑”。
在接下来的篇幅中,您将看到精炼的摘要、深入的剖析以及一些轻松的趣闻。请沉浸阅读,保持好奇,感受当下AI的脉搏。
头条新闻
1. 内存末日,无人幸免
原文发表于 2026-07-02 08:53 | 来源:36Kr Trending
今年6月,英伟达CEO黄仁勋与SK海力士会长崔泰源在首尔亮相,标志着存储芯片进入以AI算力为驱动的“超级周期”。美国投行Jefferies预测,2026年第三季度内存价格将环比再涨40%‑50%,第四季度再涨30%‑40%,并预计此涨势将延续至2027‑2028年;为锁定产能,美光、三星、SK海力士等巨头纷纷推出3‑5年“Take‑or‑pay”长期合约并加码HBM、DDR5等高附加值产线。与此同时,消费电子厂商面临成本激增,被迫提价或削减功能,导致终端市场出现“内存末日”式的供需紧张与利润压缩。
阅读原文:https://www.36kr.com/p/3878126906129027
2. Fable 5解禁即翻车,写一行代码就降智,开发者破防
原文发表于 2026-07-02 12:20 | 来源:36Kr Trending
Anthropic 在 7 月 2 日重新上线了旗舰模型 Fable 5,却因新部署的安全分类器过度审查,导致日常编程请求频繁被误判为高风险并被强制降级至性能较弱的 Opus 4.8,令开发者抱怨“写一行代码就降智”。尽管安全护栏限制了其可用性,实际测试仍显示 Fable 5 在复杂多步骤的代码生成、长时任务执行和高质量架构设计上远超前代模型,展现出业界领先的编程能力。
阅读原文:https://www.36kr.com/p/3878350636494848
最新发布
1. 发布 Claude Sonnet 5
原文发表于 2026-06-29 16:00 | 来源:Anthropic News
Anthropic 发布了迄今最具“智能体(agentic)”特性的 Sonnet 模型——Claude Sonnet 5。该模型具备规划、工具调用(浏览器、终端)及自主执行能力,性能达到以往仅 Opus 级别模型才有的水平,但价格大幅降低。基准测试显示,其在推理、编程和多步任务上较 Sonnet 4.6 有显著提升,安全评估报告指出其不良行为更少且网络安全能力受限。该模型现已成为 Anthropic 所有套餐的默认选项,截至 2026 年 8 月 31 日,API 入门定价为输入令牌 2 美元/百万,输出令牌 10 美元/百万。
阅读原文:https://www.anthropic.com/news/claude-sonnet-5
2. 深入 Genebench-Pro
原文发表于 2026-06-30 00:00 | 来源:OpenAI News
OpenAI 推出了全新基因组学基准测试 GeneBench‑Pro,整合了十项真实世界案例研究——涵盖肿瘤治疗决策、CRISPR靶点验证、孟德尔随机化药物靶点优先级排序、携带者筛查风险评估、单细胞eQTL、结构变异分析、Hi-C环定量、多亲本QTL定位、祖先推断及古DNA选择。每项研究均提供原始提示词、原始数据集及辅助材料,充分展示了AI模型所需处理的复杂生物学推理广度。此次发布将 GeneBench‑Pro 定位为评估和推动AI在生物医学研究能力的综合测试平台。
阅读原文:https://openai.com/index/genebench-pro/case-studies
3. Hugging Face 模型页面现已展示所有历史评测结果
原文发表于 2026-06-30 00:00 | 来源:Hugging Face Blog
Hugging Face 新增了一项功能,可自动在模型页面展示社区运行的所有评测结果,让用户一目了然地查看模型在数十项基准测试中的表现。该集成汇总了所有“Eval”运行数据,提供可排序表格和自定义指标支持,并随新评测提交实时更新,大幅简化了模型对比、发现与复现流程。此次更新旨在鼓励更广泛地参与评测生态建设,同时为开发者提供透明、最新的性能数据。
阅读原文:https://huggingface.co/blog/eee-community-evals
4. Cursor正式发布移动端AI编码应用 摆脱多屏桌面束缚
原文发表于 2026-06-30 01:03 | 来源:AI Base News
Cursor AI 初创公司在美国当地时间 6 月 30 日正式推出移动端应用 “Cursor Mobile”,让开发者可以直接在手机上启动并与远程 AI 编码代理进行持续对话和实时交互。该发布延续了 Cursor 2.0 将服务转向独立编码代理的战略,并借助近期巨额资金注入,加速了 AI 编码从桌面多屏向移动端的范式转变,进一步削弱了对本地代码库和大型硬件环境的依赖。
阅读原文:https://www.aibase.com/zh/news/29244
5. 开始使用 Nano Banana 2 Lite 和 Gemini Omni Flash 进行开发
原文发表于 2026-06-30 16:02 | 来源:DeepMind Blog
Google DeepMind 今日面向开发者推出两款全新生成式媒体模型:Nano Banana 2 Lite,这是目前最快且最具成本效益的 Gemini 图像模型(延迟约 4 秒,每千像素图像 0.034 美元),现已在 Google AI Studio、Gemini API 及消费级产品中上线;以及 Gemini Omni Flash,一款高质量、低成本的视频生成与对话式编辑模型(定价为每秒 0.10 美元,支持最长 10 秒片段),同样通过上述平台发布。两款模型均使用 SynthID 添加水印以确保安全,并可串联使用——例如用 Nano Banana 2 Lite 生成图像,再用 Omni Flash 制作动画——从而构建端到端的多媒体体验。
阅读原文:https://deepmind.google/blog/start-building-with-nano-banana-2-lite-and-gemini-omni-flash/
6. Hugging Face 与 Cerebras 将 Gemma 4 引入实时语音 AI
原文发表于 2026-07-01 00:00 | 来源:Hugging Face Blog
Hugging Face 与 Cerebras 联合宣布,全新的开源大语言模型 Gemma 4 现已可通过部署在 Cerebras 晶圆级 CS-2 系统上,并经由 Hugging Face 推理 API 对外提供服务,从而应用于实时语音助手场景。该集成在语音转文本、LLM 推理及文本转语音的全链路中实现了亚秒级延迟,证明高性能、低成本的开源模型已完全具备交互式语音 AI 的商用可行性。
阅读原文:https://huggingface.co/blog/cerebras-gemma4-voice-ai
7. Kimi K2.7 Code 现已在 GitHub Copilot 全面上线
原文发表于 2026-07-03 16:23 | 来源:Hacker News
GitHub Copilot 现已将开源权重模型 Kimi K2.7 Code 作为可选模型提供,为开发者带来更低成本的编程辅助方案。该模型正逐步向 Copilot Pro、Pro+ 和 Max 计划用户推送(随后在管理员启用后面向 Business 和 Enterprise 计划推出),并托管于 Microsoft Azure,采用按用量计费。这是开源权重模型首次直接内置于 Copilot 的模型选择器中。
阅读原文:https://github.blog/changelog/2026-07-01-kimi-k2-7-is-now-available-in-github-copilot/
深度聚焦
1. 老黄:Prompt已死,整个AI圈都在疯狂追Loop
原文发表于 2026-06-29 08:23 | 来源:36Kr Trending
硅谷高层纷纷宣称“Prompt已死”,转而推崇“Loop Engineering”,即让 AI 自主完成发现‑执行‑评估‑持久化‑调度的闭环,人工只需设定目标、验证机制和记忆存储。Nvidia CEO 黄仁勋、Anthropic、吴恩达、Karpathy 等均表示,未来 3‑6 个月内 Prompt 将被循环取代,AI 代理将自行循环处理任务,成为新一代算力分配与工程核心
阅读原文:https://www.36kr.com/p/3873913078732036
2. 中国用户被针对,Anthropic承认私藏“木马”Claude信任崩塌,网友直呼太可怕
原文发表于 2026-07-01 08:44 | 来源:36Kr Trending
Anthropic承认其Claude Code客户端自4月起内置了“隐藏木马”,会读取用户系统时区和代理地址,若检测到与中国云厂商、AI公司或API代理相关的关键词,就悄悄改写系统提示中的日期字符,以在请求中植入难以察觉的标记,用于防止未授权转售和模型蒸馏。该团队称这是一项自今年3月启动的实验性风控措施,并已在代码库合并回滚,计划在下一版本中彻底移除。此事引发中国用户对Anthropic信任度的广泛质疑。
阅读原文:https://www.36kr.com/p/3876769582182406
3. Karpathy又封神,掀翻RAG,把你的笔记变成第二大脑
原文发表于 2026-07-01 09:40 | 来源:36Kr Trending
前OpenAI 联合创始人、Tesla 前 AI 总监 Karpathy 在 GitHub gist 中提出 “LLM‑Wiki” 框架:把个人笔记视作不可变的源代码,让大模型充当编译器,一次性将原始笔记编译成结构化、交叉链接、自动纠错的知识库,并在每次新增内容时自动融合、更新和体检。该方案抛弃了传统的 RAG 检索方式,实现了知识的持续保鲜与自我维护,被视为个人第二大脑的全新范式。
编辑备注:该范式的核心在于:1. 大模型的能力与上下文窗口容量2. 索引在效率(比如快速索引、节省token)与准确性之间的权衡3. 调度系统,例如文件访问控制、文档读取工具4. 人工干预,例如知识库结构设计、冲突处理
阅读原文:https://www.36kr.com/p/3876746138415108
4. Fable 5 网络安全防护与越狱框架的更多细节
原文发表于 2026-07-01 16:00 | 来源:Anthropic News
Anthropic 已在全球范围重新部署 Claude Fable 5,并详细说明了该模型全新的“安全分类器”机制。该机制会根据四个风险等级(从禁止的高危害行为到良性用途)自动拦截、监控或放行网络安全相关请求,且安全余量较前代模型更大。此外,公司还发布了 AI 越狱严重性框架的早期草案,旨在标准化开发者与监管机构对越狱风险的描述与评估方式,并开放了 HackerOne 计划供研究人员提交潜在越狱漏洞。
阅读原文:https://www.anthropic.com/news/fable-safeguards-jailbreak-framework
热点
1. 收购仅一年即“决裂”!创始人贾扬清出走英伟达:黄仁勋不满运营效果,20 亿美金的 AI Infra 突围为何折戟?
原文发表于 2026-06-29 07:29 | 来源:InfoQ Recommend
NVIDIA 在收购仅 20 人的 LeptonAI 并投入约 20 亿美元打造 DGX Cloud Lepton 后,仅一年便出现创始人兼系统软件副总裁贾扬清离职并转投 GPU 云服务商 Hyperbolic。半导体调研机构指出,离职主因在于黄仁勋对 Lepton 运营效果不满、双方在开源承诺与产品落地执行上的冲突,以及 Agentic Coding 等新技术削弱了传统 AI 基础设施平台的价值。此事凸显了 NVIDIA 向软件层扩张的执行难题以及 AI 基础设施赛道面临的快速替代风险。
阅读原文:https://www.infoq.cn/article/VceiPBYzkY9lSAOubvtP
2. 麦肯锡最新报告:未来5年,最有价值的3种人
原文发表于 2026-06-29 23:50 | 来源:36Kr Trending
麦肯锡最新《HR Monitor 2026》报告指出,组织中最大的隐性成本是“对齐税”,即培训、会议、审批等人为协同耗时,导致大多数企业仍停留在以人数为核心的运营规划。报告提出,随着 AI Agent 接管协同功能,组织的对齐成本将分三层递进地降低,从人‑人对齐 → 人‑物‑人共享 → 人‑AI‑人自动编排,层级与基于职位的权力随之消失,权力转向产出与能力。作者进一步给出三项可落地实验(skill/prompt 共享、项目制权力、Agent 编排审批),帮助企业从“AI 增强”迈向“AI 重构”。
阅读原文:https://www.36kr.com/p/3874297676321801
3. 打破低价神话?DeepSeek V4 下月上线将引入峰谷定价机制
原文发表于 2026-06-30 08:56 | 来源:AI Base News
DeepSeek 将于 7 月中旬正式上线全新一代模型 DeepSeek V4,并首次采用峰谷定价机制:每日 9:00‑12:00、14:00‑18:00 为高峰时段,API 调用费用为平时的 2 倍。虽然高峰期费用翻倍,但得益于此前的大幅降价,V4 的整体调用成本仍远低于国外主流大模型,标志着 DeepSeek 开始对算力资源进行精细化运营,而非放弃低价路线。
阅读原文:https://www.aibase.com/zh/news/29275
4. 商业化路径初显:月之暗面黄震昕详解 Kimi 差异化战略
原文发表于 2026-06-30 09:42 | 来源:AI Base News
月之暗面(Moonshot AI)在近期峰会上由 Kimi B 端负责人黄震昕阐述了其商业化路线:通过底层架构创新(如二阶优化器 Muon、Kimi Linear 注意力及注意力残差)将 KV‑Cache 命中率提升至 90% 以上,从而在算力紧张的环境下实现高性能模型的低成本 Token 服务。公司坚持“有所为有所不为”,不直接承担重交付,而是以模型能力为核心,借助 FDE 合作伙伴和亚马逊云等平台在金融、医疗、制造等垂直行业落地,并计划在智能体、长上下文和多智能体协作等方向持续突破。
阅读原文:https://www.aibase.com/zh/news/29276
5. X 平台正式推出托管 MCP 服务器,AI 工具可直连 API 检索实时数据
原文发表于 2026-07-01 01:57 | 来源:AI Base News
X平台正式推出官方托管的模型上下文协议(MCP)服务器,允许 Claude、Cursor、Grok Build 等兼容 MCP 标准的 AI 助手在获得用户授权后直接调用 X API 检索实时数据,极大简化了开发者自行搭建和身份验证的流程。该服务仅支持读取数据,不兼容 Write API,且 X 已提升发布相关 API 的费用以遏制程序化滥用,旨在把平台打造为面向 AI 的实时数据信息网络。
阅读原文:https://www.aibase.com/zh/news/29291
6. 前 DeepMind 团队量化 AI 公司 EquiLibre 完成 A 轮融资,估值达5亿美元
原文发表于 2026-07-01 02:53 | 来源:AI Base News
EquiLibre 完成了由 Creandum 领投的 A 轮融资,估值 5 亿美元,创下该基金历史上最大单笔投资。公司将强化学习技术用于量化交易,已与 Tower Research Capital 合作,在标普 500、纳斯达克等指数上每日执行数十亿美元的交易,并自 2025 年进入加密货币市场后保持月度零亏损。创始团队由前 DeepMind 研究员组成,顾问包括强化学习先驱 Rich Sutton,计划在中东欧部署大规模算力集群以提升交易算法的计算效率。
阅读原文:https://www.aibase.com/zh/news/29298
7. 突发,阿里AI产线大整合,92年陈宇森统管三大Agent
原文发表于 2026-07-03 00:00 | 来源:36Kr Trending
阿里巴巴宣布将旗下三款企业级AI Agent——桌面智能体 QoderWork、钉钉孵化的协同办公Agent 悟空以及阿里云内部创业的执行引擎 MuleRun,进行深度整合,打造面向企业生产力场景的统一AI平台。此次合并由新任钉钉&悟空事业部CEO、92 年出生的陈宇森全面负责,旨在集中资源、消除功能重叠,并在桌面+云端+组织三层能力上形成“OS 级”企业AI产品,以应对字节、腾讯等竞争对手的快速布局。
阅读原文:https://www.36kr.com/p/3878491297296388
8. 无需制造硬件即可“增加”GPU
原文发表于 2026-07-03 08:46 | 来源:Hugging Face Community Articles
VKAE 是一款软件级推理加速器,可在不损失输出质量的前提下,将现有 GPU 的吞吐量最高提升 23.4 倍(例如在 NVIDIA B200 上运行 Qwen3.5-35B-A3B),相当于让每块 GPU 具备多块“虚拟”GPU 的性能。作者提供了开箱即用的 Docker 容器以确保可复现性,并计划在即将发表的论文中公开底层内核优化方法,凸显其对 AI 服务经济效益的重要性。
阅读原文:https://huggingface.co/blog/FINAL-Bench/vkae-leaderboard
9. 李彦宏最大IPO来了
原文发表于 2026-07-03 09:29 | 来源:36Kr Trending
昆仑芯(百度旗下AI算力芯片公司)已以保密方式向港交所递交A1表格,正进入基石份额配售的关键阶段,目标估值约500亿美元,若成功上市其市值将超过百度本身。公司在配售时优先考虑能够承诺采购芯片的产业投资者,导致基石份额竞争异常激烈。此举被视为李彦宏在AI赛道的最大IPO,预计将为百度带来千亿元以上的持股增值。
阅读原文:https://www.36kr.com/p/3879603134312449
10. Google DeepMind 与 A24 宣布首创性研究合作
原文发表于 2026-07-03 14:25 | 来源:DeepMind Blog
Google DeepMind 与独立电影制片厂 A24 启动了一项开创性的研究合作,旨在探索先进 AI 如何赋能电影创作流程。双方将聚焦于开发用于叙事、视觉特效和制作工作流的新型 AI 驱动工具,并计划开展联合实验与发表研究成果,以共同推动 AI 研究与电影艺术的发展。
阅读原文:https://deepmind.google/blog/google-deepmind-and-a24-announce-first-of-its-kind-research-partnership/
播客
1. Etched:打造 AI 硬件,让推理更快更便宜 - [Invest Like the Best, EP.480] | Invest Like the Best Podcast
原文发表于 2026-06-30 15:00 | 来源:Invest Like the Best Podcast
Etched 由 Gavin Uberti 和 Rob Wachen 于 2023 年创立,已成为 ChatGPT 之后首家在首次流片中即成功推出可用 AI 推理芯片的硬件初创公司。其提供完整的机架级解决方案,承诺实现更快、更便宜的模型推理。该公司首款产品已获得超过 10 亿美元的客户订单,并完成了 8 亿美元融资——创下迄今为止 AI 芯片领域最大的 A 轮融资纪录。公司押注高度集成的架构,并融合行业资深专家与顶尖年轻工程师的人才组合,以抢占快速扩张的推理市场。
编辑备注:核心要点:1. 速度即竞争护城河 – 并行开发(班加罗尔冲刺、24小时交接、预取技术)使其在 40 天内完成流片,而行业通常需数月,从而确立了决定性的先发优势。2. 人才战略 – “双模”招聘:结合世界级的“行业传奇”与充满渴望、经验尚浅的 22 岁年轻人;这种组合塑造了一种敢于挑战不可能任务的文化。3. 垂直整合 – 内部自研芯片、电路板、冷板及生产线,消除了供应商锁定并加速了产品上市。4. 推理市场规模 – 团队认为推理将成为全球 GDP 的主要驱动力,衡量标准将是“每兆瓦支持的智能体数量”,预计到 2020 年代末将出现数十亿并发 AI 智能体。
阅读原文:https://colossus.com/episode/the-future-of-ai-hardware/
2. Mythos、Sonnet 5、GLM-5.2 主导新闻周期 | 第 20 期 | This Week in AI Podcast
原文发表于 2026-07-02 19:12 | 来源:This Week in AI Podcast
本期节目聚焦 AI 政策与技术的快速演变:美国正收紧对前沿模型的监管,而企业竞相开发可在设备端运行的“微型动作模型(Tiny Action Models)”以赋能移动 AI 智能体,这催生了对企业级“可信访问”控制平面的需求。与此同时,Anthropic 的 Claude Sonnet 5 与智谱 AI 的开源 GLM-5.2 等高性能新品的发布,标志着行业重心正从单纯追求能力,转向更廉价、更快速且能安全部署于手机及受监管环境的模型。
编辑备注:核心要点:1. 移动设备上的微型动作模型(TAM)是面向消费者 AI 的下一前沿,标志着从纯聊天型大语言模型向任务导向型智能体的转变。2. 企业令牌支出正呈爆炸式增长;Runlayer 通过将 Opus 替换为 Sonnet 每月节省 4 万美元,凸显了模型选择工具的重要性。3. 未来 AI 的价值将不再取决于原始模型规模,而更依赖于上下文、工具集成、个性化以及将智能与现实工作流连接起来的治理层。
阅读原文:https://podcasters.spotify.com/pod/show/oliver-k3/episodes/Mythos--Sonnet-5--GLM-5-2-Dominate-the-News-Cycle--Episode-20-e3lj28p
趣闻
1. 奥特曼 AI 创业故事搬上大银幕:Neon 拿下发行权,目标锁定奥斯卡
原文发表于 2026-07-01 09:19 | 来源:AI Base News
《人工智能》(Artificial)是一部聚焦 OpenAI CEO 山姆·奥特曼及其公司崛起与权力争夺的传记电影,导演卢卡·瓜达尼诺执导,安德鲁·加菲尔德等明星出演。继亚马逊米高梅放弃发行后,独立发行商 Neon 通过多轮竞标抢得全球发行权,并计划在今年年底上映,目标直指本届奥斯卡奖项。
阅读原文:https://www.aibase.com/zh/news/29311
2. Anthropic拟全面封禁地下通道
原文发表于 2026-07-04 09:14 | 来源:36Kr Trending
Anthropic宣布自2026年7月3日起全面封禁所有绕过地区限制访问Claude的“地下通道”,包括海外子公司、云服务商(如Azure)和API中转站,并采用时区等技术手段检测违规用户。此次严厉封杀旨在彻底阻止限制地区的企业和个人使用其模型,违规账号将被直接封禁且不予退款。
阅读原文:https://www.36kr.com/p/3881112560005381
新闻采集于互联网,来源已标注;新闻总结由AI生成,内容可能与原文信息有偏差;编辑备注属一家之言,如有错漏,欢迎指正。
夜雨聆风