乐于分享
好东西不私藏

�� AI 日报|2026-05-10 DeepSeek与阿里合作终止

�� AI 日报|2026-05-10 DeepSeek与阿里合作终止

✨ 今日趋势:AI浪潮涌动,创新与变革并行。

🔥 主编导语(Top 3 必看)

  1. Anthropic举办“Code with Claude”会议,探讨AI与代码的未来
  2. DeepSeek与阿里合作终止,市场热议;百度发布新模型,技术实力再升级
  3. Strukto推出Mirage,统一虚拟文件系统助力AI代理发展

导语:AI技术发展日新月异,从代码到模型,从合作到政策,行业动态持续更新,为读者带来最新资讯与趋势洞察。

🔥 近期热文

📰 中文热点

Anthropic正推进新一轮融资,估值或将突破9000亿美元 - 品牌方舟BrandArk

📝 Anthropic正积极进行新一轮融资,预计估值将大幅提升至9000亿美元以上,这一进展备受市场关注。

🔗 Google News Claude中文

DeepSeek据悉拟融资500亿元 6月推出V4.1 - 新浪财经

📝 DeepSeek计划于6月推出V4.1版本,并正寻求融资500亿元,以扩大其市场影响力。

🔗 Google News DeepSeek中文

剥夺大模型执行权!港中文开源Agent治理内核,高危拦截率达92.95% - 新浪财经

📝 香港中文大学开源的Agent治理内核成功剥夺大模型执行权,其高危拦截率高达92.95%,为AI安全治理提供新方案。

🔗 Google News 中国AI

🌐 海外热点

Open Source AI App Store Screenshot Designer

📝 开源AI应用商店截图设计器Open Source AI App Store Screenshot Designer上线,提供便捷的AI应用截图制作服务,旨在简化开发者展示应用功能。

🔗 https://ai-app-store-screenshots.vercel.app/

Anthropic Signs SpaceX Colossus 1 Data Center to Boost Capacity - ServeTheHome

📝 Anthropic与SpaceX合作,签约Colossus 1数据中心以增强其数据处理能力,旨在提升服务性能。

🔗 Google News Anthropic

Anthropic NLAs translate LLM activations to human-readable text for safety

📝 Anthropic推出NLAs技术,将大型语言模型激活转换为人类可读文本,以保障安全。该技术旨在提升LLM应用的安全性,确保输出内容更易于理解和监管。

🔗 https://presciente.com/edition/78

🏢 大厂动态

Anthropic's "Code with Claude" Conference - galvnews.com

📝 Anthropic举办“Code with Claude”会议,探讨人工智能与编程领域的最新进展。

🔗 Google News Anthropic

DeepSeek和阿里谈崩?市场人士回应;8车企辟谣“被约谈”名单;SK海力士回应员工人均奖金610万元;百度发布新模型丨每经早参 - 搜狐网

📝 DeepSeek与阿里合作谈崩,市场人士解读原因;八家车企否认被约谈;SK海力士澄清员工奖金情况;百度发布新型人工智能模型。

🔗 Google News DeepSeek中文

云南发布10项重点任务,事关“人工智能+医疗卫生”应用 - 新浪财经

📝 云南推出10项重点任务,旨在推动人工智能在医疗卫生领域的应用,新浪财经报道。

🔗 Google News 中国AI

《人工智能终端智能化分级》系列国家标准发布宣贯会在京召开 - 新京报

📝 《人工智能终端智能化分级》系列国家标准在京发布,宣贯会聚焦行业规范与发展。

🔗 Google News 中国AI

💰 融资与创业

Mirage · Unified Virtual Filesystem for AI Agents – Strukto

📝 Strukto公司推出统一虚拟文件系统Mirage,旨在为AI代理提供更高效的数据管理解决方案,支持多平台操作。该系统目前处于测试阶段,预计将极大提升AI数据处理的效率。

🔗 https://www.strukto.ai/mirage

估值逼近1万亿美元!全球最值钱的AI创企,要易主了 - 36kr.com

📝 Google News Claude中文发布了「估值逼近1万亿美元!全球最值钱的AI创企,要易主了 - 36kr.com」。核心内容显示,估值逼近1万亿美元!全球最值钱的AI创企,要易主了    36kr.com。整体来看,技术迭代与商业化推进正在同步加速。

🔗 Google News Claude中文

Why an AI Insurance Unicorn Opened a 24/7 Café to Win Customers - inc.com

📝 一家AI保险独角兽公司为吸引顾客,开设了全天候咖啡馆。通过提供便捷服务,该公司旨在提升用户体验,增强品牌形象。

🔗 Google News AI Funding

Stale Gov.uk pages are feeding AI overviews old data and Brits are believing it

📝 英国政府网站过时的页面数据被用于AI概述,导致英国民众误信旧信息,政府承认此情况并称其为“AI煤气灯效应”。

🔗 https://www.theregister.com/software/2026/04/23/govuk-says-ai-gaslighting-brits-with-stale-govuk-data/5229766

Broadcom reportedly won't build OpenAI's custom chip unless Microsoft buys 40 percent of them

📝 Broadcom拒绝为OpenAI定制芯片项目提供资金,除非微软承诺购买40%的芯片,但微软尚未同意。OpenAI经理Sachin Katti认为这种依赖性“财务上不具备吸引力”,该项目第一阶段成本约180亿美元。

🔗 https://the-decoder.com/broadcom-reportedly-wont-build-openais-custom-chip-unless-microsoft-buys-40-percent-of-them/

🔬 技术进展

model: add sarvam_moe architecture support by sumitchatterjee13 · Pull Request #20275 · ggml-org/llama.cpp

📝 Reddit LocalLLaMA社区用户sumitchatterjee13提交了Pull Request #20275,为ggml-org/llama.cpp添加了Sarvam-30B和Sarvam-105B两种MoE架构支持。Sarvam-30B和Sarvam-105B均为先进的MoE模型,分别拥有2.4B和10.3B的活跃参数,适用于资源受限环境,具备出色的推理、编码和对话能力,尤其在印度语言领域表现卓越。

🔗 https://www.reddit.com/r/LocalLLaMA/comments/1t8db1j/model_add_sarvam_moe_architecture_support_by/

NVIDIA AI Releases Star Elastic: One Checkpoint that Contains 30B, 23B, and 12B Reasoning Models with Zero-Shot Slicing

📝 NVIDIA研究人员推出Star Elastic,一种后训练方法,将多个嵌套推理模型嵌入单个检查点,包含30B、23B和12B参数规模,无需为每个变体单独训练或存储模型权重。该方法基于Nemotron Elastic框架,应用于Nemotron Nano v3,单次160B-token运行训练所有三个变体,相比从头开始预训练每个模型,实现360倍token减少。Star Elastic引入弹性预算控制,一种新颖的推理方案,使用较小的子模型进行思考阶段,完整模型用于最终答案,相比标准预算控制,提供高达16%更高的准确率和1.9倍更低的延迟,同时嵌套FP8和NVFP4检查点将完整模型家族纳入RTX级GPU的范畴。

🔗 https://www.marktechpost.com/2026/05/09/nvidia-ai-releases-star-elastic-one-checkpoint-that-contains-30b-23b-and-12b-reasoning-models-with-zero-shot-slicing/

"OncoAgent: A Dual-Tier Multi-Agent Framework for Privacy-Preserving Oncology Clinical Decision Support"

📝 HuggingFace Blog发布新研究,提出名为OncoAgent的双重层级多智能体框架,旨在保护隐私的同时提升肿瘤学临床决策支持系统的准确性。

🔗 https://huggingface.co/blog/lablab-ai-amd-developer-hackathon/oncoagent-official-paper

Fields Medalist says ChatGPT 5.5 Pro delivered "PhD-level" math research in under two hours with zero human help

📝 Fields Medal得主Timothy Gowers使用ChatGPT 5.5 Pro在不到两小时内完成了数论领域的“博士水平”数学研究,模型在一小时内将指数界限改进为多项式界限,MIT研究者称其关键想法“完全原创”,Gowers认为数学贡献的标准现在变成了证明LLM无法做到的事情。

🔗 https://the-decoder.com/fields-medalist-says-chatgpt-5-5-pro-delivered-phd-level-math-research-in-under-two-hours-with-zero-human-help/

What is an average publication outcome for an ML PhD? [D]

📝 Reddit上,一位机器学习博士研究生询问同行们,对于机器学习领域的博士毕业生而言,平均的论文发表数量是多少,例如3-5篇顶级会议的第一作者论文是否属于平均水平,引发了对该领域学术成果评价标准的讨论。

🔗 https://www.reddit.com/r/MachineLearning/comments/1t8bnmp/what_is_an_average_publication_outcome_for_an_ml/

🌍 开源生态

TensorZero Emphasizes AI Scaling, Open-Source Security, and Evolving Talent Strategy in Weekly Update - TipRanks

📝 TensorZero在最新周报中强调人工智能规模扩展、开源安全及人才战略演变。

🔗 Google News AI Open Source

Exactly a year ago, I started working on an MCP server I launched on reddit that became by far my most active open source project!

📝 一年前,Reddit用户Taylor Wilsdon启动了一个MCP服务器,如今已成为他最活跃的开源项目。该项目从当初的“野西”发展到如今,支持在Mac mini上运行gemma4或qwen3.6,并采用本地模型工具调用,效率大幅提升。

🔗 https://www.reddit.com/r/LocalLLaMA/comments/1t8olv3/exactly_a_year_ago_i_started_working_on_an_mcp/

9 Best AI Tools for Spec-Driven Development in 2026: Kiro, BMAD, GSD, and More Compare

📝 2026年,AI技术在Spec-Driven Development领域取得显著进展,工程社区分为两派:一派迭代提示,一派先写结构化规范。本文介绍了9款推动这一变革的AI工具,包括AWS Kiro的EARS-structured spec IDE和GitHub Spec Kit的93K星开源工作流程。

🔗 https://www.marktechpost.com/2026/05/08/9-best-ai-tools-for-spec-driven-development-in-2026-kiro-bmad-gsd-and-more-compare/

Supermicro-tied execs used Thailand government entity to ship Nvidia AI GPUs to China — report alleges Chinese web giant Alibaba received restricted servers - Tom's Hardware

📝 据报道,Supermicro关联高管利用泰国政府实体将Nvidia AI GPU运往中国,涉嫌违反出口限制,中国互联网巨头阿里巴巴收到受限服务器。

🔗 Google News AI Open Source

⚖️ 政策监管

两项AI政策发布,范式智能战略布局与产业方向高度契合

📝 近日,两项AI政策发布,旨在推动范式智能战略布局与产业方向高度契合,聚焦电力交易、能源调度、智能预测与决策等场景,探索AI应用落地。

🔗 https://www.qbitai.com/2026/05/415019.html

Understanding Annotator Safety Policy with Interpretability

📝 研究指出,标注者安全政策定义了何为安全与不安全的AI输出,但标注者间存在普遍的分歧,可能源于操作失败、政策模糊或价值多元。为解决这一问题,研究者引入了标注者政策模型(APMs),通过学习标注者的标注行为来揭示其内部安全政策,从而提高标注政策设计的透明度和包容性。

🔗 https://arxiv.org/abs/2605.05329

📌 其他

Anyone Trying to submit for ICML FM4LS workshop but noticed link closed Early? [D]

📝 在Reddit上,有用户发现ICML FM4LS workshop的提交链接提前关闭,尽管官网显示的截止日期是5月9日。用户询问是否有人遇到同样问题,并询问是否有遗漏的沟通信息。

🔗 https://www.reddit.com/r/MachineLearning/comments/1t8nks7/anyone_trying_to_submit_for_icml_fm4ls_workshop/

Threats by artificial intelligence to human health and human existence (2023)

📝 一篇题为《人工智能对人类健康和存在的威胁》的文章在HackerNews AI上发表,探讨了人工智能可能对人类健康和生存带来的风险,引发关注。

🔗 https://gh.bmj.com/content/8/5/e010435

播放破亿的 AI 短片,名场面是一个「穿帮镜头」| 对话《纸手机》主创

📝 AI短片《纸手机》播放量突破亿级,其名场面“穿帮镜头”引发热议,讲述了一个小男孩攒钱为奶奶烧手机的故事,令人动容。

🔗 https://www.ifanr.com/1661163?utm_source=rss&utm_medium=rss&utm_campaign=

📌 结语

每天5分钟,掌握AI行业关键变量。欢迎关注公众号,我们一起见证智能时代。

💬 你最关心哪个方向?留言告诉我👇