乐于分享
好东西不私藏

2026年最疯狂的两个月:AI军备赛跑失控了

2026年最疯狂的两个月:AI军备赛跑失控了

2026/05/12

星期二 农历四月廿六

MONTHLY NEWS

本月分享

AI 江湖,天才辈出!

OpenClaw爆红全网,一度席卷AI圈,风头无两。热潮退去后,它迅速淡出视野,归于沉寂。

   可平静只是短暂蛰伏,没过多久,AI江湖风云突变,各路模型与智能体扎堆登场,巨头入局、开源混战,行业内卷加剧,瞬间掀起一场你来我往、群雄逐鹿的腥风血雨......

02

04-2026

Google 发布 Gemma 4

号称单位参数量最强开源模型;Cloud Next '26 宣布 260+ 项 AI  Agent 功能.。

05

04-2026

Meta 发布 Llama 4 Scout & Maverick

支持 1000 万 token 超长上下文(全球最长);同期推出 Muse Spark 多模态模型。

07

04-2026

Anthropic 发布 Claude Mythos Preview

启动 Project Glasswing,仅向 12 家顶级科技/安全机构定向开放,用于防御性网络安全;Anthropic 同日发布 244 页系统卡。

07

04-2026

智谱 AI 发布 GLM-5.1

一度登顶开源模型 SWE-Bench Pro 榜首,持续 9 天。

16

04-2026

Anthropic 发布 Claude Opus 4.7

同日推出 Claude Design 可视化创作工具;披露 Opus 4.7 的网络安全能力仍弱于 Mythos。

17

04-2026

xAI 发布 Grok 4.3 Beta

向 SuperGrok Heavy 订阅用户开放。

20

04-2026

Moonshot AI 发布 Kimi K2.6

支持 256K 上下文,支持 300 个子代理并行运行,价格仅  $0.95/$4.00 /M token。

23

04-2026

OpenAI 发布 GPT-5.5

协助发现拉姆齐数新数学证明;价格也只有$5/$30 /M token。

24

04-2026

DeepSeek 发布 DeepSeek V4 Pro

1M 上下文,$0.14 /M token 性价比极高。

03

05-2026

独立 AI 编程大赛

Kimi K2.6 夺冠,小米 MiMo V2-Pro 亚军,GPT-5.5 第三,Claude Opus 4.7 第五

04

05-2026

Anthropic 发布 Claude Security 公测

可用于企业内,主要基于 Opus 4.7 自动扫描代码漏洞并生成修复补丁。

04

05-2026

美国国会提出 AI 数据中心建设暂停法案

指向能耗(29.6 GW)与水资源消耗问题。

05

05-2026

DeepSeek 发布 DeepSeek-V4-Flash

32T token 预训练,1M 上下文,推理成本极低,可用于本地部署的最廉价模型。

Q1:token 是什么? 

A1:大概 1 个英文单词 ≈ 1~1.5 token,1 个中文字 ≈ 1~2 token。100 万 token 大约相当于一本 70 万字的长篇小说。

Q2:$5/$30 /M token什么意思?

A2:$5 = 输入(你发给模型的文字)每 100 万 token 收取 5 美元;$30 = 输出(模型回复你的文字)每 100 万 token 收取 30 美元。

红色注释为定向开放大模型橙色注释为闭源大模型

蓝色注释为开源大模型

四大领域官方排行榜

SVG布局的工具条上可以设置动画各种参数同时可以设置宽高比,达到SVG层和布局内容的完美对齐

文生图

视觉理解

网页开发

综合文本

ENDING

这两个月小鱼真的很震惊,但最惊吓的就是 Anthropic 发布的最顶级大模型 Mythos。

我讲两个关于 Mythos 的 “ 恐怖故事 ” :

第一个故事

你家有条裂缝,从 2009 年开始就有了。你住了 17 年,客人来来往往,亲戚朋友经常来你家,都没有人发现。

但 Mythos 刚进门瞄了一眼就说:“在那儿。”

然后它不只是用手指给你看,而是顺手把裂缝撬开,告诉你从哪里能掏空整栋楼的地基。

这条“裂缝”其实是 FreeBSD 操作系统里的一个 Bug,全球大量服务器都在跑它。黑客只要知道这个,就能从互联网上任意一台电脑拿到服务器的最高权限。

而这些仅仅是 Mythos 一个人找到的。

第二个故事

全球网络安全圈有一个模拟黑客对抗比赛,叫做 CTF,是用来训练顶级安全研究员的。

之前最强的 AI 参加(应该就是 opus-4.6),100 分的题 1 分都拿不到。

你知道 Mythos 考了多少分吗?它考了 73 分。这根本不是进步,简直就是降维打击。

这也是为什么 Anthropic 造出来之后不肯开源,也不肯卖了赚钱的原因,因为他们自己都被吓到了。因为就算再势力的资本家,对于这么恐怖的一个东西所带来的危害,还是会良心发现的。

不管是 Mythos 还是其他各种模型的发布,无一不意味着四、五月份是一场 AI 界的革命性巨变。

很多大模型都从量的积累到了质的飞跃。这听起来是件好事,但对于每一个 AI 领域的从业者来说,虽然门槛变得越来越低,但学习成本和学习迭代速度却会变得更快。

在 AI 洪流的冲刷下,我们更多地应该学会不只是 QA 式地对 AI 进行提问和回答,而是学会如何面对接下来一个最重大的关口——也就是已经存在的 AI Agent模式。这种模式,小鱼将会在下次推文中进一步讲解。

有学习兴趣的伙伴可以私信并与小鱼进行交流讨论。