乐于分享
好东西不私藏

「每日AI梗」| 安德烈·卡帕西加入Anthropic (卡帕西跳槽),Gemini Omni全能模型发布 (Omni全能),ChatGPT图像生成(15亿张图)

「每日AI梗」| 安德烈·卡帕西加入Anthropic (卡帕西跳槽),Gemini Omni全能模型发布 (Omni全能),ChatGPT图像生成(15亿张图)

哈喽,大家好,我是继词客。

每天精选3个AI热梗,让你秒懂AI圈,聊天不落后!


🔥梗01 卡帕西跳槽

AI界的「转会窗」开了,卡帕西这一跳,比姆巴佩去皇马还炸。

小小梗儿哪里来

安德烈·卡帕西加入Anthropic

AI领域知名专家安德烈·卡帕西宣布加入人工智能安全公司Anthropic。卡帕西此前曾是特斯拉自动驾驶AI负责人及OpenAI联合创始人,此次加盟标志着顶尖人才向AI安全与对齐研究领域的新一轮流动。来自:Hacker News 热门[1]

其中道理摊开来

卡帕西是谁?OpenAI联合创始人特斯拉Autopilot架构师AI教育界顶流——YouTube上教百万人学神经网络的男人。他没回老东家OpenAI,而是选了Anthropic,这就像梅西不去巴萨回归,反而跑去拜仁。核心信号:AI安全和对齐正在从边缘走向C位,连最硬核的技术大佬都觉得,「让AI听话」比「让AI更强」更值得干。

为啥好笑乐开怀

马斯克都忍不住点赞Anthropic——自家xAI的人跑了,他搁这夸对手,画面太美
OpenAI的群聊里估计已经炸了:「兄弟你回来啊」「不了,我现在是安全人了」
一个人跳槽,三个公司都上热搜:OpenAI丢了人、Anthropic赢了面、xAI的老板在围观

日常唠嗑随手来

朋友说跳槽去对手公司:「你这波卡帕西啊」
同事选了冷门方向:「人家卡帕西也选了安全对齐,别小看」
面试被问为什么选我们:「因为你们是Anthropic,不是OpenAI」(慎用)

AI干货讲明白

AI对齐(Alignment)是让AI按人类意图行事的研究方向。Anthropic由OpenAI前VP Dario Amodei创立,专注AI安全。卡帕西的选择暗示:前沿LLM研究的下一个主战场不在「更大更强」,而在「更可控更安全」。安全对齐正从学术圈走向产业核心——这是AI从「能用」到「敢用」的关键一步。


🔥梗02 Omni全能

谷歌今天发了个模型,叫Omni——翻译成人话就是「啥都行」。

小小梗儿哪里来

Gemini Omni全能模型发布:可从任意输入生成任意输出,一句话让AI修改视频

在2026年谷歌I/O开发者大会上,谷歌正式推出Gemini Omni模型。"Omni"意为全能,能够无缝处理文本、图像、音频和视频等多种信息模态,实现"从任何输入生成任何输出"。其核心亮点在于支持对话式编辑,用户可通过自然语言指令轻松修改视频元素。来自:IT之家[2]

其中道理摊开来

Omni就是「全能」的意思。以前AI模型是专才——文生文、图生图、视频生视频,各管一摊。Gemini Omni直接打通所有模态,你给它一段视频+一句话,它就能按你说的改视频。任意输入→任意输出,这六个字是今天谷歌I/O的核弹。想象一下:你对着手机说「把背景换成海滩」,视频就真换了——不是滤镜,是AI重新理解并生成。

为啥好笑乐开怀

以后跟朋友吹牛可以改视频当证据:「你看我昨天真在海边」
谷歌的命名越来越离谱:Gemini → Gemini Pro → Gemini Ultra → Gemini Omni,下一步是不是Gemini Everything?
OpenAI刚秀完15亿张图/周,谷歌直接:「我改视频」

日常唠嗑随手来

看到离谱视频:「Omni生成的吧?」
朋友问你能干啥:「Omni,啥都行」(说的时候要自信)
老板要求改方案:「给我一秒钟,Omni一下」

AI干货讲明白

多模态生成指一个模型同时理解和生成文本、图像、音频、视频等多种内容。Gemini Omni的核心突破是统一架构——不再需要分开的模型处理不同任务,而是一个模型搞定所有。它还具备物理推理能力,不仅生成画面,还能推断「接下来该发生什么」,这是从生成式AI世界模型的关键跳跃。Flash版已上线,Pro版即将推出。


🔥梗03 15亿张图

ChatGPT一周生成15亿张图,人类画师集体沉默。

小小梗儿哪里来

ChatGPT图像生成周使用量突破15亿次

人们每周在ChatGPT中生成超过15亿张图像。研究员@kenjihata与产品负责人@adele__li及主持人@AndrewMayne一起,探讨自Images 2.0发布以来出现的新用例和趋势。来自:X:OpenAI[3]

其中道理摊开来

15亿张/周,什么概念?全人类专业画师一年画的图加起来,可能还不到ChatGPT一周的零头。自从ChatGPT的Images 2.0上线,Ghibli风格头像、表情包、梗图、PPT配图……所有你能想到的视觉需求都在被AI吃掉。这数字不是技术炫耀,而是一个信号:AI图像生成已经从尝鲜变成了日常工具,就像手机拍照取代数码相机一样不可逆。

为啥好笑乐开怀

15亿张图/周,平均每秒2500张——你眨个眼的功夫,AI已经画了一幅蒙娜丽莎
设计师朋友说:「我没失业,我只是改行当AI提示词工程师了」
以后博物馆可以开个展:「人类画的图(2026年前)」

日常唠嗑随手来

看到好看的头像:「ChatGPT画的吧?」「不,我画的」「那更厉害了」
朋友炫耀P图技术:「Out了,现在都是AI直出」
画师朋友说接不到单:「15亿分之一,你竞争的是这个数字」

AI干货讲明白

ChatGPT的Images 2.0基于扩散模型(Diffusion Model),核心原理是从纯噪声逐步去噪还原出图像。15亿/周的使用量意味着扩散模型已规模化落地。这个数字背后还有一个关键:吉卜力风格等特定美术风格的AI生成在版权层面引发巨大争议——AI「学会」了画风,但画师没拿到一分钱。AI图像版权将是下一个法律战场。


📌 今日总结 三个梗串起来就是今天AI圈的完整剧本:人才流动看卡帕西——大佬用脚投票,AI安全赛道正式出圈;技术突破看Omni——谷歌一记重拳,多模态生成进入「啥都行」时代;规模化落地看15亿张图——AI不是未来,是正在发生的现在。安全对齐多模态统一规模化应用,三条线同时拉满,2026年AI的格局已经清晰了。


谢谢你看我的文章,「继词客」是一位AI科技的门童——不是导师也不是专家,就是站在门口,帮你推开那扇门,然后陪你一起走进去。


参考链接

[1] Hacker News 热门: https://twitter.com/karpathy/status/2056753169888334312

[2] IT之家: https://www.ithome.com/0/952/519.htm

[3] X:OpenAI: https://x.com/OpenAI/status/2056849157860831239

--- 完 ---

以上,既然看到这里了,如果觉得不错,随手点个 赞、在看、转发 三连吧,如果想持续收到推送,也可以给我 点个关注 ~
本文仅为继词客个人观点,与字节跳动无任何关联。内容仅作观点解读,部分素材来源于网络公开内容,仅限学习交流使用。若涉及侵权,请联系客服删除处理。

撰文:辞柔  & 继词客

编辑:元安 & 摇禾   

美编:动甜

/ 图片、资料来源:x,小红书,抖音,微信,B站,Facebook,微博

/ 投稿或爆料,请联系邮箱:tokenjitter@163.com