各位朋友们,当下来谈谈今日的AI圈,我用四个字去形容它:
细思极恐
不是惊叹它能力太强带来的畏惧,而是心底忍不住犯嘀咕:它会不会已经不再需要我们了,这份不安才更难熬。
听我慢慢给你捋。
一、清华搞出个 AI,自己写论文,还推翻了数学结论
先上第一道硬菜。
昨天中关村的活动上,清华陈勇超团队扔了个东西叫Apex Research—— 一个自进化 AI 系统。
这玩意儿能干啥?
它自己搞科研,自己写论文,还往 ACL 2026(自然语言处理顶会)投了34篇,其中11篇达标,2篇初审成绩超过了 99% 的人类首次投稿研究者。
你以为这就完了?
它还在数学领域推翻了一项沿用了十几年的主流结论,数学家验证过,成立。
朋友们,划重点:
以前的 AI:你教它啥,它会啥 现在的 AI:它自己找问题,自己研究,还能推翻人类的结论
这已经不是“工具”了?这是一个不需要导师的博士生,而且还不用发工资不用睡觉。
最让人后背发凉的是这句话:“和只会复刻现存知识的传统大模型不同,这套系统能够自主创造内容”。
自主干什么?自主生成全新知识啊。
人类几千年积攒文明与学识,向来都是后辈踩着前人的成果一步步探索得来的。现在 AI 说:我自己长肩膀了。
二、GitHub 热榜第一:会自我改进的 Agent
如果你觉得清华那个还不够刺激,再来看看 GitHub。
这两天 GitHub 榜首有个项目叫prime-agent,连着两天第一。
它是干啥的?
会自我改进的 AI Agent。
说白了就是它完成任务后能自我复盘:
“刚刚这个处理方案有缺陷,下次换种方式试试”,并且能把优化思路牢牢记住,后续处理直接避开无效路径。
你真以为 AI 竞争针对的只有人类吗?
不,AI 已经开始卷自己了。
以前大伙都调侃 AI 是人工智障,根源就是它出错后不会自我修正,每回都要人手把手调教。可现在完全变了:它踩过的坑自己复盘消化,靠总结经验持续迭代升级。
这就跟打游戏碰上的对手一模一样,起初你觉得对方水平很差,可他每失败一次就精进一分,打到最后你根本不是对手。
更关键的是,这类 AI 早已不是个例。同一天榜单上还有谷歌大佬 Addy Osmani 开源的工程工具包,专门服务 AI 编程智能体,核心亮点就是能产出工业级代码,写完直接投入线上生产。
翻译一下:AI 写的代码,已经可以直接上线了。
三、大厂杀疯了:10 万亿参数的 GPT-6 要来了
如果说前面两个是 "质" 的变化,那大厂这边就是 "量" 的疯狂。
今天36氪炸了一条消息:GPT-6(代号 Astra)传10万亿参数,8月强行发布。
十万亿参数是什么概念?业内估测 GPT-4 总参数约 1.8 万亿,传闻 GPT-6 直接冲到它的五倍多,达到 10 万亿级别。
更夸张的是爆料消息:OpenAI 哪怕顶着各国政府安全审查的阻拦,也要执意推出这款模型。什么叫强行上线?监管部门明确叫停,要求暂缓发布、完成完整安全风险评估,可 OpenAI 直接选择不等审核,按期对外推出。
细品背后的紧迫感,根源是 Anthropic 在底层预训练赛道已经拉开领先差距,逼得 OpenAI 不得不拼命追赶。早在九个月前,他们就内部重调全部算力资源,all in 超大模型预训练。
国内这边也丝毫没有掉队。字节跳动正秘密训练至少 5 万亿参数的超大基座模型,由 Seed Foundation 负责人项亮全权牵头,这也是目前国内已知规模最大的自研大模型。多家外媒透露,项目上限参数最高或将冲击 10 万亿,规模直逼 Anthropic 的 Mythos 5 旗舰模型。
而且张一鸣放话了:不走蒸馏 "捷径",宁可短期落后也要追求真正的技术。
翻译一下:别人抄近道,我不抄,我硬卷。
四、AI 从 "聊天" 变 "办事" 了
光说参数你可能没感觉,说点你能直接用的。
OpenAI 今天正式发布了Operator—— 一个能直接在浏览器里干活的 AI Agent。
不是聊天,是干活。
它能自己浏览网站、订机票、填表格,你跟它说一声,它就帮你办了。
海外 AI 可自主联网、订票、填单,一句话就能全权代办事务。国内千问开放平台今日落地,打通顺丰、自如、闪送、嘟嘟巴士等十余家服务商,对话内 @对应智能体,用大白话就能完成寄件、租房、闪送、购大巴票全流程。
发现没有?
AI 的定位变了。
2023 年:AI 是聊天机器人 2024 年:AI 是写作助手 2025 年:AI 开始能干活了 2026 年:AI 自己进化、自己科研、自己干活
它已经不满足于当你的 "助手" 了,它开始当你的 "替身" 了。
五、说点真心话
写到这里,其实有点感慨。
我们何其有幸,亲眼见证 AI 从笨拙的人工智障蜕变为全能助手;却又满心惶恐,只因变革来得太过迅猛。常常还未吃透当下的工具,新一轮技术浪潮便已袭来。
今天这些新闻串在一起,我看到一个趋势:
AI 已经从 "人类教AI" 的阶段,进入 "AI教AI" 的阶段了。
从前,写代码、标注数据、设计模型架构全都是人类的工作,AI 只负责按指令执行任务。可如今一切都变了:AI 能自主写代码、独立开展科研、自我调优、持续迭代进化。
人类的角色,正在从 "老师" 变成 "观众"。
但我想说的是 ——焦虑没用,拥抱才有用。
AI 再强大,也读不透人心。
它能流畅写完一整篇论文,却猜不透你的老板偏爱哪种行文风格;
它能一键帮你订好行程机票,却不懂你母亲心底盼着你哪天归家;
它可以持续自我迭代、不断变强,却永远无法共情你藏在心底的生活期许。
工具越强,人的判断力越值钱。
知道什么时候用 AI、怎么用 AI、用 AI 来做什么 —— 这个能力,AI自己学不会。
最后留个问题:
如果 AI 真的能自己进化了,你觉得人类最不可替代的能力是什么?
夜雨聆风