3分钟了解一周全球AI发展
大模型们又卷起来了
Claude:下一代模型代码能力猛涨,还给所有AI生成的内容加了水印,复制粘贴都去不掉,一查就知道哪个模型写的。
OpenAI:新图像模型在测了,细节强到能画一粒尿酸。另外GPT提速14倍,以前干两周的活现在一天搞定。
智谱GLM-5.3:代码能力涨了50%,跑分超过Kimi,开源圈又坐回前排。
DeepSeek:V4-Pro开源了,还把整个工具框架也开源了,想自己搭AI助手的可以动手了。
阿里Qwen3.8:270亿参数的小模型,干翻了半年前的顶级模型,关键是能本地跑。
Grok 4.6:马斯克的模型杀进第一梯队了,还能给每个Bot配云电脑,教一次就24小时帮你干活。
Google Gemini:Flash版升级,创始人亲自下场盯开发。
这些新功能挺有意思
手语转文字:Google出的,听障朋友直接用手语就能"打字"。
语音克隆:IndexTTS 2.5开源了,几秒声音就能复刻你的音色和语气,还能说外语。
AI写歌:MiniMax开源了音乐模型,一句话生成5分钟完整歌曲,本地就能跑。
文档识别:Mistral OCR升级,手写和复杂表格也能精准转文字。
AI主播:新的实时语音模型,上下文变了话术自动跟着调,做AI客服和主播很合适。
小模型和开源工具
28MB的模型:Cactus Needle 2,路由器、耳机、摄像头上都能跑,虽然不聪明但能调用工具。
本地桌面客户端:开源了,本地跑大模型、本地训练都行,不用什么都丢云端。
腾讯世界模型:说句话就能生成一个能逛、能改的3D世界。
还有两个离谱的
英伟达新模型:Nemotron 4,1万亿参数起步,秋天发,目标是最强开源模型。
反光卫星:Earendil-1获批测试了,能把阳光反射到地球指定位置,晚上施工救援也能"借光"。
夜雨聆风