大家好,我是AI视听小学生。
今天AI圈又是炸裂的一天——DeepSeek终于长出了"眼睛",马斯克拿走了200亿美元,谷歌的AI模型开始帮人类打癌症了。
👁️ DeepSeek V4 Flash Vision上线:国产大模型终于"会看图"了
今天下午,DeepSeek官方API文档里悄悄出现了一个新模型:deepseek-v4-flash-vision-exp。这是DeepSeek V4系列第一个直接支持图片输入的视觉模型,拥有1M上下文,最大输出长度384K,支持JSON Output、Tool Calls等功能。
说白了,就是DeepSeek以前只能"读字",现在终于能"看图"了。
更关键的是价格——和纯文本版完全一样。高峰时段缓存未命中输入3元/百万Token,输出9元;空闲时段更便宜,分别只要1.5元和4.5元。图片不单独按张收费,而是按尺寸折算成Token,跟文字一起算。
为什么这件事这么重要?因为就在上周,DeepSeek刚开源了Agent Harness(一套Agent运行框架),结果开发者最常问的问题就是"怎么让DeepSeek看图"。以前只能借用其他公司的视觉模型当"外挂",现在终于原生支持了。
不过要注意,模型名字后面还带着"Exp"(实验版)后缀,说明还在测试阶段。但参考DeepSeek之前的惯例——先出实验版收集反馈,再推正式版——这个视觉能力离正式发布应该不远了。来源
> 小学生点评: DeepSeek这波操作太聪明了。先把Agent框架搭好,再把视觉能力补上,整套系统就闭环了。而且价格不涨,这是要继续打价格战的节奏啊!其他做视觉模型的厂商,估计要紧张了。
💰 马斯克xAI狂揽200亿美元,英伟达亲自下场投资
马斯克的AI公司xAI又搞了个大新闻——最新一轮融资拿下了200亿美元,而且英伟达亲自参与了投资。
这笔钱要干嘛?主要是加速Grok模型的开发,以及扩建xAI的算力基础设施。有了英伟达的加持,xAI在GPU供应上肯定能拿到优先权。
200亿美元什么概念?这比很多上市公司的市值都高。马斯克这是在用真金白银告诉全世界:AI军备竞赛,我绝对不缺席。
而且这个时间点也很有意思——正值OpenAI内部权力洗牌、IPO准备的关键时期。马斯克选择此刻大举融资,显然是想趁对手内乱时弯道超车。来源
> 小学生点评: 200亿美元啊朋友们!马斯克这波就是"钞能力"的极致体现。不过英伟达投资xAI这件事也值得品味——既给OpenAI卖卡,又投资xAI,老黄这波两头下注,稳赚不赔。
⚡ 谷歌DiffusionGemma:1秒1500个Token,快到离谱
谷歌今天发布了一篇技术论文,介绍了一个叫DiffusionGemma的新模型。这个模型最炸裂的地方是速度——单张H100显卡上每秒能生成1500个Token!
怎么做到的?传统大模型是一个字一个字地往外蹦(自回归方式),而DiffusionGemma是一次性并行生成256个Token。就像别人一个字一个字说话,它是一句话一句话往外甩。
更厉害的是,这个模型基于现有的Gemma 4 MoE微调(38亿激活参数/252亿总参数),训练成本不到原模型的10%,还保留了思考模式、多模态和长上下文能力。
目前模型已经开源,已有开发者在macOS上跑出了复现版本。社区最关心的问题是:这种扩散式生成的准确率,能不能追上传统自回归模型?来源
> 小学生点评: 1500 tokens/秒是什么概念?你打字都追不上它生成文本的速度。如果这技术成熟了,以后AI回复可能真的是"秒回",再也不用盯着loading转圈等半天了。不过准确率还得看实战,速度快但答非所问也不行。
🧬 谷歌Gemma下载破10亿,AI发现抗癌新通路
今天谷歌DeepMind还宣布了一个里程碑:开源模型Gemma累计下载量正式突破10亿次。从2024年2月首次发布到今天,用了两年半。全球开发者基于Gemma做出了超过10万个衍生变体。
但更让人震撼的是Gemma在医疗领域的应用——谷歌DeepMind联合耶鲁大学团队,用Gemma开发了一个27B参数的模型C2S-Scale,干了一件大事:把一个细胞变成一句话。
这个模型把单细胞测序数据转换成由基因名组成的"句子",让AI能直接"读"懂细胞。然后,它在4000多种药物中进行了虚拟筛选,找到了一种叫silmitasertib的药物——这种药能放大免疫信号,让"隐身"的冷肿瘤重新暴露在免疫系统的攻击范围内。
最关键的是,这个AI发现的治疗通路已经在活细胞实验中得到了验证。这是AI第一次提出全新的癌症治疗机制,并在实验中确认有效。来源
> 小学生点评: 这才是AI最让人激动的应用方向——不是帮你写文案,而是帮人类打癌症!4000种药虚拟试一遍,靠人工实验不知道要多少年。AI在医疗领域的潜力,可能比我们想象的还要大得多。
🖥️ Groq融资3.5亿美元,AI推理芯片赛道要起飞
美国AI推理芯片独角兽Groq宣布完成3.5亿美元(约23.7亿人民币)A轮融资,投后估值35亿美元(约237亿人民币)。
这轮融资由Disruptive领投,英伟达计划参投(尚待交割完成)。Groq主打AI推理芯片,跟英伟达的GPU路线不同——它走的是专用芯片(LPU)路线,主打极致推理速度。
英伟达投资Groq的逻辑跟投资xAI类似:在GPU之外布局专用推理芯片,防止被"弯道超车"。毕竟不是所有AI任务都需要GPU的通用算力,很多推理场景用专用芯片更便宜更快。来源
> 小学生点评: 又是英伟达!老黄这是要把AI芯片赛道的"潜力股"都投一遍。Groq走的是"专用芯片"路线,就像CPU之于GPU——不是所有活都需要大杀器,有时候专用的更高效。AI推理芯片这个赛道,未来肯定会越来越热闹。
📜 中国加快推进AI领域立法
近日,中央网络安全和信息化委员会印发《促进网信企业高质量发展行动计划(2026-2030年)》,明确提出加快推进人工智能、反网络暴力、数字经济、网络平台、区块链等新兴领域立法。
从国际上看,欧盟《人工智能法案》已于8月2日正式进入全面执法阶段,对通用AI模型提供商拥有了正式执法权,最高可处以全球年营收3%或1500万欧元的罚款。
中国的AI立法虽然起步相对晚,但从文件措辞来看,"加快推进"四个字说明节奏在加快。对于AI企业来说,合规将成为必须面对的课题。来源
> 小学生点评: AI发展太快,法律确实得跟上。不过立法这事儿也不能一刀切——管太严扼杀创新,管太松出问题。欧盟已经开始罚款了,中国也在加速,搞AI的以后得多关注合规了。
🎤 科大讯飞预告:1024开发者节推出全新大模型
今天下午,在科大讯飞2026年半年度业绩说明会上,总裁吴晓如透露:在今年全球1024开发者节上,科大讯飞将推出基于全国产算力的全新主力通用大模型。
8月底就会先推出一个阶段性版本。新模型的目标是:代码能力和Token性价比达到国内第一梯队,全国产算力训练的通用大模型中各项指标继续保持国内领先。
"全国产算力"这四个字很关键——在当前芯片出口管制的背景下,能用国产芯片训练出第一梯队的大模型,这本身就是一种战略能力。来源
> 小学生点评: 科大讯飞这波是在憋大招。全国产算力+第一梯队,这两个标签加在一起含金量很高。10月24日见分晓,希望别让我们失望!
今天的AI新闻就到这里!哪条新闻最让你兴奋?是DeepSeek终于"开眼",还是AI抗癌的新突破?欢迎在评论区聊聊你的看法~
觉得有用的话,别忘了点个赞和在看,转发给你身边关注AI的朋友,咱们明天见!
Tips:有你们的支持,就是我最大的动力~~~
夜雨聆风