2026年8月13日科技资讯精选
老罗说科技
2026年8月13日
8月12日,全球AI行业在同一天上演了三幕截然不同的戏码。谷歌那边,联合创始人布林紧急接管Gemini团队,旗舰模型3.5 Pro被悄悄取消;英伟达这边,开源了Nemotron 3.5 Lightning 30B MoE模型和推理路由库,把"卖铲子"升级为"送种子";而在中国,DeepSeek V4-Plus涨价方案正式落地,整体涨幅约60%,首日API调用量却逆势增长18%。三件事看似各自独立,但连在一起看,指向的是同一个趋势——AI竞争正在从"谁跑得快"进入"谁能活得久"的新阶段。
一、谷歌布林杀回一线:Gemini 3.5 Pro被取消,旗舰哑火
谷歌联合创始人谢尔盖·布林紧急接管Gemini团队,直接介入一线研发。据独立研究智库SemiAnalysis判断,内部代号"Gemini 3.5 Pro"的旗舰版本已被悄悄取消——这款模型原定于今年5月Google I/O后"下月发布",但三个月过去了,连影子都没见到。
SemiAnalysis的分析显示,Gemini 3.5 Pro的实际能力大约只达到Anthropic去年11月发布的Claude Opus 4.5水平,在复杂推理和编程任务上已被中国多家开源模型超越。作为过渡方案,谷歌推出了多款Flash系列模型,但在公开评测中排名仅第八或第九位。
更让谷歌头疼的是人才流失。Transformer共同发明人Noam Shazeer在谷歌花27亿美元把他从Character.AI挖回来不到两年后,转身加盟了OpenAI;AlphaFold核心缔造者、2024年诺贝尔化学奖得主John Jumper也转投Anthropic;谷歌第30号员工、入职27年的Jeff Dean带着多位Senior Fellow集体离职创业。
讽刺的是,就在布林接管团队的同一天,谷歌CEO皮查伊宣布Gemini月活用户突破10亿,成为谷歌史上增长最快的产品。用户在增长,模型竞争力却在下滑——这种"规模增长与技术焦虑并存"的撕裂感,正是谷歌AI当前处境的真实写照。

谷歌联合创始人布林紧急接管Gemini团队,旗舰模型3.5 Pro疑被取消
老罗点评:发明了Transformer、做出了比ChatGPT早一年的内部聊天机器人的谷歌,却在AI竞赛中节节败退。问题不在技术能力,而在组织胆识——SemiAnalysis的病理诊断一针见血:缺乏足够坚定的信念。当一家公司内部的算力分配都成了内耗时,外部的竞争压力只会被放大。布林亲自下场,说明谷歌到了不得不自救的临界点。
二、英伟达开源Nemotron 3.5 Lightning:从"卖铲子"到"送种子"
8月12日,英伟达发布了Nemotron 3.5 Lightning——一款300亿参数的MoE(混合专家)开放权重模型,并同步开源了NeMo Switchyard推理路由库。
NeMo Switchyard的亮点在于:它可以在任务执行中途动态切换底层模型。英伟达自测显示,这一机制能把单任务推理成本压缩到约三分之一。把模型和路由器都放在同一开源协议下,意味着企业可以在自有硬件上自由编排Agent管线,降低被单一闭源厂商锁定的风险。
这并非英伟达第一次在开源领域落子。此前,英伟达已开源了VoiceChat 11B全双工语音对话模型、Cosmos物理AI模型、Alpamayo自动驾驶VLA模型等多个项目,覆盖智能体、机器人、自动驾驶、医疗健康等六大领域,还开源了10万亿Token的训练数据。
从商业逻辑看,英伟达的开源策略并不矛盾——卖GPU是主业,开源模型是生态。当更多开发者在Nemotron生态上构建应用,对GPU算力的需求只会水涨船高。黄仁勋要的不是模型收费,而是让GPU成为AI时代不可替代的基础设施。

英伟达开源Nemotron 3.5 Lightning 30B MoE模型,同步发布NeMo Switchyard推理路由库
老罗点评:英伟达的开源策略可以用一句话概括——用免费模型养付费算力。当闭源厂商还在比拼谁的Token更贵时,英伟达直接把模型和路由器都送了出去,让开发者在自家GPU上自由编排。这不是慈善,而是更高维度的商业护城河:当你的整个AI管线都跑在Nemotron生态上时,换掉GPU的代价远大于换掉模型的代价。
三、DeepSeek涨价首日调用量反增18%:价格屠夫的"价值回归"
8月12日,DeepSeek V4-Plus涨价方案正式生效:输入价格调整为3.5元/百万Tokens,输出价格调整为12元/百万Tokens,整体涨幅约60%。然而,首日API调用量不但没有下滑,反而逆势增长18%。
这一结果出乎不少人意料。要知道,DeepSeek此前素有"价格屠夫"之称——2024年率先将API价格打到输入1元、输出2元的行业地板价,今年5月又将V4-Pro永久降至原价的1/4。但6月底开始,DeepSeek引入峰谷计费机制,高峰时段价格直接翻倍,此次全面涨价更是明确信号。
涨价不是DeepSeek一家的选择,而是行业趋势。2026年以来,智谱AI已完成三次调价,月之暗面Kimi K3的API输出价格涨至100元/百万Token,较上代涨超3.5倍。阿里云、腾讯云、百度智能云也陆续上调了AI算力相关收费标准。
但横向对比,中国大模型的价格优势依然显著。据Artificial Analysis 7月底测试,DeepSeek-V4-Flash单次调用成本约0.03美元,GPT-5.6约1.86美元,Claude Fable 5约3.15美元——DeepSeek的价格仅为Claude的1/105。

DeepSeek V4-Plus涨价方案正式落地,首日API调用量逆势增长18%
老罗点评:涨价不降反增的调用量说明了一件事——用户对DeepSeek的需求是刚需,不是图便宜。当Agent大规模落地带来百倍于普通对话的算力消耗时,"按价值定价"取代"按成本定价"是必然走向。从价格战到价值战,这不是退缩,而是中国大模型走向成熟的标志。
四、老罗有话说
把今天的三条新闻放在一起看,会发现一个有趣的共同点:它们都在讲"从粗放到精耕"的转型。
谷歌从"什么都想做"变成"必须聚焦"——布林亲自下场,说明谷歌终于意识到AI不是可以并行投入的副业,而是需要all-in的生死战。英伟达从"卖硬件"变成"建生态"——开源不是放弃利润,而是用更深的服务绑定客户。DeepSeek从"价格战"变成"价值战"——当涨价后调用量不降反增,说明中国AI模型已经具备了不可替代的使用价值。
一句话总结:2026年8月,AI行业正式告别"野蛮生长",进入"精耕细作"的新阶段。对于从业者来说,这意味着机会不再是"谁先做",而是"谁做得更好、更深、更不可替代"。
你怎么看这三件事?欢迎在评论区聊聊你的观点。关注老罗说科技,每天带你读懂科技圈。
夜雨聆风