前言
一个中国团队,把全球AI的价格打下来了。
2024年12月26日,DeepSeek V3横空出世。671B参数,激活37B,性能对齐GPT-4o,训练成本却仅557.6万美元——GPT-4o的估计成本约1亿美元,是它的近20倍。
API价格更狠:输入0.5元/百万token(缓存命中)/2元(缓存未命中),输出8元/百万token(45天优惠期内为2元),约为GPT-4o的1/10到1/50。
消息传出,硅谷震动。
OpenRouter数据显示,DeepSeek长期占据平台token份额榜首,占比约16.7%(截至2026年7月13日)。
这不是小打小闹的优化,这是一个中国团队用一套全新的方法论,把全球AI行业的成本结构打穿了。
梁文锋:从量化到AI的跨界者
要理解DeepSeek的故事,得先从它的创始人梁文锋说起。
1985年,梁文锋出生在广东湛江吴川市覃巴镇米历岭村,父母都是小学语文教师。2002年以吴川一中高考状元身份考入浙大电子信息工程——没有海外背景,纯本土路线。
毕业后,梁文锋做了一件当时很少有人想到的事——用人工智能做量化交易。2015年,他与浙大校友徐进共同创立了杭州幻方科技有限公司(幻方量化)。
幻方量化的管理规模在2021年突破千亿大关,跻身国内量化私募“四大天王”之列。梁文锋发现,量化交易的核心壁垒其实是算力和算法,而这恰好也是大模型训练的核心需求。
一个念头开始成型:能不能用量化赚的钱,养一个真正的大模型?
这就是后来被外界津津乐道的“金融养科技”闭环。幻方量化持续盈利,源源不断地为DeepSeek输血,让他在没有外部融资压力的情况下,放手去做长期投入。
2023年7月,梁文锋正式创办杭州深度求索人工智能基础技术研究有限公司(DeepSeek)。
这一步棋,国内没有几家公司能走。
价格屠夫:从V3到V4,一条“斩杀线”的诞生
技术创新带来的最直接结果,是价格战争。
2026年4月24日,DeepSeek发布V4系列模型预览版。V4-Pro拥有1.6T总参数、49B激活参数和100万token的超长上下文窗口;V4-Flash总参数284B,仅激活13B参数,同样支持百万上下文。
7月31日,DeepSeek悄无声息地把V4-Flash正式版API挂上了线。没有发布会,没有PPT,就像V3发布时一样低调。
但这次,它引爆了一个词:斩杀线。
全球知名评测机构Artificial Analysis随即把大模型拉出来“公开处刑”——横轴是单次任务成本,纵轴是智能指数得分。DeepSeek V4 Flash 0731落在左上角那个亮点:3美分,50分。

从这个点往右拉一条横线、往下拉一条竖线,两条线夹出的右下角直角区域,就是“斩杀区”——成本比它高、分数比它低。绝大多数模型都落入了这个区域。
几组数据,感受一下这条线的杀伤力:
数据来源:Artificial Analysis智能指数及单任务成本评测。其中Kimi K3为开源榜第一(57分)。
贵100倍,只多考不到10分。 这笔账,怎么算都是亏的。
再看API定价。截至2026年8月,DeepSeek V4系列引入了峰谷计费(高峰时段为工作日9:00-12:00和14:00-18:00):
V4-Pro(旗舰级):
输入(缓存命中):平时0.025元/百万Token,高峰0.05元 输入(缓存未命中):平时3元/百万Token,高峰6元 输出:平时6元/百万Token,高峰12元
V4-Flash(性价比型):
输入(缓存命中):平时0.02元/百万Token,高峰0.04元 输入(缓存未命中):平时1元/百万Token,高峰2元 输出:平时2元/百万Token,高峰4元
梁文锋的定价逻辑简单粗暴:10个月收回硬件成本。通常,大模型厂商的定价会包含硬件成本、研发成本、运营成本和利润空间。梁文锋只算硬件成本,而且只要求10个月回收。
2026年5月22日,DeepSeek将V4-Pro的限时2.5折优惠直接转为永久定价——输出价从原24元/百万Token降至6元,降幅75%;输入(缓存未命中)从12元降至3元;输入(缓存命中)从0.1元降至0.025元。自2026年6月1日起正式执行。这不是促销,这是永久调价。
效果立竿见影。
2026年7月30日,OpenAI宣布GPT-5.6系列降价:Luna降价80%(输入从1美元/百万Token降至0.2美元,输出从6美元降至1.2美元),Terra降价20%。即便如此,DeepSeek V4 Flash的单任务成本仍比降价后的GPT-5.6 Luna低约60%。
更震撼的是调用量。8月1日,仅通过OpenCode一个入口,DeepSeek V4 Flash单日处理8万亿Token(其中5万亿为免费试用额度,3万亿为开发者付费调用)——而接入了400多款模型的OpenRouter全平台,日均处理量约6.6万亿。
一款模型,一个入口,干翻一个生态。
在OpenRouter最新周榜中(7月27日—8月2日),全球调用量前五全部由中国大模型包揽:DeepSeek V4 Flash(7.22万亿Token周调用量,厂商份额21.8%)、小米MiMo、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2。中国大模型周调用量已连续14周超过美国。
能躲过这一刀的,只剩两种:更便宜的(GPT-5.6 Luna、小米MiMo),但编程能力差一截;更强的(Kimi K3、Claude Opus 4.8),但必须把思考开到Max才能拉开差距,成本高得离谱。
连“幸存者”都活得很累。 这才是斩杀线真正可怕的地方。
开源:MIT协议的杠杆效应
如果说价格是直接打击,那么开源就是长期渗透。
DeepSeek的所有模型都采用MIT协议开源——这是最宽松的开源协议,意味着任何人都可以自由使用、修改、分发,甚至用于商业目的,而且不需要开放自己的代码。
这个选择的聪明之处在于:它用最低的门槛,撬动了全球开发者生态。开源自带杠杆效应。你提供一个基础,全世界的开发者帮你完善它。
这条路的好处是能快速建立开发者生态,坏处是短期难以变现。但梁文锋的节奏很清晰:先用技术建立影响力,再用影响力反哺商业。
AI主权:当开源遇上国产算力
2026年6月17日,Cohere CEO Aidan Gomez在G7峰会上对全球领导人发出了一个警告:世界再也承受不起向集中式供应商租用未来的战略风险。
他说的是AI主权——一个正在从学术讨论变成国家战略的现实命题。
Gomez的核心论点很直接:当你租用AI,你就交出了运营控制权。你放弃了数据隐私、安全协议和基本访问权限,让自己完全受制于第三方。就像工业时代,民主国家深知依赖单一能源来源或关键矿物的狭窄地理咽喉有多危险,今天,我们正准备在数字智能上犯同样的错误。
他提出了检验“真正主权”的三个标准:你能否控制模型的质量和治理?你能否控制自己的数据?你能否在没有第三方依赖的情况下维持运营?
这三条,每一条都指向同一个方向:自主可控。
而DeepSeek,恰好站在这三条线的交汇点上。
2026年4月24日,DeepSeek V4发布预览版,官方技术报告第一次把华为昇腾与英伟达并列写入硬件验证清单。路透社报道称,这标志着DeepSeek在战略上从依赖美国半导体,转向更多采用中国本土AI设备。同日,华为昇腾CANN官方直播宣布DeepSeek V4昇腾首发。
英伟达CEO黄仁勋的回应更具分量。2026年4月15日,黄仁勋接受Dwarkesh Patel播客专访时表示:如果DeepSeek先在华为平台上发布,那对我们国家来说将是灾难性的。 短短9天后的4月24日,华为昇腾CANN官方直播宣布DeepSeek V4昇腾首发——黄仁勋的担忧精准应验。
当中国顶尖大模型与国产算力基座完成绑定,美国长期推行的芯片封锁就会失去关键抓手。
这不仅仅是DeepSeek一家的事。V4发布当天(2026年4月24日),8家国产AI芯片厂商官宣了Day0适配方案:华为昇腾、寒武纪、海光信息、摩尔线程、沐曦股份、昆仑芯、平头哥真武、天数智芯。智源研究院牵头的FlagOS社区在Day0完成了DeepSeek-V4-Flash在8款以上AI芯片上的全量适配与推理部署——一个模型公司的版本发布,引来国家级机构组织产业测试,这在中国AI产业链上前所未有。
回到Gomez提出的三个标准,DeepSeek + 华为昇腾的组合给出了一份中国答案:
开源模型 + 国产算力,这不是情怀,这是一套经过验证的、高性能的“国模+国芯”方案,其成本账和安全账极具诱惑力。
当开源遇上国产算力,当技术创新遇上产业自主,一条比“斩杀线”更深的线正在成形——它画的不是价格边界,而是主权边界。
真正的颠覆
那么,DeepSeek到底颠覆了什么?
表面看,是价格。API价格打了下来,训练成本降了下来。但这只是最表层的变化。
更深层的颠覆,是中国创新路径的验证。DeepSeek证明了三件事:
第一,花小钱可以办大事。 不是越大越好,而是越精越好——技术可以一定程度上弥补资源的短板。
第二,开放可以战胜封闭。 把核心技术毫无保留地交给全世界,反而换来全球开发者的投票,换来《Nature》封面的权威背书,换来一个自我强化的生态飞轮。
第三,中国团队完全有能力在基础创新上做到世界领先。 这不是某个单点的突破,而是从底层方法到工程实现的系统性创新。
最深刻的颠覆,是格局。
过去三年,全球大模型市场是ChatGPT一家独大。DeepSeek的出现,让市场从单极主导进入多极竞争。中国大模型,从跟随模仿走向并跑甚至领跑。
有人把DeepSeek比作中国AI的“斯普特尼克时刻”——1957年苏联发射斯普特尼克卫星,直接刺激了美国的太空竞赛。DeepSeek的问世,正在产生类似的效应。
DeepSeek真正颠覆的不是某个产品,而是整个AI行业的游戏规则——从拼资源、拼投入,变成拼效率、拼路径、拼主权。而这场颠覆最反常识的地方在于:它把路找到了,又把路开放给了全世界。
别人筑墙,他修路。这或许才是DeepSeek给这个时代留下的真正注脚。
1957年,斯普特尼克卫星升空,刺激了一场跨越十年的太空竞赛。2024年那个冬天,DeepSeek悄然上线,没人知道它会引发什么。
但有一件事已经确定:全球AI的故事,从此有了另一个讲法。
而这个讲法,才刚刚开始。
夜雨聆风