嗨,我是 Nucky。
这周AI圈最热闹的事,就是Anthropic和月之暗面前后脚发新模型。一边是Claude Opus 5喊出“Fable 5性能、一半价格”,另一边是Kimi K3-256K走“同能力、更低成本”路线。作为每天和AI打交道的人,我今天干脆把这两个新面孔,再加上一直免费的DeepSeek V4-Pro,拉出来做一场同题对比。
测试任务设计
我给了三个模型同一个提示词:请基于Claude Opus 5、Kimi K3-256K、DeepSeek V4-Pro的公开价格与定位,生成一个单文件HTML页面,包含三者的价格对比表格和柱状图,并给每个模型写一句定位。比拼维度:代码一次性可运行性、页面美观度、价格数据准确性、中文输出自然度。
1. Claude Opus 5
网址:claude.com · 定位:Anthropic 7月24日发布的新旗舰,主打“接近Fable 5、价格腰斩”
测试过程
我通过Claude Pro界面切换至Opus 5,把提示词丢进去。它先是一小段思考,然后直接输出完整HTML代码,包含内嵌CSS和ECharts柱状图。我复制到本地打开,页面正常渲染,柱状图数据准确,三者的输入/输出价格都用美元和人民币双标注。整个响应耗时约45秒。
让我意外的是,它主动给页面加了一个“性价比指数”小卡片,把价格和能力做了简单归一化。这个细节不是我要的,但确实让页面更“成品”。
结果评价
质量:★★★★★(5/5)速度:★★★★☆(4/5)易用性:★★★★★(5/5)中文:★★★★☆(4/5)
使用技巧
1. 让它生成代码时,加上一句“请把CSS和JS全部内联到一个HTML文件里,不要引用外部资源”,否则它可能默认用CDN。
2. 如果做中文内容,提示词里写“输出自然、口语化的中文”,否则它会偏书面和翻译腔。
价格与适合人群
API输入5美元/百万token、输出25美元/百万token;Pro订阅20美元/月起,免费版只能用Sonnet 5,Opus 5需要付费。适合对代码质量和可靠性要求高、愿意付费的专业开发者或知识工作者。
2. Kimi K3-256K
网址:kimi.com · 定位:月之暗面7月25日发布的精简版,256K上下文、能力对齐K3、成本更低
测试过程
在Kimi网页端,我先在模型下拉框里手动切到Kimi K3(免费版默认可能是K2.6,这点很容易忽略)。输入同样的提示词后,它输出了一份完整HTML,用的是纯CSS+原生Canvas画柱状图,没有依赖外部库。代码第一次打开就能跑,页面风格比Opus 5更“简洁”,但中文标签和说明非常自然。
不太满意的地方是耗时。这个简单页面它花了约2分10秒才完成,比Opus 5和DeepSeek都慢。另外,它没有把人民币换算做得特别细,只给了大致区间,数据精度不如Opus 5。
结果评价
质量:★★★★☆(4/5)速度:★★★☆☆(3/5)易用性:★★★★☆(4/5)中文:★★★★★(5/5)
使用技巧
1. 每次开新对话都检查一下模型下拉框,确认选中的是Kimi K3,否则免费版可能默认跑老模型。
2. 做编程任务时,加上“请用原生技术实现,不要引用外部JS库”,它会更稳,也避免CDN在国内加载慢。
价格与适合人群
网页端免费版可用(有速率限制);完整K3 API为输入20元/百万token、输出100元/百万token,256K版本官方称“消耗约为K3的一半”。适合日常中文写作、长文档阅读和前端原型,对速度不敏感的轻度开发者。
3. DeepSeek V4-Pro
网址:chat.deepseek.com · 定位:杭州深度求索的V4系列旗舰,网页端免费、API价格极低
测试过程
在chat.deepseek.com切换到Expert Mode(对应V4-Pro),输入同样提示词。它的输出是最“工程师思维”的:HTML结构清晰、CSS变量命名规范、柱状图用SVG手写,还附带了一段“如何本地打开”的说明。代码一次性运行成功,但页面视觉比前两个朴素,更像个技术原型。
说实话,DeepSeek在中文表达上没问题,但偶尔会把“百万token”写成“1M tokens”,术语混用。数据准确性OK,价格标注以人民币为主,对美元价格的换算偏保守。
结果评价
质量:★★★★☆(4/5)速度:★★★★★(5/5)易用性:★★★★☆(4/5)中文:★★★★☆(4/5)
使用技巧
1. 复杂任务先开DeepThink模式,让它把推理过程展示出来,方便你检查它有没有跑偏。
2. 让它输出代码时加一句“所有文本用中文,技术术语保留英文缩写”,可以避免中英夹杂。
价格与适合人群
网页端完全免费;API按量付费,V4-Pro输入约0.435美元/百万token、输出约0.87美元/百万token,几乎是三者里最低的。适合预算敏感的学生、独立开发者,以及想把AI嵌入自己产品的初创团队。
横向对比表
Nucky 的最终推荐
综合最强:Claude Opus 5。代码最可靠、页面最完整、对复杂任务的理解最到位。如果你靠AI做生产级开发,这笔钱值得花。
性价比最高:DeepSeek V4-Pro。网页端免费、API价格只有其他两者的零头,速度还最快。对预算敏感的场景,它是首选。
最适合新手:Kimi K3-256K。中文最自然,网页端免费就能体验到K3级别的能力,对国内用户最友好。缺点是速度慢,急活别用它。
我的个人选择:如果今天只选一款,我会把DeepSeek V4-Pro作为日常问答和轻量编程的主力,把Opus 5留给重要项目。Kimi K3-256K则专门处理中文长文档。三家互补,比只用一家更稳。
关注Nucky的AI笔记,明早8点见
—— Nucky的AI笔记 · 每天3分钟读懂AI
⚠️ 以上内容为个人观点,仅供参考
夜雨聆风