夜雨聆风学习资料网

ARTICLE · 1093438

这么多AI工具,我应该怎么选?

这么多AI工具,我应该怎么选?

这么多AI工具,我应该怎么选?

打开美团点外卖,里面塞了个AI助手。京东买东西,弹个AI导购。支付宝里有AI客服,雪球里有AI诊股。这些原本跟AI没关系的App,现在都往里塞了个问答入口。
再到独立App,元宝、豆包、千问、Kimi、智谱清言、DeepSeek,每个月都有新名字挤进来。海外市场也是一样,GPT、Claude、Gemini、Grok、Perplexity,光把名字记全都要花一阵。
这两年AI这把火,从大模型烧到了智能体。火还在烧,可围观的人先犯了难。每个App都往里塞AI问答,每个群都在传新工具,工具多到选不动。
一年多前我开始密集用AI工具做研究和写稿。Codex、Claude Code、Cursor、WorkBuddy、Gemini……,工具多到自己都挑不过来。经常有人问我,这么多到底选哪个。
我觉得这个问题没有标准答案,但有一点儿可以确定。这些工具大概分为三类,每段都有它的主战场和领跑者。把这三段弄明白,选择压力就会小很多。
第一阶段是大模型本身。第二阶段是编程Agent。再往后才是办公Agent。

大模型那两年,比的是参数和指标

2022年到2024年,市场焦点都在大模型本身。比什么?模型参数量、训练算力、参与训练的文本知识量、上下文窗口。这段时间,市场最亮的崽是GPT、Claude、Gemini、千问、DeepSeek、Kimi、GLM(智谱)。豆包、元宝那时候还没什么声量。
大模型把AI这把火点着了。回头看,产品形态其实挺原始。打开就是一个聊天框,问什么答什么。往前推十年,微软小冰就在做类似的事,差别在现在的模型更聪明、更像人。
那一阶段大家都在比模型,产品形态没什么创新。谁能把模型做得多模态、谁上下文能拉到百万token,谁就是这一阶段的赢家。OpenAI 靠 GPT-4 领跑,Anthropic 靠 Claude 3 的长文本和安全策略紧追。Google 的 Gemini 走多模态原生路线,算是另一条路。国内千问、DeepSeek、Kimi、GLM 各有侧重,产品形态都还是 ChatBot。
那时候的产品大致是这样。
模型
厂商
当时定位
GPT-4/GPT-4o
OpenAI
通用旗舰,多模态领跑
Claude 3/3.5
Anthropic
长文本与推理,安全路径
Gemini
Google
多模态原生,搜索生态
通义千问
阿里
中文场景,开源并行
DeepSeek
深度求索
推理性价比,开源突围
Kimi
月之暗面
超长上下文,国内首发
GLM/智谱清言
智谱
学术基因,企业服务
豆包
字节
后发跟进,C端流量路线
元宝
腾讯
后发跟进,依托微信生态
海外这些产品基本是顶级实验室主导,国内是大厂和独立创业公司混战。那时候,产品差异不大,模型差异主要源于背后的算力差距。

编程Agent率先跑通付费

2024年往后,赛道开始分化。模型能力溢出到具体场景,编程是第一个跑通商业化的方向。
为什么是编程先跑通?代码这件事,对错有客观标准。模型写出来的代码能不能跑、跑得对不对,跑一遍就知道。不像写营销文案,好坏全凭感觉。再加上开发者群体付费意愿强,企业愿意为提效掏钱,商业化路径自然成立。
Claude Code在企业付费这条路上跑通了。开发者愿意为它掏钱,企业愿意把它接进工作流,这是大模型行业里最早跑通的商业化路径。OpenAI 的 Codex 紧追不放,两家在编程Agent领域形成双子星。
随着前两者的示范效应,国内外厂商都往代码方向发力。微软的 GitHub Copilot,字节的 Trae,阿里的 Qoder,腾讯的 CodeBuddy,加上 Kimi、GLM、DeepSeek、MiniMax 都在代码赛道上较劲。
还有一类独立创业公司,专门做"大模型编程能力 + 传统IDE 融合"的AI 原生 IDE,比如 Cursor、OpenCode。模型不是自己的,工程能力是自己的。这条路线给程序员多了一个选择,也给大厂把编程 Agent 做得更工程化提供了参照。
主流编程Agent大概是这样。
产品
厂商
形态
一句话定位
Claude Code
Anthropic
CLI/IDE 插件
模型能力强,企业付费路径跑通
Codex
OpenAI
IDE 插件/云端
与 ChatGPT 生态打通
GitHub Copilot
微软
IDE 插件
装机量大,开发者习惯成熟
Trae / TraeCode
字节
AI 原生 IDE
国内首发,免费策略激进
Qoder
阿里
AI 原生 IDE
基于通义模型,企业版布局
CodeBuddy
腾讯
IDE 插件/桌面端
与 WorkBuddy 打通办公场景
Cursor
Anysphere
AI 原生 IDE
独立创业,海外风头最盛
OpenCode
开源社区
开源 IDE
可自托管,极客向
综合整体的市场反馈和表现来看,Claude Code 和 Codex 的护城河确实确实足够深,但海外的网络和支付门槛很高,一定程度上阻碍了两者在国内的普及。不过好在国产类产品的体验一直在提升,算是给国内程序员提供了替代选择。

办公Agent成了2025年的新战场

2025年往后,AI能力继续溢出,这次溢到通用办公领域。
信号很清楚。2026年开始,OpenAI 把原来 ChatGPT 和 Codex 整合到桌面端,形成 Chat、Work、Code 三条产品线。Anthropic 把 Claude 产线和 Claude Code 也统一整合到桌面端,分划出 Claude Chat、CoWork、Code 三个入口。轻交互走 Chat,重办公走 Work。编程那摊活交给 Code。三个场景用一套模型,产品形态严格切分。
xAI 的 Grok、Meta 的 Muse,也在朝个人 AI 助理的方向走,只是路径还没前面两家清晰。
国内跟进很快,而且是大厂领跑。国内主流AI办公产品线大致是这样。
集团
聊天入口
办公主入口
编程主入口
腾讯
腾讯元宝
WorkBuddy
CodeBuddy
阿里
通义千问
千问办公
Qoder
字节
豆包
豆包工作
TraeCode
智谱(GLM)
智谱清言
(未独立)
Zcode
DeepSeek
DeepSeek 网页版
(未独立)
(未独立)
Kimi
Kimi
Kimi Work
Kimi Code
MiniMax
海螺 AI
(未独立)
MiniMax Code
海外办公和编程产品,目前由 OpenAI 和 Anthropic 两家主导。这跟海外 B 端产品市场更成熟、付费习惯更早有关系。国内跑得快的,都是自身有 B 端产品生态的互联网大厂。
为什么是大厂?办公 Agent 要落地,离不开背后那套办公生态。腾讯有企业微信,阿里有钉钉。字节靠飞书也铺了好几年。模型再强,没有配套的文档协作、会议、日历、审批、CRM 这些组件,办公 Agent 就站不住。再加上产品里的插件、技能,国内大厂的办公 Agent 已经是非常成熟的使用体验了。
独立大模型厂商里,智谱(GLM)、DeepSeek、Kimi、MiniMax 也在分化。智谱和Kimi走得最靠前,办公和编程都开始有产品线。DeepSeek目前重心还在大模型本身。MiniMax 偏内容生成,C 端属性更强。

到底选哪个

讲到这里,答案就很明显了。
专业程序员的话,Claude Code 和 Codex 无论是模型能力还是产品工程能力,依然有深不见底的护城河。这一点毋庸置疑。但前提是得解决网络和支付问题。如果这两道坎过不去,国内头部编程产品也在逐步占领市场,差距在缩小。
日常办公、非技术类白领想用 AI 提升效率的话,优先选国内大厂产品。腾讯 WorkBuddy、字节豆包工作、阿里千问办公更有性价比和生态优势。背后依托的是企业微信、钉钉、飞书这一套办公组件,再加上产品里的插件、技能,已经是非常成熟的使用体验了。
如果只是想随便聊聊、查查资料,元宝、豆包、千问、Kimi 都行,挑界面顺手的装一个就好。
工具多不等于要全用。选准一两个用熟,比样样沾一点强得多。

相关学习资料