ARTICLE · 1093438
这么多AI工具,我应该怎么选?
发布时间:2026-09-28 21:47:19 最近访问:2026-09-28 21:47:19
这么多AI工具,我应该怎么选?
这么多AI工具,我应该怎么选?
打开美团点外卖,里面塞了个AI助手。京东买东西,弹个AI导购。支付宝里有AI客服,雪球里有AI诊股。这些原本跟AI没关系的App,现在都往里塞了个问答入口。再到独立App,元宝、豆包、千问、Kimi、智谱清言、DeepSeek,每个月都有新名字挤进来。海外市场也是一样,GPT、Claude、Gemini、Grok、Perplexity,光把名字记全都要花一阵。这两年AI这把火,从大模型烧到了智能体。火还在烧,可围观的人先犯了难。每个App都往里塞AI问答,每个群都在传新工具,工具多到选不动。一年多前我开始密集用AI工具做研究和写稿。Codex、Claude Code、Cursor、WorkBuddy、Gemini……,工具多到自己都挑不过来。经常有人问我,这么多到底选哪个。我觉得这个问题没有标准答案,但有一点儿可以确定。这些工具大概分为三类,每段都有它的主战场和领跑者。把这三段弄明白,选择压力就会小很多。第一阶段是大模型本身。第二阶段是编程Agent。再往后才是办公Agent。大模型那两年,比的是参数和指标
2022年到2024年,市场焦点都在大模型本身。比什么?模型参数量、训练算力、参与训练的文本知识量、上下文窗口。这段时间,市场最亮的崽是GPT、Claude、Gemini、千问、DeepSeek、Kimi、GLM(智谱)。豆包、元宝那时候还没什么声量。大模型把AI这把火点着了。回头看,产品形态其实挺原始。打开就是一个聊天框,问什么答什么。往前推十年,微软小冰就在做类似的事,差别在现在的模型更聪明、更像人。那一阶段大家都在比模型,产品形态没什么创新。谁能把模型做得多模态、谁上下文能拉到百万token,谁就是这一阶段的赢家。OpenAI 靠 GPT-4 领跑,Anthropic 靠 Claude 3 的长文本和安全策略紧追。Google 的 Gemini 走多模态原生路线,算是另一条路。国内千问、DeepSeek、Kimi、GLM 各有侧重,产品形态都还是 ChatBot。海外这些产品基本是顶级实验室主导,国内是大厂和独立创业公司混战。那时候,产品差异不大,模型差异主要源于背后的算力差距。编程Agent率先跑通付费
2024年往后,赛道开始分化。模型能力溢出到具体场景,编程是第一个跑通商业化的方向。为什么是编程先跑通?代码这件事,对错有客观标准。模型写出来的代码能不能跑、跑得对不对,跑一遍就知道。不像写营销文案,好坏全凭感觉。再加上开发者群体付费意愿强,企业愿意为提效掏钱,商业化路径自然成立。Claude Code在企业付费这条路上跑通了。开发者愿意为它掏钱,企业愿意把它接进工作流,这是大模型行业里最早跑通的商业化路径。OpenAI 的 Codex 紧追不放,两家在编程Agent领域形成双子星。随着前两者的示范效应,国内外厂商都往代码方向发力。微软的 GitHub Copilot,字节的 Trae,阿里的 Qoder,腾讯的 CodeBuddy,加上 Kimi、GLM、DeepSeek、MiniMax 都在代码赛道上较劲。还有一类独立创业公司,专门做"大模型编程能力 + 传统IDE 融合"的AI 原生 IDE,比如 Cursor、OpenCode。模型不是自己的,工程能力是自己的。这条路线给程序员多了一个选择,也给大厂把编程 Agent 做得更工程化提供了参照。综合整体的市场反馈和表现来看,Claude Code 和 Codex 的护城河确实确实足够深,但海外的网络和支付门槛很高,一定程度上阻碍了两者在国内的普及。不过好在国产类产品的体验一直在提升,算是给国内程序员提供了替代选择。办公Agent成了2025年的新战场
2025年往后,AI能力继续溢出,这次溢到通用办公领域。信号很清楚。2026年开始,OpenAI 把原来 ChatGPT 和 Codex 整合到桌面端,形成 Chat、Work、Code 三条产品线。Anthropic 把 Claude 产线和 Claude Code 也统一整合到桌面端,分划出 Claude Chat、CoWork、Code 三个入口。轻交互走 Chat,重办公走 Work。编程那摊活交给 Code。三个场景用一套模型,产品形态严格切分。xAI 的 Grok、Meta 的 Muse,也在朝个人 AI 助理的方向走,只是路径还没前面两家清晰。国内跟进很快,而且是大厂领跑。国内主流AI办公产品线大致是这样。海外办公和编程产品,目前由 OpenAI 和 Anthropic 两家主导。这跟海外 B 端产品市场更成熟、付费习惯更早有关系。国内跑得快的,都是自身有 B 端产品生态的互联网大厂。为什么是大厂?办公 Agent 要落地,离不开背后那套办公生态。腾讯有企业微信,阿里有钉钉。字节靠飞书也铺了好几年。模型再强,没有配套的文档协作、会议、日历、审批、CRM 这些组件,办公 Agent 就站不住。再加上产品里的插件、技能,国内大厂的办公 Agent 已经是非常成熟的使用体验了。独立大模型厂商里,智谱(GLM)、DeepSeek、Kimi、MiniMax 也在分化。智谱和Kimi走得最靠前,办公和编程都开始有产品线。DeepSeek目前重心还在大模型本身。MiniMax 偏内容生成,C 端属性更强。到底选哪个
专业程序员的话,Claude Code 和 Codex 无论是模型能力还是产品工程能力,依然有深不见底的护城河。这一点毋庸置疑。但前提是得解决网络和支付问题。如果这两道坎过不去,国内头部编程产品也在逐步占领市场,差距在缩小。日常办公、非技术类白领想用 AI 提升效率的话,优先选国内大厂产品。腾讯 WorkBuddy、字节豆包工作、阿里千问办公更有性价比和生态优势。背后依托的是企业微信、钉钉、飞书这一套办公组件,再加上产品里的插件、技能,已经是非常成熟的使用体验了。如果只是想随便聊聊、查查资料,元宝、豆包、千问、Kimi 都行,挑界面顺手的装一个就好。工具多不等于要全用。选准一两个用熟,比样样沾一点强得多。