动机,打工人搜什么
MOTIVE写周报要查行业数据,做方案要找靠谱信源,看到一篇公众号好文想追问它的核心观点,还有 Excel 公式、合同条款、政策解读这类日常小问题。
传统搜索给的是 10 个蓝链接,得自己点开、自己判断、自己摘要。打工人没这个时间。
AI 搜索直接给答案。但答案对不对、来源靠不靠谱、好不好用,每家的说法都不一样。我选了三条路线各一家——秘塔(独立搜索派)、豆包(国民综合派)、元宝(生态整合派),用同一批问题挨个问,五个场景跑了一遍。
实测,同一道题考三家
TEST客观题,三家全答对了
第一题:2024 年中国 GDP 增速多少,四个季度分别多少。
三家数字完全一致:全年 5.0%,Q1 5.3%、Q2 4.7%、Q3 4.6%、Q4 5.4%。第二题换 2026 年 6 月 CPI,三家又都答出同比上涨 1.0%。
客观题上三家打成平手,准确性不是区分点。拉开差距的是「怎么把答案给你」。
秘塔会先亮「思考了 2.74s」,答案里每个数字带个上标①,点开是引用来源,末尾还能一键生成可视化图表,默认四个模板挑一个,直接出柱状图加时间轴。豆包标注「搜索 2 个关键词,参考 10 篇资料」,答案排版成带标签的分节,末尾主动追问要不要横向对比近三年数据。元宝最素,纯文字流,但每段挂个 ⓘ 图标,结尾给的追问建议是两条可以点进去的具体问题。
三家都答对了题,差异全在体验层。

虽然准确性一致,但在长尾任务上,秘塔提供了 4 套可视化模板,以及完整的数据出处。在用户体验上,私以为秘塔更胜。
开放题,三家风格完全不同
第二场:2026 年 AI Agent 行业现状与竞争格局分析。这种开放题才是信源质量的照妖镜。
秘塔像读一份学术研究报告。思考了 5.46s,15 条引用脚注,来源里有学术 PDF 标签,数据冲突直接并列——全球市场规模同时给出 5000 亿美元、187 亿美元、526.2 亿美元三个口径,不做判断,让读者自己选。

豆包像听一场结构化工作汇报。14 篇资料,答案分成 4 大章,每个数据后面挂品牌名——腾讯云、Gartner、IDC,国内玩家按三梯队拆成 60%、25%、15% 的份额结构,一眼能扫到重点。

元宝像翻一本数据手册。每个数据点都有 ⓘ 可溯源,市场规模给了 5 个机构口径的对照表,全球厂商份额表精确到 31%、24%、18%、14%、7%。它还主动补了一句:「以上市场规模数据因各机构统计口径差异较大,引用时已尽量标注来源与口径。」

这句话值得单独记住——三家里面,只有元宝主动告诉你数字背后口径是乱的。
长文档,33 页白皮书三家都啃下来了
第三场:丢一份 33 页的沙利文行业白皮书 PDF,让三家读全文并总结。
三家都给出了完整摘要,章节结构、市场规模、典型案例一个没漏。差异在呈现方式:
豆包保留原图最多,架构图、柱状图、案例图谱原样搬进答案,视觉密度最高,最像把 PDF 直接转写了一遍。元宝一张原图都没留,全部转成文字加表格,但把报告封面信息标出来了——发布机构弗若斯特沙利文、共 33 页,还额外整理了一张政策文件表,把报告里提到的 4 个政策文件全名和发布时间列全。顺带一句,腾讯是懂免责的——元宝首页就挂着「内容由 AI 生成,仅供参考」。秘塔保留了大部分原图,豆包、元宝、秘塔其实都提到了附录摘要,只是秘塔把附录的图片完整呈现了出来,AI、LLM、RAG、RLHF、Agent 五个专业名词每个都配了完整释义。
长文档处理三家都过关,谁都没掉链子。
公众号链接,三家都能读
第四场,用我自己的公众号文章做测试:让三家读取链接,说出文章核心观点。
文章讲的是 DeepSeek V4-Flash 用后训练把 Agent 能力提升近六倍、价格只有旗舰版三分之一这件事。
豆包把文章拆成 4 个部分:产品事实、核心论断、作者提出的三个存疑、最终结论,末尾跟了三个追问跳转。元宝给的是四层金字塔,最后补了一句全文总结:「编程从“技能”变成“表达”,降低创造门槛,重构人机协作范式」——这句话直接可以当金句引用。秘塔输出了一段流畅的文字综述,观点全对,但没有任何分节,也没有追问。
值得说一句:元宝背靠微信生态,但在公众号链接读取上并没有甩开另外两家。文章已经被全网抓取过,谁都能读到。
四场测试打下来,汇总成一张表:
洞察,三条不同的路
INSIGHT五场跑完,三家的路线图很清楚。
秘塔是学术基因。信源最严、引用最规范、数据冲突敢直接并列。代价是界面像论文检索工具,普通打工人日常用会觉得重。
豆包是字节系全能助手。结构永远工整,表格永远清晰,品牌信源让答案显得可靠。代价是信源点不开、不可溯源,深度内容得自己再验证一遍。
元宝是微信生态的延伸。数据最全、口径说明最诚实、追问最聪明,连「要不要整理成速查表」这种后续动作都能替你想到。代价是产品还在早期,粗糙感明显,首页还挂着「下载元宝电脑版」的引流卡片,商业化已经在路上了。
三个产品,三条路:一个走学术深度,一个走速度广度,一个走生态独占。
结论,你的工位该装哪个
CONCLUSION按场景选,别按名气选:
写正式报告、做深度研究,用秘塔。信源可溯源,引用规范,报告能拿得出手。
日常快速搜、做汇报找重点,用豆包。结构最清晰,答案最工整,打开就能用。
搜公众号内容、做行业研究、要选型决策,用元宝。数据最完整,口径最诚实,追问最聪明。
如果只装一个,我会选秘塔。我测的是 web 版,豆包和元宝给我的感觉更像 chatbot 问答助手——问一句答一句,用完就走。秘塔提供个人知识库和书架,附属功能也比另外两家做得更完整。虽然豆包和元宝背靠大厂,有自己的生态,但就「打工人把它当工具用」这件事,秘塔更像个趁手的工具。
三家目前的共同短板是口径问题:同一个市场规模,三家能给出差距几倍的数字,AI 搜索能给你答案,但答案背后的口径是谁家的,得你自己留个心眼。这也是我对 AI 搜索的总体判断——它把「找到信息」变成了「给出答案」,但「答案对不对」这层责任,暂时还压在打工人自己身上。
标记,三个都在进化
MARK秘塔、豆包、元宝都在快速迭代,这篇写下的结论,可能一两个月后就过时。
我的建议是三个都装上,花一个下午各跑几个真实问题,找到最顺手那个。当然,也可以同时使用——不同任务挑不同的工具,写报告用秘塔,日常快问用豆包,深挖公众号用元宝。
最后补一句:AI 不会淘汰打工人,只会淘汰不会用 AI 的人。
秘塔:metaso.cn
豆包:doubao.com
元宝:yuanbao.tencent.com

登月者柯里昂
正在登月的前沿观察者
觉得有用?点个关注
登陆前沿、插旗标记、绘制地形,一起登月。
夜雨聆风