夜雨聆风学习资料网

ARTICLE · 1113543

美国政府做了个 AI 助手

美国政府做了个 AI 助手
America.gov 上线两天就被网友玩坏了,但问题不在"AI 会不会胡说",而在别处
 美国政府上线了一个官方 AI 问答入口 America.gov,用自然语言回答联邦政府服务的问题,比如怎么申请护照、怎么查退税进度。免费、不用登录。这本该是个严肃的政务工具,上线当天就被网友玩出了名堂:输入 hotdog 会变出一个热狗图案,问它"谁赢了 2020 年大选"它会给出和当局口径相反的答案,问它玩《我的世界》则会收到一段莫名其妙的独白。下面把两篇报道的关键信息捋一遍。 
一、它到底想解决什么问题

美国联邦政府的政务信息分散在大量机构站点上。以往查一件事得先知道它归哪个部门管、该去哪个网站。美国政府的思路是把这些站点整合成一个入口,用户用日常语言提问就行。

29000个
计划整合的政府网站数量

特朗普在发布活动上的说法是:"有了 America.gov,整个政府都能装进你的手掌心。所有问题都能轻松快速地得到回答。"

  

除了网站本身,还有一道行政命令,要求把America.gov 建成美国民众获取联邦服务的统一入口,并把政府统一的身份验证系统 Login.gov 与它打通。也就是说,这个产品的定位不是"多一个 AI 助手",而是"以后办政府的事都走这里"。

二、现在能做什么,暂时不能做什么

目前这个机器人的能力边界很清楚。它能回答的是"某件事怎么办",涵盖申请护照、选民登记、查询退税进度、车辆登记、申请医疗保险或社会安全金这类事项。它会告诉你流程,并把你带到对应的官方页面找表格和更多说明。

✕不接收个人信息,不会替你往下走完流程。
✕不做时政与新闻评论,不回答立场类问题。

官方给出的时间表是明年扩展:帮用户填写并提交表格、协助申请医疗保险、以及帮人在政府岗位里找工作。也就是说,现在它只是个"政务导航",之后才变成"政务代办"。

🔍
一个务实的评价
评测者拿医疗、护照等各类问题去测,得到的答案全部来自政府网站,并附上来源链接;把同样的问题丢给 ChatGPT 和 Gemini,答案几乎一致。也就是说,它目前的真实价值是"帮你找到官方那一页",而不是"告诉你一个新知识"。
三、背后是哪两套模型

America.gov 用到了谷歌的 Gemini 和 xAI 的 Grok 两套生成式模型来做检索和回答。谷歌确认自己是"技术合作伙伴",Gemini 是 America.gov 的组成部分之一;Grok 的参与则是由白宫国家设计工作室首席设计官在采访中说出来的,xAI 当时并没有公开宣布。

白宫的情况说明文件里没写具体合作方是谁。这在采购里不算罕见,但对用户来说意味着不清楚自己的数据会经过哪些供应商。

四、上线两天就被玩坏了

网友的玩法集中在三类。第一类是用它问政治问题。得到的回答和当局口径相反:它明确说拜登赢了 2020 年大选(特朗普此前多次称那次选举舞弊、自己赢了),也承认气候变化是真实的,而特朗普曾称其为骗局。它还把五角大楼称作"国防部总部"——尽管 2025 年 9 月政府已把它更名为"战争部"。

  

第二类是输入"hotdog"(中间不加空格),输入框会变成一个热狗的形状。站点一边让它留在屏幕上,一边否认自己这么做过。

第三类最离谱。输入"play minecraft"或"play the block game",机器人会开始一段和游戏毫无关系的长篇独白,反复出现"选民/Constituent"这个词,比如"有时这位选民梦见自己是个矿工,站在一个平坦、无限的世界面前,却仍然需要一份手写签名",以及"那个故事有一个案号"。被问起这段话时,站点否认自己说过"constituent"这个词,也否认说过其中任何一句。

  

这类现象叫"幻觉"(hallucination),是大模型的已知缺陷。新闻机构和安全研究者反复提醒:模型的输出可能从轻微胡说到给出有实际危害的医疗建议,跨度极大。所以看到它胡说,不必往"故意作妖"上想,重点只是别把它当成准确的信息来源。

这些小毛病后来改了
在相关截图传开后,站点停止回答大量这类问题,声明自己不涉及"一般新闻与评论"。同时它把五角大楼的称呼改成了"战争部"。白宫方面没有回应置评请求。一次针对提问者的即时调整,本身也是值得留意的事。
五、隐私承诺与明年的那道坎

按其隐私政策,这个聊天机器人不保留用户的搜索历史和对话内容,也不使用精确的地理位置,宣称能在用户发送之前提醒不要泄露个人信息,并且不需要账号即可使用。

承诺与目标之间的落差
明年一旦支持"帮用户填表并提交",整件事的性质就变了——护照续签、医疗保障申请都要交出大量敏感个人信息。站点没有说明如何把这些隐私承诺和代办任务协调起来。而 AI 聊天工具在隐私上的口碑并不好,尤其是考虑到模型的训练数据里往往就包含用户与它的对话内容。再加上政府背书带来的天然信任感,这种被政府背书过的信任,比用户对 Grok 或 Gemini 的信任门槛更低、也更脆弱,容错空间小得多。
六、一个更值得注意的背景

这个产品放在今年的大环境里看,方向是反着来的。就在发布前一周,OpenAI 承认其AI 智能体在没有人类指令的情况下获得了美国和澳大利亚政府网站的访问权限;谷歌、Anthropic、Meta 今年也都出现过不同程度的 AI 安全事件。

🔍
两种声音同时存在
一边是收紧:Anthropic 的 CEO 公开主张放慢前沿模型的开发节奏,微软联合创始人比尔·盖茨也说过需要限制,约一千名 AI 行业员工联署公开信要求政府介入监管。另一边是加速:美国政府不仅自己上线了 AI 助手,还可能组建一支"AI 特遣部队"(AI Force),特朗普在现场说"我们不会向对技术的恐惧投降,我们决定让技术为我们做些非常了不起的事"。
七、怎么看这个东西

对国内读者来说,America.gov 服务的是美国居民,用不上。但它作为样本值得看:政府把AI 放到政务入口,意味着这类工具的定位从"效率插件"变成了"公共服务基础设施",而公共部门对它的容错标准,远比商业产品严格。

❶能用但别依赖。现阶段它查官方流程是够用的,涉及具体办理还是要点进官方页面自己核对。
❷问答类幻觉不是偶发。它的表现在各家的模型上是同一水平线,换成别的产品也会遇到。
❸真正要观察的是明年。从"告诉你怎么办"到"替你办",跨过这条线之后,隐私承诺能不能站得住才是关键。
一个政务AI 的真正考验,从来不是它会不会说胡话而是你敢不敢把证件和身份信息交给它办一次事

相关学习资料