67%。这个数字足够让任何医生停下手里的咖啡
一份刚进入美国联邦法院的诉状称,梅奥诊所内部数字助手 MAYA 的错误率曾高达 67%,研究人员还删除不利结果、歪曲测试表现提出警报的人,是梅奥雇来管 AI 合规的研究运营总监她后来的结局颇有黑色幽默:守门人拉响警报,门还在,她先被请出了大楼
这里必须先限定范围:67%目前是原告一方的指控公开资料没有说明它测的是什么任务、分母多大、发生在研发测试还是临床流程;法院也尚未作出事实认定。然而,诉状里紧挨着这个数字的“删除结果”,让事情迅速冲上社交平台


▲ 种子帖集中提到67%错误率、删除不利结果和“竞争优势”
被雇来踩刹车的人,收到“尽快除掉她”的指令
原告名叫 Traci Tamiko Eto(特蕾西·多美子·埃托)据诉状,她于 2023 年 12 月加入梅奥,管理约 36 名员工和 3 名经理,同时承担 AI 合规相关职责
2024 年初,她开始质疑 Mayo Clinic Platform(梅奥诊所平台)共享患者数据时的去标识化审查诉状转述上司给出的理由:重新审查会拖慢项目,损害梅奥的“竞争优势”几个月后,她又报告了高风险心脏试验器械未经机构审查委员会批准、未授权软件进入临床流程、基因组数据共享超出原知情同意范围等问题
MPR News 的首发报道称,围绕 MAYA 的内部警报多达十份诉状指控团队掩饰 67% 错误率,并让数据安全暴露于风险之中

▲ MPR News于2026年7月9日首发报道,标题直指患者照护与隐私风险
MAYA确实存在,67%究竟怎么算仍是谜
梅奥自己的临床研究页面,确认了 MAYA 的身份:它是一款用于增强电子病历数据检索的数字助手,研究类型为观察性研究,亚利桑那州项目已停止招募
该页面未披露 67% 这一数字,公开渠道也查不到验证报告公开材料没有定义错误类型,检索失败、遗漏关键病史与内容捏造的风险等级相差很大,任务未完成率更不能直接等同于临床差错率同一个百分比,落在搜索框和临床决策上,风险完全不同

▲ 官方页面写明研究目的是评估MAYA增强数据检索的有效性,但没有公布错误率
这也解释了为什么诉讼的下一步很关键若案件进入证据开示,完整测试档案和内部通信才可能找到 67% 对应的分母在那之前,把它写成“梅奥 AI 三次错两次”的定论,等于先替法庭按下回车键
加薪7000美元,几周后却成了“文化不合”
技术警报之后,诉状描述了一条陡峭的人事下坡
2025 年 2 月,埃托向法务部门提交报告,很快被排除在高管会议之外一名 AI 工程负责人据称警告她,上级已有 “marching orders to get rid of Tamiko ASAP”,“已下令尽快除掉多美子”
次月,她刚获得约 7000 美元加薪,年薪升至约 16.6 万美元,几周后便进入绩效改进计划,理由是 “poor cultural fit”,即“文化契合度差”到 7 月,她失去团队管理权,也被移出自己参与发明的 AI Protocol Builder(AI 协议构建器)项目及相关专利申请
职业压力引发焦虑和抑郁症状。诉状称,梅奥起初拒绝她的家庭与医疗假法(FMLA)休假申请,律师介入后才批准2025 年 9 月 2 日,假期过半,她收到岗位取消通知;12 月 1 日正式终止雇佣。诉状还称,这次裁员只涉及她一人。

▲ MedPath转述诉状细节;这些内容仍待梅奥答辩及法庭质证
医院AI的闸门,为什么比模型排行榜更重要
机构审查委员会 IRB(Institutional Review Board)听起来像一间专门盖章的办公室它实际管着人体研究的风险收益、知情同意和隐私保护病历完成“去标识化”后也未必从此安全;数据源一旦交叉,重新识别的可能性会回来
医疗软件的用途同样决定监管强度。查找院内信息技术(IT)文档和影响诊疗判断,隔着一条很深的责任鸿沟算法若漏掉过敏史,流畅的语气只会让错误穿上白大褂可靠部署离不开可追溯的验证记录。临床人员还得能独立复核,合规人员必须拥有真实否决权
梅奥向 MPR 提供的声明写道:
“Our research and clinical innovation are conducted in accordance with applicable laws and regulations.”
“我们的研究与临床创新均依照适用法律法规开展。”
梅奥还表示,隐私、安全、透明和合规已经嵌入 AI 流程,并拒绝评论进行中的诉讼这是机构目前公开给出的边界,逐项技术答辩仍未出现
发布会刚谈“信任”,一个月后诉状抵达法院
两项事件只隔了一个多月。2026 年 6 月 2 日,梅奥与微软宣布共建医疗前沿 AI 模型,强调去标识临床数据、真实环境验证和患者信任;7 月 6 日,埃托的诉状提交至明尼苏达联邦地区法院

▲ 这项合作与MAYA分属不同项目;相邻的发布时间把梅奥AI治理推到聚光灯下
目前没有证据显示微软合作项目涉及诉状中的同类问题两件事前后脚出现,依然揭开了医疗 AI 军备竞赛最难看的褶皱:发布会上,“更快”意味着更早诊断;合规会议里,“更快”可能意味着审查员成了进度条前的人形弹窗
一位牙医在讨论此案时写下:
“Your license does not delegate responsibility to an algorithm.”
“你的执业许可不会把责任委托给算法。”



▲ 临床从业者把焦点落回验证、隐私、知情同意与人的最终责任
这句话给案件留下了最硬的一根标尺未来,法庭将判断劳动报复等主张能否成立证据开示若继续推进,内部验证资料还有机会进入公共记录医疗 AI 的信誉无法靠发布会维持。它要保留坏结果,并允许红灯真把项目停下拉响警报的人,也应继续坐在会议桌旁
夜雨聆风