先补一条这两周持续发酵的大事。它值得你再看一眼,因为这个赛道这个月明显在加速。
澳大利亚 Harrison.ai 发布 Harrison.Rad 1.5,一个放射科专用基础模型。它干的事和以前的影像 AI 不一样。以前的 AI 在片子上圈东西,它直接把报告初稿写出来。看图,调旧片做对比,写清病灶比上次增大了多少,顺手把心胸比这类测量值算好,还能按开单医生的临床问题调整措辞。
真正出圈的是这个:它通过了英国皇家放射科医师学会的 FRCR 2B Short Case 考试,中位数 86.5 分,及格线 73.2。这是第一个通过这项考试的 AI。FRCR 2B 是放射科医生执业路上的大考,考的就是给你一组片子,当场说出诊断。
先别慌,我特意去看了考试形式。Short Case 考的是"看片答诊断",考官把片子怼到你面前,你说这是什么病。这个能力当然重要,但它和写报告是两回事。
写报告难的不是认出病变,是知道什么该写进去,什么该略过去。一个肝囊肿写三行还是写一句?双肺底的间质性改变要不要跟旧片比?这些判断背后站着责任。报告是医疗文书,出了纠纷,法院看的是签名栏,不看 AI 的版本号。
Harrison 自己也清楚。官网明晃晃写着:产品没有获得任何监管审批,不能替代临床判断。它现在的身份是一个打字飞快的助手,初稿它出,但每一个字都得你核,名字也得你签。
而且不是一家在冲。6 月这一个月,Aidoc 的 First Read 拿了 FDA 突破性器械认定,做胸片危急重症的初步报告文本,还在研究阶段。HOPPR 的 Presto Agent 已经商用,直接嵌进 PowerScribe 出草稿。Signify Research 的月报干脆把这个月叫"报告起草月"。整个赛道在往同一个方向挤:AI 不只圈病灶了,它要开始写字了。
写出来的东西能不能直接用,前代产品有过一次实测。2025 年 5 月,麻省总医院的 AI Arena 拉了 113 名放射科医生,对上一代模型和真人医生的报告做了 2,840 次盲评。结果 AI 报告可接受率 65.4%,医生 79.6%。差距在缩小,但还没到闭眼放行的程度。
我的判断是:这类东西会先进科室,从省打字时间开始。但别指望省太多,它写的每一句话你都得逐字核对,漏掉的东西算你的,不算它的。这种场面我自己撞见过。深夜班上,科里那套 AI 兴冲冲圈了 8 个红框邀功,真正 2.5 公分的肺癌它绕着走。圈错了是误报,多花两分钟删。写漏了呢?报告里没写,就等于没看见。
AI 开始写字了,但写字和负责是两回事。初稿它能出,签名栏还是你的。省的是打字的时间,省不掉核对的眼睛。

AI 出初稿,签名栏还是你的
速览
AI 少胡说了 44%:QoQ-Med3 超 GPT-4o,靠的是更诚实
MIT 和约翰·霍普金斯联合做的多模态推理模型,7 月 25 日登在 npj Digital Medicine。平衡准确率 71.3%,压过 GPT-4o。两个数字我最在意:一是超声和乳腺钼靶这类冷门模态提升最大,大模型终于肯看冷门片子了;二是外源性幻觉率降了 44.4%,说白了就是"没根据的胡说"少了近一半。W7 我们刚抓过 AI 不看图背答案,这个方向算是学界给出的回应之一。
MAST 排行榜更新:GPT-5.5 领跑,Gemini 在影像子项反超
7 月 17 日 MAST 医学 AI 排行榜更新:GPT-5.5 综合 61.6% 继续领跑,Gemini 3.5 Flash 59.4% 紧追。有意思的是影像理解子项,Gemini 58.1% 对 GPT-5.5 的 57.6%,综合领先不等于单项领先。看这种榜单我的习惯是只看自己用得上的那一列,总分第一不代表读你的片子第一。
C 臂 X 线直接"变"CT:3D-Anywhere 拿到 FDA 通行证
7 月 16 日,Provect AI 的 3D-Anywhere 获 FDA 510(k):用手术室里常规 C 臂 X 线机,实时生成类 CT 的三维影像,不用再推病人去做 CT。脊柱、骨科手术导航的场景最直接。对我们基层也提个醒:影像 AI 的战场不只在诊断,还在成像本身。
如果科里明天上了"AI 写初稿"的功能,你会从头逐字核对,还是只扫一遍它标重点的地方?你觉得它省下的时间,够不够抵掉核对的风险?留言说说你的看法。
END
本周信源
Harrison.Rad 1.5:Harrison.ai 官方发布,2026.06。FRCR 2B Short Case 中位 86.5 分(及格线 73.2),训练含 600 万+ 诊断检查;公司声明产品未获监管审批,不替代临床判断。
报告起草赛道:Signify Research 月度报告,2026.07;Aidoc First Read 获 FDA 突破性器械认定(研究阶段);HOPPR Presto Agent 商用(嵌入 PowerScribe)。
前代盲测:MGB AI Arena,2025.05。113 名放射科医生,2,840 次盲评,AI 可接受率 65.4%,医生 79.6%。
QoQ-Med3:npj Digital Medicine,2026.07.25。DOI: 10.1038/s41746-026-02945-3。平衡准确率 71.3%,F1 0.349,外源性幻觉率降 44.4%,超声与钼靶模态提升显著。
MAST 排行榜:ARISE 2026.07.17 更新。GPT-5.5 综合 61.6%,Gemini 3.5 Flash 59.4%;影像子项 Gemini 58.1% vs GPT-5.5 57.6%。
3D-Anywhere:Provect AI,FDA 510(k),2026.07.16。C 臂 X 线实时生成术中类 CT 三维影像。
信源:npj Digital Medicine · arXiv · Harrison.ai · Signify Research · MGB AI Arena · MAST · FDA
夜雨聆风