AI赋能传统中医,早已不是遥远的科技概念,而是走进大众生活的实用工具。近两年,各类AI中医模型层出不穷,其中开源模型凭借免费、可落地、可自研微调的优势,成为个人爱好者、中医从业者、科创玩家的首选。
目前市面上公开可用的开源AI中医模型已有十余款,但绝大多数人都有同一个疑问:这些模型真实诊疗水平如何?谁辨证更准、看舌更靠谱?能不能作为日常养生参考?
今天我们依托行业公开权威测评数据,用通俗易懂的白话,横向拆解主流开源AI中医模型的真实实力,避开AI中医误区,帮大家精准选出实用、靠谱的工具。
一、先分清两大流派:文本辨证派 & 视觉舌诊派
市面上所有开源AI中医模型,核心分为两大赛道,二者测评维度不同、擅长领域不同,不能直接混为一谈对比。
1. 文本辨证派:问诊开方,主打文字辨证
这类模型主打文字交互,用户口述身体症状、体感、作息问题,模型自动完成中医辨证、证型判定、方药参考。
主流代表:仲景(ZhongJing)、HuatuoGPT、JingFang系列等。
2. 视觉舌诊派:看图辨质,主打图像识别
这类模型聚焦中医望诊核心,通过拍摄舌象照片,智能识别舌色、苔色、厚薄、齿痕、瘀点等特征,判定体质与病理状态。
主流代表:TongueDiagnosis、TongueLMM、ShizhenGPT视觉版等。
二、文本模型硬核PK:辨证准确率差距悬殊
业内专业团队依托JingFang Benchmark权威测评基准,采用近9000份真实临床中医病例,对各大模型进行标准化统考,以专业F1准确率值为核心评判标准,结果极具参考性。
第一名:JingFang系列模型
辨证F1值可达0.82左右,是目前开源赛道的天花板级别。该模型经过海量真实中医医案专项训练,辨证逻辑贴合临床思维,综合能力对标规培2-3年的专业住院医师,是辨证开方最靠谱的开源模型。
第二名:ShizhenGPT-32B
深耕中医专业题库与医案数据,在国家中医执业医师标准化考试中,可稳定取得78分的优异成绩,属于AI中医中的“学霸级别”,辨证严谨度极高。
第三名:通用大模型(GPT-4o等)
无任何中医专项数据微调,仅依靠通用知识库作答,辨证F1值仅0.25。面对复杂中医证型,基本等同于随机判断,参考价值极低。
垫底:初代仲景开源模型
受限于早期训练数据体量不足、医案储备匮乏,辨证F1值仅0.03,几乎不具备独立辨证能力,容易出现证型错判、方药混乱等问题。
核心结论
开源AI中医的核心实力,不取决于模型参数大小,只取决于是否经过标准化中医临床医案专项训练。专项微调=真懂中医,通用套答=假性科普。
三、视觉舌诊大测评:谁能精准读懂舌象密码?
舌诊是中医望诊的核心,也是AI中医落地最成熟的场景。测评主要针对舌色、苔质、齿痕、裂纹、瘀斑等关键特征识别准确率,梯队差距十分明显。
第一梯队:中医专属多模态模型
代表模型:TongueLMM、ShizhenGPT视觉版、BenCao
整体识别准确率稳定在65%-78% 。能够精准区分日常常见舌象,适配大众体质辨识、日常养生筛查需求,是目前最实用的开源舌诊模型。
第二梯队:传统图像分割算法模型
采用“舌体抠图+特征分类”流水线模式,最优准确率可达75%。但短板非常明显,极度依赖标准光线、正面清晰原图,环境稍有干扰,识别准确率大幅下滑,泛化能力较弱。
第三梯队:通用多模态大模型
以GPT-4o为代表,舌诊整体准确率不足40%。无法区分淡红舌、淡白舌、薄白苔、白厚苔等基础差异,完全达不到中医入门标准,绝对不适合用于体质诊断。
四、深度拆解:模型实力差距的3个核心原因
1. 训练数据的专业度天差地别
专业AI中医模型,投喂的是数十万份真实临床医案、数万张人工标注的标准舌象照片,数据精准、逻辑贴合中医理论。
而通用大模型仅抓取互联网零散碎片化信息,没有系统中医知识体系,更无临床实战数据支撑。
2. 模态能力各有短板
单一文本模型只会问诊辨证,单一视觉模型只会看舌辨象。
目前顶尖的AI中医,均为文本+视觉双模态融合,可以结合用户口述症状+舌象特征综合判证,无限贴近中医“问诊+望诊”的诊疗逻辑,精准度大幅提升。
3. 行业缺乏统一权威评测标准
多数模型仅能在自家测试数据集上取得高分,一旦更换公开通用测评基准,成绩便大幅跳水。目前国内尚未建立统一的AI中医行业考核标准,导致部分模型存在“虚高测评”的情况。
五、精准选型指南:普通人直接照着选
✅ 需要专业辨证、参考方剂调理
优先选择:JingFang系列、ShizhenGPT
(临床数据最优,辨证逻辑严谨,适合养生参考、中医学习)
✅ 日常自测舌象、简单体质辨识
优先选择:TongueLMM、ShizhenGPT视觉版
❌ 绝对避雷
禁止使用GPT、Claude等通用大模型做中医诊断,误诊误导风险极高。
六、客观认知:AI中医的现状与未来趋势
从整体测评结果来看,开源AI中医已经实现了从“人工科普”到“智能辨证”的跨越式升级,普通人免费即可使用专业级中医AI工具,是传统中医药数字化落地的重大突破。
但我们必须理性看待:现阶段所有AI中医模型,均无法替代线下执业医师。
中医核心精髓是“望闻问切、四诊合参、辨证论治、因人施治”,而当前AI仅能实现问诊、望诊两大模块,缺失脉诊、闻诊核心环节,无法兼顾人的情志、体质、地域、季节等综合变量。
站在AI科技发展视角来看,中医智能化是不可逆的趋势。未来随着多模态融合、大模型专项微调、千万级中医医案数据库的完善,AI中医将成为家庭健康管理、日常养生调理的绝佳辅助工具,实现传统中医与现代AI科技的双向赋能。
重要温馨提示
本文所有模型测评数据,均来源于TCM-Ladder、TCM-3CEval、JingFang Benchmark公开权威实验结果,仅作科普学习、工具参考使用。AI结果不可作为诊疗、抓药、治病依据,身体不适请及时前往正规医疗机构就诊。
夜雨聆风