夜雨聆风学习资料网

ARTICLE · 1112930

中国电信开源1.2B文档模型:合同表格秒解析,办公先试

中国电信开源1.2B文档模型:合同表格秒解析,办公先试

编辑:方直AI 来源:公开资料

9月30日,中国电信开源了一个只有 12 亿参数的“小模型”,却在文档解析榜上把一众大模型比了下去。大模型的活,正在被“专科生”抢走。

1.2B 参数,干翻“全科生”

9月30日,中国电信星辰 AGI 实验室开源 TeleOCR,一个 12 亿参数的文档解析模型,在 OmniDocBench v1.6 拿到 96.87 分,并在 ICDAR 2026 等文档解析基准登顶。它不聊天、不写诗,只做一件事:把扫描件、合同、表格、票据里的文字和结构精准抽出来。

为什么“小”反而更划算?

大模型什么都会,但也什么都贵、什么都重。文档解析是高频刚需——金融、保险、政务每天要处理海量复杂单证。一个 12 亿的专用模型,部署成本低、硬件门槛小,反而比动辄千亿的通用模型更贴合企业工作流。这也是开源阵营的新信号:与其追通用旗舰,不如用“小而专”的模型打穿一个场景。

打工人怎么用上?

① 日常把纸质合同、报销单拍下来让模型抽字段,告别手工录;② 团队把它接进内部系统,做批量单证结构化;③ 关注开源权重,敏感合同可私有化部署,数据不出公司。

一个趋势判断

“通用大模型 + 专用小模型”的分层组合,会成为企业 AI 落地的主流形态。你不需要每个环节都上旗舰,把重复、规则清晰的活交给专科模型,才是降本的正解。

未来的 AI 办公室,不是一台全能怪兽,而是一支各司其职的专科小队。

回复「工具」领取《AI工具清单完全指南》,看哪些小模型能直接进你的工作流。

觉得有用,点个「在看」,明天继续拆当天最值得知道的那一条。你最想把哪种纸质文件交给 AI 处理?留言聊聊。

相关学习资料