ARTICLE · 1042392
端到端文档解析模型WeVisDoc
端到端文档解析模型WeVisDoc
微信正式开源
端到端文档解析模型WeVisDoc
单张图片直接输出Markdown格式内容
正文输出Markdown
公式输出LaTeX
表格输出HTML
支持拍照合同翻拍论文扫描报表输入
模型为单模型端到端架构
覆盖版面理解 覆盖文字识别
覆盖公式识别 覆盖表格重建
无需拆分流水线
提供两个开源版本
2B版本轻量便于部署
4B版本对退化页面稳定性更强
OmniDocBench v1.6得分九十五点三八
位列端到端组别第一
PureDocBench三赛道均值七十五点五四
Clean Digital Real赛道全部拿到第一
公式表格处理是核心优势
脏图场景表现优于多数流水线方案
模型基于Qwen3‑VL‑2B和4B构建
采用Apache2.0协议开源
论文链接
https://t.co/2wEWU308bX
GitHub仓库链接
https://t.co/eWF2lGMJ3x
作者提示: 个人观点,仅供参考
北京,2小时前,