目前大多数AI翻译软件或者平台,都是采用队列式翻译,即提交翻译任务,然后等待翻译完成下载翻译结果。而Owlangs是一款沉浸式的翻译软件,可以自动筛选和定位翻译失败的片段,方便对失败片段的翻译做二次修正。对翻译大文章和电子书非常有用。
最近把Owlangs做了一次升级,同时支持沉浸式翻译和队列翻译都支持,沉浸式翻译,适合希望对翻译结果进行检查的用户;队列式翻译,适合多用户共享一个部署的情景,对翻译结果要求较低的用户。
使用前需要配置MinerU平台和LLM平台的token API key,方法跟其他Agent类似,记得配置后测试一下链接,确保平台可用。有3个配置入口,在首页上的“配置向导”、“设置”->“AI平台”和在快速设置的平台设置里。
1,检查MinerU平台和LLM平台是否可用,如果可用状态等是绿色的,如果不可用,请先到设置里进行配置,测试连接成功,状态灯会变成绿色。
2,拖拽文件导入,软件会自动对PDF进行解析,这个过程会调用MinerU的API(本地部署的选MinerU(Local),MinerU官网的试用接口的选MinerU(Cloud)。
3,PDF解析的时候,如果PDF文件超级大,软件会自动对PDF文件进行分割,以适配MinerU的能力限制,这个过程软件自动完成,用户无需关注。解析完成后,得到的结果如下图:
中间是解析得到的文本片段,右侧是片段分类的统计。checkbox表示该类型被排除,不作翻译,比如参考文献不想翻译,页眉页脚也不想翻译,就是在这里设置的。

4,接下来有三条路径:
4.1 术语表,这里不赘述,软件基本是所见即所得,支持术语表的自动检测和增删改查,以及选择历史术语表,批量更新术语表,保存和导出等。术语表设置后,翻译的时候,会使用这些术语表进行翻译。
4.2 转换,即文档不作翻译,只是转换格式
4.3 翻译,点击翻译后,自动完成翻译。翻译结果的统计,以及与原文的对照,识别和标记翻译失败的片段,双击译文,可以进入编辑状态,直接在软件里修改。
4.4 重试,对于翻译失败的,可以修改提示词,或者更好LLM平台进行重翻,有些片段自己觉得不满意,也可以将这些片段标记为”Retry“。点击”重试“按钮,将会对这些片段进行重翻。

5,下载,支持多种格式的文档导出,UI很直观,不作赘述。
有一点要注意,有时PDF文档里包含有大量的LaTeX格式的文本,由于PDF解析也不是100%准确,存在失败的可能,如果遇到PDF导出失败,可以考虑先导出DOCX或者MD,再自己手动将其转为PDF。

这个工具对LaTeX转docx作了很好的兼容,能将公式和表格自动完成格式转换,非常适合用于科研文献的处理。
下面是这个PDF文件导出的word文件的截图,LaTeX格式的公式都自动转为Word的公式格式

开源社区:
https://github.com/zampher/Owlangs
Github上有交流群信息和联系信息
如觉得有用,请在Github上帮我标个星,谢谢!
夜雨聆风