ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

PDFMathTranslate 使用指南:一条命令翻译英文 PDF,公式和排版完整保留

PDFMathTranslate 使用指南:一条命令翻译英文 PDF,公式和排版完整保留 PDFMathTranslate 使用指南一条命令翻译英文 PDF公式和排版完整保留【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate英文论文想翻成中文最怕公式变乱码、双栏变单栏。PDFMathTranslatepdf2zh就是干这个的把 PDF 全文译成中文公式、图表、双栏结构原样保留还会同时生成纯译文和中英对照两个版本适合啃文献的学生和研究员。效果先给你看输入一篇英文 Nature 论文输出长这样翻译完成后版面结构和原文逐行对应连页眉页脚都没跑位下面的动画演示了它在翻译时如何处理跨栏文本最小路径跑通准备 Python 3.11 或 3.12 环境。安装pip install pdf2zh翻译pdf2zh document.pdf完事。当前目录会多出document-mono.pdf纯译文和document-dual.pdf中英对照。全程不用配密钥默认走 Google 翻译服务。按需加料用顺手之后这几个参数出场率最高-s换翻译服务如pdf2zh paper.pdf -s deepl或-s openai:gpt-4o-mini对应服务的密钥需先设成环境变量。-p只翻指定页码pdf2zh paper.pdf -p 1就翻第 1 页。-li/-lo指定源语言和目标语言如-li en -lo zh。-t并发线程数大文档可以调大提速。--dir整个文件夹批量翻译配合-o指定输出目录文献多的时候直接pdf2zh --dir ./papers/ -o results/。--ignore-cache强制重新翻译不走缓存。完整参数清单在 docs/ADVANCED.md包括用--prompt自定义 LLM 提示词、--config加载 JSON 配置这些玩法。换一种姿势不想碰命令行的话装完直接开图形界面pdf2zh -i浏览器打开http://localhost:7860/拖文件进去、选服务、点翻译就行详情见 docs/README_GUI.md懒得装 Python 环境就用 Docker拉镜像映射 7860 端口同样打开浏览器用docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zhWindows 用户还有 release 页的免安装 exe下载解压双击就能跑。这些情况先绕开扫描件翻不了。它解析的是 PDF 里的文本层纯图片扫描件先过一遍 OCR 再喂进来。Python 版本卡死。只支持 3.11~3.123.10 和 3.13 都装不上。首次运行模型下载慢。要拉取wybxc/DocLayout-YOLO-DocStructBench-onnx版面检测模型网络受限时设个镜像环境变量set HF_ENDPOINThttps://hf-mirror.com。另外Ollama、OpenAI 这类服务的密钥要先设好环境变量各服务对应的变量名在 docs/ADVANCED.md 的表格里查得到。收尾 PDFMathTranslate 把翻 PDF 还保住排版压缩成了一条命令的事而且被 EMNLP 2025 收录。装完翻一篇论文感受一下参数细节翻 docs/ADVANCED.md 就够。pip install pdf2zh【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表