ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

一条命令译出保留排版的双语论文:PDFMathTranslate 快速上手完整指南

一条命令译出保留排版的双语论文:PDFMathTranslate 快速上手完整指南 一条命令译出保留排版的双语论文PDFMathTranslate 快速上手完整指南【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslatePDFMathTranslatepip 包名pdf2zh是一款免费开源的 PDF 论文全文翻译工具适合需要批量阅读外文文献的研究生、科研人员与工程师。它先用版面分析模型把页面自动切成正文、公式、图片等区域的方法找出文本区再调用 Google、DeepL、OpenAI 等服务逐段翻译最后把译文写回原坐标公式与分栏原样保留。能力说明排版保留公式、图表、目录留在原位支持多栏与跨页文档双份产物一次翻译同时产出-mono.pdf纯译文与-dual.pdf双语对照可换翻译服务Google、DeepL、OpenAI、Ollama 等十余种可接任意 OpenAI 兼容接口多形态命令行、网页、Docker、MCP 服务、Python / HTTP API三步译出第一份保留排版的双语 PDF环境要求 Python 3.11 或 3.12三步走完。第一步安装pip install pdf2zh你会得到pdf2zh命令可用。首次运行会自动下载约几十 MB 的版面检测模型。模型下载失败怎么办先把模型源指向镜像CMD 用set HF_ENDPOINThttps://hf-mirror.comPowerShell 用$env:HF_ENDPOINT...然后重跑下一条命令。第二步翻译你的 PDFpdf2zh paper.pdf你会得到当前目录下的paper-mono.pdf纯译文和paper-dual.pdf中英对照。默认走 Google 翻译不需要配置任何密钥。第三步打开-dual.pdf检查公式与分栏是否和原文一致。左侧英文原文、右侧中文译文公式编号都留在原位选对入口省时间命令行、网页界面与 API三种入口对应三种用法选一种即可。命令行控制语言、页码与翻译服务pdf2zh paper.pdf -li en -lo zh -p 1-3,5你会得到只翻译第 1~3 页和第 5 页。-s换翻译服务服务:模型写法可直接指定模型如-s openai:gpt-4o-mini长文档加-t 8提高线程数。网页界面上传、配置、预览下载pdf2zh -i你会得到浏览器自动打开http://localhost:7860/上传 PDF、选服务与目标语言翻译完成后可直接预览并下载两个结果文件加--share可生成临时外链供团队访问--authorized users.txt按用户名,密码文件限制登录细节见 GUI 文档。Python 与 HTTP API接进自己的程序from pdf2zh import translate (file_mono, file_dual) translate( files[example.pdf], lang_inen, lang_outzh, servicegoogle, thread4 )[0]你会得到脚本里一行调用返回两个结果文件的路径。要自建在线服务装pdf2zh[backend]后运行pdf2zh --flask与pdf2zh --celery workerCelery 是任务队列负责接住并执行翻译任务再用 REST 接口基于 HTTP 的应用接口提交任务、查进度、下载结果细节见 API 文档。MCP让 AI 助手替你翻译pdf2zh --mcp你会得到一个 MCP 服务MCP 是模型上下文协议让 AI 助手调用外部工具的标准接口注册到 Claude Desktop 后用自然语言就能让它找文件并翻译。把翻译装进工作流批量目录、缓存与自定义提示词批量翻译整个目录pdf2zh --dir /path/to/papers/你会得到目录里的每个 PDF 被逐一处理适合文献整理。缓存、配置与自定义提示词已翻译的文本段会写入缓存重翻同一文档不再消耗 API 额度要强制重译加--ignore-cache。--config config.json预置语言、字体路径与多组服务密钥--prompt prompt.txt自定义发给大模型的指令模板含${lang_in}、${lang_out}、${text}三个变量适合注入领域术语。API 需要走自建中转时见 代理配置文档注意BASE_URL要带/v1后缀。不装 Python 也能跑Docker 与免安装版团队共用一台翻译服务用 Docker 最省事docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh你会得到启动后浏览器访问http://localhost:7860/拿到和本机一样的网页界面二次定制用仓库里的 Dockerfile 与 docker-compose.yml。不想装 Python 的 Windows 用户发布页提供pdf2zh.exe压缩包解压双击即可运行打不开就按提示补装 VC 运行库。另有实验开关--mode precise启用 v2 翻译内核先运行pdf2zh-setup-precise搭独立环境面向跨栏一致性等边缘场景--babeldoc换用 BabelDOC 后端另一个 PDF 排版翻译引擎。对照能力边界再下手能翻与不能翻的 PDF适合带文本层的电子 PDF论文、技术报告、标准、教材用-dual.pdf对照学习双语表达批量、可复现地处理整目录文献把翻译接进自有系统或 AI 助手API / MCP。不适合或需要留意扫描版、图片型 PDF识别的是 PDF 内嵌文本纯图片页要先做 OCR把图片里的字转成可编辑文本付费服务的密钥配在哪环境变量或--config配置文件里DeepL、OpenAI、Gemini 等需填 API Key变量名对照表见 docs/ADVANCED.md翻译质量取决于所选服务术语要求高就换 DeepL 或大模型并配--prompt本地运行要 Python 3.11–3.12用 Docker 或免安装版可绕过。现在就可以跑pip install pdf2zh后执行pdf2zh paper.pdf几分钟拿到第一份双语对照论文。深入参数看 docs/ADVANCED.md集成开发看 docs/APIS.md项目以 AGPL-3.0 开源。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表