PDFMathTranslate/PDFMathTranslate
[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero
解決的問題
解決在保留原始版面的同時翻譯科學PDF文件的問題。傳統翻譯方式經常破壞複雜文件的格式,而此工具確保在翻譯過程中,公式、圖表、目錄與註解等元素均完整保留。
工作原理
該系統結合精確的版面偵測(透過 DocLayout-YOLO)與大型語言模型(LLMs),在維持文件結構的同時識別並翻譯文字。支援多種翻譯服務(如 Google、DeepL 和 OpenAI),可作為命令列工具、基於 Web 的互動式介面,或透過 Docker 部署。可產生單語翻譯文件或雙語版本。
適用對象
專為需要以母語閱讀科學論文與技術文件的研究人員、學生與專業人士設計,確保不遺失原始版面的重要視覺上下文。
主要亮點
- 版面保留:公式、圖表與註解保持在原始位置。
- 靈活部署:支援 CLI、GUI、Docker 映像與 Zotero 插件形式。
- 服務無關:支援多種翻譯後端,包括 Google、DeepL 與 MiniMax。
- 雙語輸出:可產生包含源語言與目標語言的雙語文件。
寫過它的文章
相關
- 專案
- 專案
- 專案
- 專案
- 專案