PDFMathTranslate/PDFMathTranslate

[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero

解決的問題

解決在保留原始版面的同時翻譯科學PDF文件的問題。傳統翻譯方式經常破壞複雜文件的格式,而此工具確保在翻譯過程中,公式、圖表、目錄與註解等元素均完整保留。

工作原理

該系統結合精確的版面偵測(透過 DocLayout-YOLO)與大型語言模型(LLMs),在維持文件結構的同時識別並翻譯文字。支援多種翻譯服務(如 Google、DeepL 和 OpenAI),可作為命令列工具、基於 Web 的互動式介面,或透過 Docker 部署。可產生單語翻譯文件或雙語版本。

適用對象

專為需要以母語閱讀科學論文與技術文件的研究人員、學生與專業人士設計,確保不遺失原始版面的重要視覺上下文。

主要亮點

  • 版面保留:公式、圖表與註解保持在原始位置。
  • 靈活部署:支援 CLI、GUI、Docker 映像與 Zotero 插件形式。
  • 服務無關:支援多種翻譯後端,包括 Google、DeepL 與 MiniMax。
  • 雙語輸出:可產生包含源語言與目標語言的雙語文件。

寫過它的文章

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案