alephpi/Texo
A minimalist SOTA LaTeX OCR model with only 20M parameters, running in browser. Full training pipeline available for self-reproduction. | 超轻量SOTA LaTeX公式识别模型,仅20M参数量,可在浏览器中运行。训练全流程代码开源,以便自学复现。
What it solves
Texo 是一個輕量、開源的 LaTeX OCR 模型,旨在將數學公式圖片轉換為 LaTeX 代碼。它解決了 STEM 學習者與研究人員需要免費、快速且易取得的工具,以數位化手寫或印刷的數學表達式的需求。
How it works
Texo 是 PPFormulaNet‑S 模型的蒸餾版,於 UniMERNet‑1M 資料集上進行微調。它使用基於 PaddleOCR 的 PPHGNetV2 架構,並利用 Hugging Face Transformers 框架作為解碼器與分詞器。模型高度優化,僅有 20 百萬參數,能在消費級 GPU 甚至瀏覽器中高效執行。
Who it’s for
- STEM 學習者與研究人員:需要快速將數學圖片轉成 LaTeX 的使用者。
- 開發者:尋找可整合至應用程式或在瀏覽器中執行的輕量 OCR 模型。
- 機器學習實踐者:對於蒸餾與微調專門 OCR 任務感興趣的個人。
Highlights
- 超輕量:僅 20M 參數,遠小於 UniMERNet‑T(107M)等其他 SOTA 模型。
- SOTA 表現:在 UniMERNet‑Test 資料集上於 BLEU 與 Edit distance 指標上與更大型模型相當。
- 易取得:免費且開源(AGPL‑3.0),可透過獨立的網頁實作在瀏覽器中執行。
- 可訓練:可在消費級 GPU(最低 16G 記憶體)上進行訓練。
- 完整套件:包含訓練腳本、資料正規化工具與技術報告。