alephpi/Texo

A minimalist SOTA LaTeX OCR model with only 20M parameters, running in browser. Full training pipeline available for self-reproduction. | 超轻量SOTA LaTeX公式识别模型,仅20M参数量,可在浏览器中运行。训练全流程代码开源,以便自学复现。

解決的問題

Texo 是一個輕量級的開源 LaTeX OCR 模型,旨在將數學公式圖像轉換為 LaTeX 程式碼。它解決了 STEM 學習者和研究人員在數學筆記數位化過程中對快速、易用且精確工具的需求。

工作原理

Texo 是 PPFormulaNet-S 模型的蒸餾版本,隨後在 UniMERNet-1M 資料集上進行了微調。它結合了模型編碼器和解碼器來識別數學圖像中的模式,並將其轉換為 LaTeX 指令的封閉詞彙表。

適用對象

該專案主要面向需要快速將手寫或印刷數學公式轉換為 LaTeX 格式的 STEM 學生、AI 學習者和研究人員。

亮點

  • 極簡設計:僅包含 2,000 萬個參數,比 UniMERNet-T (107M) 等其他 SOTA 模型小得多。
  • 高性能:在 UniMERNet-Test 資料集上的 BLEU 和編輯距離指標方面,保持了與大型模型相當的性能。
  • 消費級訓練:可以在消費級 GPU 上進行訓練,最低要求為 16GB GPU 顯存。
  • 瀏覽器就緒:透過配套的 Web 專案支援直接在瀏覽器中執行。
  • 快速推理:針對輕量化和快速推理速度進行了優化。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • Dispatch