alephpi/Texo

A minimalist SOTA LaTeX OCR model with only 20M parameters, running in browser. Full training pipeline available for self-reproduction. | 超轻量SOTA LaTeX公式识别模型,仅20M参数量,可在浏览器中运行。训练全流程代码开源,以便自学复现。

What it solves

Texo 는 가볍고 오픈소스인 LaTeX OCR 모델로, 수학 공식 이미지 를 LaTeX 코드 로 변환하도록 설계되었습니다. 손글씨 혹은 인쇄된 수학 표현식을 디지털화해야 하는 STEM 학습자와 연구자들이 무료·빠르고 접근하기 쉬운 도구가 필요하다는 문제를 해결합니다.

How it works

Texo 는 PPFormulaNet‑S 모델을 증류한 버전이며, UniMERNet‑1M 데이터셋에 대해 파인튜닝되었습니다. 모델은 PaddleOCR 의 PPHGNetV2 기반 아키텍처를 사용하고, 디코더와 토크나이저는 Hugging Face Transformers 프레임워크를 활용합니다. 파라미터 수가 2천만 개에 불과하도록 최적화돼 있어 일반 소비자용 GPU는 물론 웹 브라우저에서도 효율적으로 실행됩니다.

Who it’s for

  • STEM 학습자 및 연구자: 수식 이미지를 빠르게 LaTeX 로 변환해야 하는 사용자.
  • 개발자: 애플리케이션에 통합하거나 브라우저에서 실행할 수 있는 경량 OCR 모델을 찾는 사람.
  • ML 실무자: OCR 전용 증류 및 파인튜닝에 관심이 있는 개인.

Highlights

  • 초경량: 파라미터가 20M 뿐이며, UniMERNet‑T(107M) 등 다른 SOTA 모델에 비해 현저히 작습니다.
  • SOTA 성능: UniMERNet‑Test 데이터셋에서 BLEU 및 Edit distance 지표가 더 큰 모델과 견줄 만합니다.
  • 접근성: 무료·오픈소스(AGPL‑3.0)이며, 별도 웹 구현을 통해 브라우저에서도 실행할 수 있습니다.
  • 학습 가능: 최소 16GB GPU 메모리를 갖춘 소비자 수준 GPU에서도 학습이 가능합니다.
  • 포괄적: 학습 스크립트, 데이터 정규화 도구, 기술 보고서가 포함되어 있습니다.