cs-chan/Total-Text-Dataset

Total Text Dataset. It consists of 1555 images with more than 3 different text orientations: Horizontal, Multi-Oriented, and Curved, one of a kind.

解決的問題

本專案提供一個專門用於自然場景中彎曲文字檢測的資料集,解決了識別非直線水平文字(任意形狀文字)的挑戰。

工作原理

Total-Text 是一個單詞級的英文彎曲文字資料集。它提供多種格式的真實標註資料,包括文字級與像素級的標註,以幫助模型學習檢測非線性文字。該儲存庫還包含一個基線實作(Poly-FRCNN-3)、用於建立場景文字影像標註的引導式標註工具箱,以及一個評估腳本(DetEval.py),可使用精確率、召回率與 F 分數來基準化檢測效能。

適用對象

專為從事場景文字檢測的電腦視覺研究人員與開發者設計,特別是專注於任意形狀或彎曲文字識別任務的人員。

亮點

  • 聚焦彎曲文字:專門針對彎曲或任意形狀的單詞級英文文字。
  • 全面的真實標註:提供文字級與像素級的真實標註資料。
  • 標註工具:包含專用的引導式標註工具箱,用於場景文字影像標註。
  • 基準測試:維護一個詳細的檢測排行榜,用於比較各種最先进方法的表現。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案