cs-chan/Total-Text-Dataset
Total Text Dataset. It consists of 1555 images with more than 3 different text orientations: Horizontal, Multi-Oriented, and Curved, one of a kind.
解决的问题
本项目提供一个专门用于自然场景中弯曲文本检测的数据集,解决了识别非直线水平文本(任意形状文本)的挑战。
工作原理
Total-Text 是一个单词级别的英文弯曲文本数据集。它提供多种格式的标注数据,包括文本级和像素级标注,帮助模型学习检测非线性文本。该仓库还包含一个基线实现(Poly-FRCNN-3)、用于创建场景文本图像标注的引导式标注工具箱,以及一个评估脚本(DetEval.py),可用于通过精确率、召回率和F分数来基准检测性能。
适用对象
专为从事场景文本检测的计算机视觉研究人员和开发者设计,特别是专注于任意形状或弯曲文本识别任务的人员。
亮点
- 聚焦弯曲文本:专门针对弯曲或任意形状的单词级英文文本。
- 全面的标注数据:提供文本级和像素级的标注数据。
- 标注工具:包含用于场景文本图像标注的专用引导式标注工具箱。
- 基准测试:维护一个详细的检测排行榜,用于比较各种最先进方法的性能。
相关
- 项目
- 项目
- 项目
- 项目
- 项目