dromara/wgai
开箱即用的JAVA AI 图片、视频语音识别&OCR平台AI合集包含旦不仅限于(车牌识别、安全帽识别、开门关门、常用类物识别等) 图片和视频识别 可自主 融合了AI图像识别opencv、yolo、ocr、esayAI内核识别;AI智能客服、AI语言模型、 无任何第三方API接口可定制化自主离线化部署并自主化行业化使用 避免占用内存、GPU消耗训练与识别分开使用;
解决的问题
WGAI 提供一个一体化的多模态 AI 管理平台,使用户无需为每种模态单独构建基础设施,即可部署工业级 AI 服务,如计算机视觉、语音识别和机器人导航。
工作原理
该平台集成了 OpenCV、YOLO、OCR 和 ChatGPT 等多种 AI 核心。采用训练与识别分离的架构,防止内存和 GPU 消耗过高,支持高效的离线部署。支持全栈服务器设置,涵盖从在线数据标注、模型训练到实时视频分析和 AGV(自动导引车)导航的全流程。
适用人群
专为需要集中式、离线能力的工业用户和开发者设计,用于管理人脸识别、车牌检测和自主机器人导航等多模态 AI 任务。
核心亮点
- 多模态集成:整合视觉(YOLO、OpenCV)、文本/语音(OCR、语音识别)和机器人(AGV 导航)功能。
- 机器人智能:包含地图扫描、路径规划和自动避障功能。
- 端到端工作流:提供内置工具,支持在线数据标注、模型训练和实时结果评估。
- 工业级部署:支持完全离线部署,确保数据隐私和资源效率。
相关
- 项目
- 项目
- 项目
- 项目
- 项目