google/cameratrapai

객체 탐지기와 종 분류기를 사용하여 카메라 트랩 이미지에서 야생 생물 종의 분류를 자동화하는 AI 모델의 앙상블입니다.

mprib/caliscope

3D 모션 캡처를 위한 다중 카메라 캘리브레이션 도구로 카메라 내재 매개변수와 공간 위치를 추정하여 정확한 3D 삼각 측량을 가능하게 합니다.

linwhitehat/ET-BERT

사전 훈련과 미세 조정을 통해 데이터그램 간의 문맥적 관계를 학습하는 암호화된 네트워크 트래픽 분류를 위한 Transformer 기반 모델

allenv0/AirPosture

AirPods의 헤드 트래킹과 로컬 AI를 사용하여 목의 긴장을 줄이기 위한 실시간 자세 코칭 및 알림을 제공하는 iOS 앱입니다.

LiteReality/LiteReality

LiteReality는 모바일 장치에서 캡처한 RGB-D 스캔을 물리 기반 렌더링 재질을 갖춘 그래픽 대응 3D 장면으로 변환하여 고정밀 재구성을 가능하게 합니다.

3dem/relion

RELION은 cryo-electron microscopy(냉동 전자 현미경)에서의 3D 재구성 및 2D 클래스 평균의 최대 후험 확률(Maximum A Posteriori) 정밀화를 위한 소프트웨어 프로그램입니다.

cvg/glue-factory

A library for training and evaluating deep neural networks that extract and match local visual features, supporting state-of-the-art models like LightGlue and GlueStick.

cvg/limap

포인트, 선, 평면, 그리고 파라미터 프리미티브를 공동으로 최적화하여 더 정확한 3D 재구성을 가능하게 하는 총체적 3D 매핑 및 Structure from Motion을 위한 툴박스입니다.

nvpro-samples/vk_gaussian_splatting

3D 가우시안 스플래팅 모델을 위한 고성능 Vulkan 기반 뷰어 및 테스트베드로, 래스터라이제이션, 레이트레이싱, 하이브리드 렌더링 기법을 비교할 수 있습니다.

OschAI/VisioFirm

SAM2와 YOLO와 같은 모델을 사용하여 컴퓨터 비전 데이터셋에 대한 반자동 사전 레이블링을 제공하는 AI 기반 이미지 및 비디오 주석 도구입니다.

PRBonn/RAP

등록을 조건부 생성 작업으로 간주하여, 흐름 매칭을 사용해 여러 미정렬 스캔을 공통 프레임으로 정렬하는 3D 포인트 클라우드 등록 프레임워크입니다.

UB-Mannheim/zotero-ocr

Zotero 라이브러리 내의 스캔된 PDF에 검색 가능한 텍스트 레이어를 추가하기 위해 Tesseract OCR를 사용하는 Zotero 플러그인입니다.

Linketic/CityGaussian

가우시안 스플래팅을 활용한 고품질 대규모 3D 장면 재구성용 프레임워크로, 멀티 GPU 지원과 기하학적으로 정확한 렌더링을 특징으로 합니다.

drivelineresearch/openbiomechanics

야구 투구 및 타격 분석을 위한 정제된 모션 캡처 파일, 시계열 생체역학, 신체 평가 메트릭을 제공하는 공개 연구 데이터셋입니다.

ScrollPrize/villa

CT 스캔에서 고대 헤르쿨라네움 초상의 가상 전개와 읽기를 위한 머신러닝 및 컴퓨터 비전 도구 모음.

dstl/Stone-Soup

Stone Soup은 타겟 트래킹 및 상태 추정 알고리즘 개발 및 테스트를 위한 프레임워크입니다.

SubhamTyagi/android-ocr

120개 이상의 언어에서 오프라인 광학 문자 인식(OCR)을 수행하는 프라이버시 중심의 안드로이드 앱입니다.

hmorimitsu/ptlflow

다수의 최첨단 광학 흐름 추정 모델을 훈련 및 평가하기 위한 통합된 PyTorch Lightning 프레임워크입니다.

oliverbravery/PrintGuard

3D 프린팅 실패를 실시간으로 감지하여 프린터를 자동으로 일시 중지하고 사용자에게 경고하여 필라멘트 낭비를 방지하는 로컬 비전 기반 모니터링 시스템.

inspatio/querysplat

QuerySplat은 이미지로부터의 3D 장면 재구성 품질을 향상시키기 위해 기하학과 외관 표현을 분리하는 3D Gaussian Splatting 예측 프레임워크입니다.

bytedeco/javacv

OpenCV 및 FFmpeg와 같은 인기 있는 컴퓨터 비전 및 비디오 처리 라이브러리를 위한 Java 래퍼로, Java 및 Android에서 고성능 이미지 및 비디오 조작을 가능하게 합니다.

tomas-gajarsky/facetorch

효율적인 추론을 위해 오픈소스 모델을 수집하고 포터블 torch.export 모델로 패키지화하는 파이썬 라이브러리입니다.

ch-sa/labelCloud

포인트 클라우드를 위한 경량 3D 바운딩 박스 라벨링 도구로, 3D 객체 탐지 및 6D 포즈 추정을 위한 학습 데이터를 생성합니다.

databricks-industry-solutions/pixels

MONAI를 활용한 SQL 기반 메타데이터 분석과 AI 기반 이미지 세그멘테이션을 가능하게 하는 DICOM 파일 수집 및 인덱싱을 위한 의료 영상 솔루션 액셀러레이터입니다.

fastvideo/gpu-camera-sample

다양한 산업용 카메라를 지원하는 고성능 GPU 가속 카메라 애플리케이션으로, 실시간 원시 이미지 처리 및 ISP 파이프라인을 제공합니다.

jamjamjon/usls

10억 파라미터 미만의 비전 및 비전-언어 모델을 효율적으로 추론할 수 있는, ONNX Runtime 기반의 크로스플랫폼 Rust 라이브러리입니다.

pymatting/pymatting

트리맵을 사용하여 전경 객체의 투명도를 추정하는 파이썬 라이브러리로, 정밀한 배경 제거 및 합성을 가능하게 합니다.

apple-aiml-research/ml-hypersim

Hypersim은 약 77,000장의 HDR 이미지(1.9TB)를 포함하는 대규모 합성 실내 데이터셋으로, 픽셀 단위의 기하학, 세마틱, 재질 채널을 제공하며, V‑Ray 기반 툴킷을 통해 유사한 데이터 생성 및 편집이 가능합니다. 깊이, 법선, 세그멘테이션, 내재 이미지 분해 등의 장면 이해 모델 학습 및 평가에 최적화되어 있으며, 사전 준비된 train/val/test 분할을 포함합니다.

apple-aiml-research/ml-hugs

HUGS는 가우시안 스플래터링을 사용하여 단일 비디오에서 애니메이션 가능한 인간과 그 주변 배경 장면을 재구성하는 참조 구현입니다.

jasongzy/Make-It-Animatable

3D 메시에서 관절 위치와 스킨웨이트를 예측함으로써 애니메이션 대응 3D 캐릭터 생성을 자동화하는 효율적인 프레임워크.

nmwsharp/polyscope

메쉬와 포인트 클라우드 및 관련 스칼라 및 벡터 데이터를 빠르게 시각화하기 위한 가벼운 C++/Python 3D 뷰어 및 UI입니다.

PFCCLab/PPOCRLabel

OCR용 반자동 그래픽 주석 도구로, 내장된 PP-OCR 모델을 사용해 학습 데이터셋 생성을 위한 텍스트 탐지 및 인식을 자동화합니다.

amebalabs/TRex

모든 화면 영역에서 선택할 수 없는 텍스트를 OCR로 추출하여 클립보드에 직접 복사하는 macOS 유틸리티입니다.

rtr46/meikipop

게임, 만화, 비디오를 포함한 화면상의 모든 콘텐츠에서 즉시 단어를 검색할 수 있게 해주는 범용 일본어 OCR 팝업 사전입니다.

deepdoctection/deepdoctection

레이아웃 분석, OCR 및 토큰 분류를 오케스트레이션하여 PDF 및 스캔 파일에서 구조화된 데이터를 추출하는 문서 이해용 Python 라이브러리입니다.

nutonomy/nuscenes-devkit

nuScenes 및 nuImages 데이터셋을 위한 소프트웨어 개발 키트로, 자율주행 연구를 위한 다중 모달 센서 데이터의 로딩, 분석, 평가를 지원하는 도구를 제공합니다.

espressif/esp-who

얼굴 및 보행자 감지, QR 코드 인식을 위한 예제를 제공하는 Espressif 칩용 이미지 처리 개발 플랫폼입니다.

facebookresearch/OrienterNet

OpenStreetMap과 같은 2D 공개 지도와 이미지를 매칭하여 이미지의 위치와 방향을 결정하는 딥 뉴럴 네트워크.

mjkwon2021/CAT-Net

JPEG 압축 아티팩트를 분석하여 이미지 조작을 탐지하고 국소화하는 네트워크로, 이미지 포렌식 연구를 위한 도구를 제공합니다.

Project-MONAI/MONAILabel

방사선학, 병리학 및 내시경 분야에서 대화형 및 자동화된 레이블링을 가능하게 하는 서버-클라이언트 아키텍처 기반의 AI 지원 의료 영상 어노테이션용 지능형 오픈 소스 생태계입니다.

yihong1120/Construction-Hazard-Detection

실시간 카메라 스트림에서 YOLO를 사용하여 PPE 위반과 근접 위험을 감지하는 AI 기반 건설 현장 안전 모니터링 시스템.

zae-bayern/elpv-dataset

전력 효율을 저하시키는 결함을 시각적으로 식별하기 위해 사용되는 2,624개의 주석이 달린 전기발광 이미지 벤치마크 데이터셋입니다.

Climate-Vision/ClimateVision

딥러닝과 위성 영상을 사용해 산림 벌채, 북극 빙하 녹음, 홍수를 자동으로 감지하는 오픈소스 머신러닝 플랫폼입니다.

cuevhv/mamma

MAMMA는 마커가 필요 없는 다중 인물 3D 모션 획득 시스템으로, 멀티뷰 영상에서 정확한 인간 포즈를 재구성합니다.

emgucv/emgucv

OpenCV 라이브러리를 위한 크로스 플랫폼 .NET 래퍼로, 이미지 프로세싱 기능을 .NET 호환 언어에서 사용할 수 있게 합니다.

tianrun-chen/SAM-Adapter-PyTorch

위장, 그림자, 의료 영상 등 어려운 장면에서 성능을 향상시키기 위한 Segment Anything Model (SAM) 적응 프레임워크.

cameraui/camera.ui

사용자 소유의 하드웨어에 영상을 보관하면서 실시간 시청, 녹화, 그리고 온디바이스 AI 탐지를 제공하는 자체 호스팅 보안 카메라 플랫폼입니다.

facebookresearch/ocean

Ocean은 모바일, 데스크톱, Meta Quest를 포함한 다양한 플랫폼에서 컴퓨터 비전 및 증강현실 애플리케이션을 구축하기 위한 C++ 프레임워크입니다.