yuanze-lin/Olympus
단일 자연어 지시를 이미지, 동영상, 3D 모델 생성을 위한 전문 모델 호출 시퀀스로 변환하는 컴퓨터 비전용 유니버설 태스크 라우터입니다.
Jumpat/SegAnyGAussians
SAGA는 인터랙티브 포인트 프롬프트 또는 오픈 어휘 텍스트 쿼리를 사용하여 3D 객체를 격리할 수 있는 3D 가우시안 스플래팅 씬을 세그먼트화하는 프레임워크입니다.
jasmcaus/caer
Caer는 Python 전용이며 GPU 가속된 컴퓨터 비전 라이브러리로, 빠른 이미지/비디오 유틸리티(리사이즈, 색상 변환, 증강 등)를 제공하고 깔끔하고 타입 검사가 가능한 API를 갖추고 있습니다. 연구 프로토타입에서 OpenCV를 대체할 수 있으며 `pip`으로 설치 가능하고 MIT 라이선스를 따릅니다.
Pbatch/ClashRoyaleBuildABot
교육 및 연구 목적을 위해 고급 상태 생성기와 객체 감지를 사용하는 클래시 로얄 자동화 봇입니다.
adipandas/multi-object-tracker
Python 라이브러리로, 다양한 멀티 객체 추적 알고리즘과 OpenCV 기반 객체 검출기를 손쉽게 구현하여 비디오 분석에 활용할 수 있습니다.
parkpow/deep-license-plate-recognition
Plate Recognizer의 차량 번호판 인식 API를 이미지 및 비디오 스트림에 통합하기 위한 예제 클라이언트 및 운영 유틸리티 모음입니다.
VisualComputingInstitute/diffusion-e2e-ft
이미지 조건부 확산 모델을 단일 단계 결정론적 추정기로 파인튜닝하여 빠르고 정확한 깊이 및 표면 법선 추정을 가능하게 하는 프레임워크.
shoumikchow/bbox-visualizer
VOC, COCO, YOLO 형식을 지원하는 Python 패키지로, 오브젝트 검출 시각화를 간소화하기 위해 이미지에 레이블이 있는 바운딩 박스를 그리는 데 도움을 줍니다.
hysts/pytorch_mpiigaze_demo
이미지 및 동영상에서 사람이 어디를 보고 있는지 추적하기 위해 사전 학습된 모델을 사용하는 시선 추정 데모 프로그램입니다.
hysts/pytorch_mpiigaze
A PyTorch implementation of gaze estimation methods from the MPIIGaze and MPIIFaceGaze papers for training and evaluation of appearance-based gaze tracking.
luxonis/depthai-ros
Luxonis OAK 카메라용 ROS 통합으로 로봇 시스템에서 하드웨어 가속 AI와 깊이 인식을 사용할 수 있습니다.
FluxML/Metalhead.jl
Flux.jl을 위한 표준 머신러닝 비전 모델 라이브러리로, ResNet, ViT, EfficientNet과 같은 인기 있는 아키텍처의 구현을 제공합니다.
Karine-Huang/T2I-CompBench
텍스트-이미지 생성 모델(text-to-image generation models)의 복잡한 구성 요소, 속성 바인딩, 공간 관계 처리 능력을 중점적으로 평가하는 종합적인 벤치마크 및 평가 스위트입니다.
frgfm/holocron
컴퓨터 비전 작업을 위한 최신 딥러닝 기법 및 모델 아키텍처의 고품질 PyTorch 구현 라이브러리입니다.
rapidsai/cucim
cuCIM은 바이오메디컬, 지리공간 및 원격 감지 응용 분야에서 사용되는 대규모 다차원 이미지를 위해 설계된 GPU 가속 컴퓨터 비전 및 이미지 처리 라이브러리입니다.
theICTlab/3DUNDERWORLD-SLS-GPU_CPU
패턴화된 빛으로 비춘 물체 이미지에서 3D 포인트 클라우드를 재구성하는 구조광 스캔 도구로, CPU와 GPU 가속을 모두 지원합니다.
alicevision/popsift
CUDA 가속을 이용한 SIFT 알고리즘 구현으로 실시간 이미지 특징 추출이 가능합니다.
rgeirhos/Stylized-ImageNet
Stylized-ImageNet을 생성하기 위한 도구로, 텍스처를 왜곡하여 CNN이 텍스처보다 객체 형태를 우선하도록 유도함으로써 견고성을 향상시킵니다.
VSLAM-LAB/VSLAM-LAB
다양한 데이터셋에서 여러 기준 알고리즘의 설치, 실행, 평가를 간소화하는 포괄적인 프레임워크.
l3p-cv/lost
유연한 웹 기반 협업 이미지 주석 프레임워크로, 반자동 파이프라인을 지원하여 머신러닝 데이터셋 라벨링 속도를 높입니다.
genicam/harvesters
GenICam 준수 장치를 위한 통합 인터페이스를 제공하여 컴퓨터 비전 애플리케이션의 이미지 획득을 단순화하는 Python 라이브러리입니다.
basler/pypylon
Basler pylon C++ API를 위한 공식 Python 바인딩으로, Python 애플리케이션에서 Basler 머신 비전 카메라를 제어하고 이미지 처리 작업을 수행할 수 있도록 합니다.
cyrusbehr/YOLOv8-TensorRT-CPP
TensorRT를 이용한 C++ 구현 YOLOv8으로 고성능 GPU 추론을 제공하며, 객체 탐지, 의미 분할 및 포즈 추정을 지원합니다.
jenissimo/unfake.js
AI 생성 피크셀 아트를 정리하고 래스터 이미지를 깨끗하고 확장 가능한 SVG로 변환하는 JavaScript 라이브러리 및 브라우저 도구입니다.
insight-platform/Savant
Nvidia 하드웨어에서 실시간 고성능 컴퓨터 비전 및 비디오 분석 파이프라인을 구축하기 위한 고수준 프레임워크로, DeepStream의 복잡성을 추상화합니다.
luispedro/mahotas
C++ 로 구현된 빠른 Python 컴퓨터 비전 라이브러리로, NumPy 배열에서 동작하는 100개 이상의 이미지 처리 알고리즘을 제공합니다.
opendatacam/opendatacam
오픈소스 컴퓨터 비전 도구로, 비디오 피드에서 움직이는 객체를 감지·추적·카운트하여 실제 움직임을 정량화합니다. 주로 교통 조사에 사용됩니다.
Visionary-Laboratory/visionary
WebGPU 기반 플랫폼으로, ONNX Runtime을 사용하여 브라우저에서 Gaussian Splatting 변형 및 3D mesh를 실시간으로 렌더링합니다.
open-edge-platform/geti_v2
Geti는 스마트 데이터 어노테이션 및 액티브 러닝부터 모델 학습 및 에지 배포에 이르기까지 전체 AI 라이프사이클을 간소화하는 엔드 투 엔드 컴퓨터 비전 플랫폼입니다.
Koldim2001/YOLO-Patch-Based-Inference
이미지 타일링 및 결과 통합을 통해 대형 이미지에서 작은 객체 검출을 향상시키는 패치 기반 추론을 지원하는 Python 라이브러리입니다.
zhiqwang/yolort
YOLOv5를 위한 런타임 스택으로, 전처리 및 후처리를 모델 그래프에 내장하여 다양한 하드웨어 가속기를 위한 객체 탐지 배포를 단순화합니다.
VIAME/VIAME
VIAME은 모듈식 다국어 파이프라인 프레임워크를 통해 탐지, 추적, 주석, 검색 및 기타 많은 이미지/비디오 처리 기능을 제공하는 오픈 소스 컴퓨터 비전 툴킷입니다. 데스크톱 및 웹 GUI, 명령줄 도구, 사전 빌드된 바이너리 및 Docker 이미지가 포함되어 있으며 C++, Python 또는 MATLAB 플러그인을 통해 확장할 수 있습니다.
azavea/raster-vision
PyTorch를 사용하여 위성, 항공 및 드론 이미지에서 컴퓨터 비전 모델을 구축하기 위한 파이썬 라이브러리 및 로우코드 프레임워크.
opengeos/segment-geospatial
Segment Anything Model (SAM)을 지리공간 데이터에 맞게 적용한 Python 패키지로, 텍스트, 포인트 또는 박스를 사용해 위성 영상을 손쉽게 분할할 수 있습니다.
orbbec/OrbbecSDK
다양한 기기 시리즈에서 데이터 스트림을 캡처하고 하드웨어를 제어할 수 있도록 해주는 Orbbec 3D 카메라용 소프트웨어 개발 키트입니다.
layumi/Person_reID_baseline_pytorch
경량이고 강력한 PyTorch 기준선으로 객체 및 사람 재식별을 제공하며, 크로스 카메라 객체 검색을 위한 포괄적인 아키텍처와 손실 함수를 제공합니다.
google-research/augmix
AugMix는 증강된 이미지를 혼합하고 일관된 임베딩을 강제하여 이미지 분류 모델의 견고성과 불확실성 보정을 개선하는 데이터 처리 기술입니다.
spytensor/plants_disease_detection
작물 질병을 감지하기 위한 PyTorch 기반 이미지 분류 파이프라인으로, ResNet50 백본과 현대적인 PyTorch 2.x 최적화를 특징으로 합니다.
openclimatefix/metnet
Google Research의 MetNet 모델을 PyTorch로 구현한 것으로, 위성 및 대기 데이터를 활용한 단기 및 전 세계 강수 예측에 사용 가능.
FORTH-ModelBasedTracker/MocapNET
실시간 2D‑to‑3D 인간 포즈 추정기로, RGB 비디오 피드를 표준 BVH 모션 캡처 파일로 변환하여 3D 애니메이션에 활용합니다.
andrewssobral/bgslibrary
컴퓨터 비전에서 배경 차감을 위한 포괄적인 C++ 프레임워크로, 비디오 스트림에서 움직이는 객체를 감지하는 40개 이상의 알고리즘을 제공합니다.
zhanghang1989/ResNeSt
객체 탐지 및 세그멘테이션과 같은 컴퓨터 비전 작업의 성능을 향상시키는 ResNet의 스플릿 어텐션 네트워크 변종입니다.
apple-aiml-research/ml-facelit
FaceLit은 다양한 조명 조건에서 현실적으로 재조명 가능한 고품질의 얼굴 이미지를 생성할 수 있는 신경망 3D 렌더링 프로젝트입니다.
MrGiovanni/SuPreM
3D 의료 영상의 감독 학습 사전 훈련을 위한 사전 훈련된 3D 모델 제품군과 AbdomenAtlas 1.1 데이터셋. 장기 및 종양 분할 성능을 향상시킵니다.
MrGiovanni/ModelsGenesis
라벨이 없는 CT 및 MRI 스캔에서 3D 모델을 사전 훈련하여 의료 영상 세그멘테이션 및 분류를 위한 기반 모델을 만드는 자기지도 학습 프레임워크입니다.
geezacoleman/OpenWeedLocator
녹색 탐지 알고리즘을 사용하여 정밀 잡초 제어를 위한 스폿 살포를 트리거하는 오픈소스 라즈베리파이 기반의 잡초 감지 시스템입니다.
rafaelpadilla/Object-Detection-Metrics
PASCAL VOC 및 COCO와 같은 주요 객체 탐지 지표(예: 평균 정밀도, IOU 등)의 표준화되고 사용하기 쉬운 구현을 제공하여, 다양한 데이터셋 간 일관된 벤치마킹을 보장하는 툴킷입니다.
luxonis/depthai
depthai 라이브러리는 Luxonis 플랫폼의 소프트웨어 프레임워크로, 개발자가 Luxonis 하드웨어에서 AI 및 컴퓨터 비전 애플리케이션을 개발할 수 있도록 합니다.