spectralpython/spectral
이미지 분광법에서 얻은 하이퍼스펙트럼 이미지 데이터를 처리, 시각화, 분류하기 위한 순수 Python 모듈입니다.
johntruckenbrodt/pyroSAR
다양한 미션과 소프트웨어 도구에서 온 SAR 위성 데이터의 확장 가능한 정리 및 처리를 위한 Python 프레임워크입니다.
histolab/histolab
디지털 병리학에서 Whole Slide Images (WSIs)를 처리하기 위한 도구로, 자동 조직 탐지 및 딥러닝 파이프라인용 정보 풍부한 타일 추출을 제공합니다.
seung-lab/connected-components-3d
3D 다중 레이블 및 그레이스케일 이미지에서 연결 성분 레이블링을 위한 고성능 라이브러리로, 생물의학 영상에서 인스턴스 세그멘테이션 분석을 가속화하도록 설계됨.
cocoa-xu/evision
Elixir 애플리케이션용 컴퓨터 비전 도구를 자동 생성하는 OpenCV 바인딩으로, CUDA 및 임베디드 시스템 지원을 포함합니다.
MRtrix3/mrtrix3
MRtrix3는 MRI 데이터의 처리 및 시각화를 제공하는 의료 영상 소프트웨어 패키지입니다.
upipes/PipeNet-Expansion
대규모 언어 모델(LLM)이 생성한 환경 지식을 활용하여 지반 탐사 레이더(GPR) 지하 진단 분류기를 새로운 지리적 지역에 적응시키는 프레임워크와 프로토타입 시스템.
jcreinhold/intensity-normalization
스캐너와 사이트 간 MR 이미지의 강도를 정규화하여 획득 아티팩트로 인해 머신러닝 파이프라인이 손상되는 것을 방지하는 Python 패키지입니다.
ngageoint/sarpy
NGA 표준과 다양한 상용 SLC 형식을 지원하는, 복잡한 합성개구 레이더(SAR) 데이터를 읽고 쓰며 처리할 수 있는 Python 라이브러리.
0x09/resdet
주파수 영역 분석을 사용하여 이미지와 비디오의 업스케일링을 감지하고 원래 소스 해상도를 식별하는 명령줄 도구 및 C 라이브러리입니다.
pySTEPS/pysteps
광학 흐름과 확률적 생성기를 사용하여 단기 앙상블 예측 시스템을 생성하는 Python 라이브러리입니다.
koide3/iridescence
포인트 클라우드 알고리즘의 빠른 프로토타이핑을 위한 경량 3D 시각화 라이브러리로, 통합된 UI 도구를 제공합니다.
orfeotoolbox/OTB
테라바이트 규모의 광학, 다중 스펙트럼 및 레이더 데이터를 처리할 수 있는 오픈소스 라이브러리입니다.
dkogan/mrcal
mrcal은 카메라 캘리브레이션 및 구조에서 운동(SfM) 문제를 해결하기 위한 일반적인 툴킷으로, C 및 Python 라이브러리와 명령줄 도구를 제공합니다.
foundry/OpenCVSwiftStitch
OpenCV를 사용하여 iOS에서 이미지를 패노라마로 스티칭하는 예제 프로젝트로, 현대적인 Swift/C++ 상호운용성을 보여줍니다.
scverse/squidpy
공간 분자 데이터 및 조직 현미경 이미지의 분석과 시각화를 위한 확장 가능한 툴킷입니다.
rameau-fr/MC-Calib
패러스펙티브 및 필시아 렌즈를 하이브리드 구성에서 지원하는 일반적이고 강력한 캘리브레이션 도구상자입니다.
AlanLuSun/High-quality-ellipse-detection
로봇 비전 및 PCB 검사와 같은 응용 분야에서 높은 위치 정확도와 효율성을 제공하는 현실 세계 이미지용 고품질 타원 검출 알고리즘입니다.
hacker-frok/qq-farm-bot-ai
OpenCV 템플릿 매칭을 사용하여 화면에서 게임 요소를 시각적으로 식별하고, 농작물 수확, 씨앗 관리, 소셜 상호작용을 자동화하는 QQ 클래식 팜용 시각적 자동화 봇입니다.
Faceunity/FULiveDemoDroid
Faceunity의 Face AR SDK를 위한 Android 통합 예제로, 실시간 얼굴 추적, 뷰티 필터 및 AR 효과를 시연합니다.
Faceunity/FULiveDemo
Faceunity의 Nama SDK를 사용한 실시간 얼굴 AR, 미화 및 모션 트래킹을 위한 iOS 통합 예제
cheind/py-motmetrics
MOTA, MOTP, IDF1, HOTA와 같은 표준 지표를 사용하여 다중 객체 추적 결과를 평가하는 Python 라이브러리.
eduardolundgren/tracking.js
색상 추적 및 얼굴 인식과 같은 컴퓨터 비전 알고리즘을 브라우저에서 직접 구현할 수 있는 경량 JavaScript 라이브러리.
sirfz/tesserocr
병렬 실행과 Pillow 통합을 지원하며 이미지에서 효율적인 텍스트 추출을 가능하게 하는 Tesseract OCR API용 Python 래퍼.
3DiVi/nuitrack-sdk
다양한 깊이 센서와 여러 플랫폼에서 작동하는 통합 API를 제공하는 3D 신체 및 스켈레탈 트래킹 라이브러리로, 인간 중심의 공간 인식을 가능하게 합니다.
borglab/gtsfm
GTSAM과 Dask를 기반으로 한 엔드투엔드 분산형 Structure-from-Motion 파이프라인으로, 2D 이미지에서 3D 장면을 재구성하며 네이티브 병렬 계산을 지원합니다.
ros-perception/perception_pcl
3D 기하 처리 및 n-D 포인트 클라우드 처리를 위한 ROS 인터페이스 스택. Point Cloud Library (PCL)을 ROS와 연결합니다.
aws-samples/amazon-textract-textractor
Amazon Textract를 사용하여 문서에서 텍스트, 테이블, 폼, 신분 정보를 추출하는 것을 간소화하는 Python 패키지입니다.
scverse/cellrank
마르코프 상태 모델링을 사용하여 세포 동역학과 분화 확률을 추정하는, 단세포 데이터에서의 운명 맵핑을 위한 모듈식 프레임워크입니다.
luxonis/depthai-python
depthai-core C++ 라이브러리용 Python 바인딩으로, Luxonis 하드웨어용 AI 및 컴퓨터 비전 애플리케이션을 Python으로 개발할 수 있도록 합니다.
LearnTechWithUs/Stereo-Vision
두 대의 웹캠을 사용하여 스테레오 비전을 캘리브레이션하고, 불일치 맵과 회귀를 활용해 물체까지의 거리를 측정하는 컴퓨터 비전 프로그램입니다.
brainiak/brainiak
신경과학 연구를 위한 Python 기반 분석 키트이며, 기능적 자기공명영상(fMRI) 데이터의 처리 및 분석에 중점을 둡니다.
ashawkey/kiuikit
3D 비전, torch 네이티브 메시 처리, 사전 구축된 PyTorch 신경망 블록을 제공하는 니치한 컴퓨터 비전 툴킷입니다.
ossimlabs/ossim
OSSIM은 정사영 보정, 재투영, 지리공간 이미지 분석을 지원하는 오픈소스 C++ 지리공간 이미지 처리 라이브러리입니다.
oliverbravery/PrintGuard
3D 프린팅 실패를 실시간으로 감지하여 프린터를 자동으로 일시 중지하고 사용자에게 경고하여 필라멘트 낭비를 방지하는 로컬 비전 기반 모니터링 시스템.
MohrJonas/obsidian-ocr
Tesseract와 같은 로컬 OCR 엔진을 사용하여 Obsidian에서 이미지와 PDF 내 텍스트 검색을 가능하게 하는 플러그인입니다.
cs-chan/Total-Text-Dataset
자연 장면 이미지에서 임의 형태의 텍스트를 탐지하는 데 개선을 위한 단어 수준의 영어 곡선 텍스트 데이터셋과 평가 프레임워크입니다.
conjuncts/gmft
gmft는 Microsoft의 Table Transformer를 사용하여 PDF 표를 Pandas 데이터프레임과 같은 구조화된 형식으로 변환하는 가볍고 고성능의 PDF 표 추출 도구입니다.
FAST-Imaging/FAST
CPU와 GPU를 사용한 고성능 의료 영상 처리, 신경망 추론 및 실시간 시각화를 위한 오픈소스 프레임워크입니다.
microblink/blinkid-ios
ID 및 여권 등 다양한 신분증 문서의 스캔을 안전하게 자동화하는 포괄적인 iOS SDK로, 선택적 즉시 사용 가능한 UI를 제공하여 자동 데이터 추출과 검증을 가능하게 합니다.
cmusatyalab/openface
딥 뉴럴 네트워크를 사용하여 이미지 및 실시간 비디오 스트림에서 사람을 식별하는 오픈소스 얼굴 인식 라이브러리입니다.
pqpo/SmartCropper
OpenCV와 TensorFlow를 사용하여 문서, 신분증, 명함의 지능형 이미지 자르기 및 시점 보정을 수행하는 Android 라이브러리입니다.
NVlabs/nvdiffrec
다중 시점 이미지에서 삼각형 3D 모델, 재질, 조명을 공동 최적화를 통해 추출하는 미분 가능한 렌더링 프레임워크입니다.
frgfm/torch-cam
畳み込み 및 트랜스포머 기반 비전 모델의 예측을 설명하고 디버깅하기 위한 PyTorch 라이브러리로, 클래스 활성화 맵(CAM)을 시각화합니다.
ZFTurbo/Weighted-Boxes-Fusion
Weighted Boxes Fusion (WBF) 및 NMS와 같은 방법을 사용하여 여러 객체 탐지 모델의 경계 박스 예측을 앙상블하는 Python 라이브러리입니다.
yoshitomo-matsubara/torchdistill
torchdistill은 PyTorch 기반의 라이브러리로, YAML 구성 파일만 작성하면 지식 증류 실험(티처-스터디 학습)을 수행할 수 있습니다. 다양한 최신 KD 손실, 중간 특징 추출을 위한 포워드 훅 매니저, 비전 및 NLP 작업용 예제 스크립트를 제공합니다. `pip install torchdistill`로 설치 가능하며, 연구에서 사용 시 관련 논문을 인용해 주세요.
lucidrains/alphafold3-pytorch
단백질 및 기타 생물학적 분자의 상호작용 3차원 구조를 예측하기 위한 PyTorch 구현으로, PDB 데이터셋 정제를 위한 포괄적인 도구를 제공합니다.
vturrisi/solo-learn
PyTorch Lightning 기반의 비지도 시각 표현 학습을 위한 자기 지도 학습 방법론 라이브러리로, SOTA 시각 모델을 훈련하고 비교할 수 있는 통합된 환경을 제공합니다.