ra1nty/DXcam
Python용 고성능 Windows 화면 캡처 라이브러리로, AI 에이전트 및 컴퓨터 비전 워크로드를 위한 저지연, 고FPS 프레임을 제공합니다.
winfunc/opcode
Claude Code를 위한 GUI 애플리케이션 및 툴킷으로, 시각적 세션 관리, 사용자 지정 에이전트 생성 및 사용량 분석 기능을 제공합니다.
potamides/DeTikZify
DeTi*k*Zify는 스케치나 래스터 과학 그림을 편집 가능한 TikZ 코드로 변환하는 오픈소스 멀티모달 LLM입니다. 이미지-투-TikZ 생성, Ti*k*Zero 어댑터를 통한 텍스트-투-TikZ, 몬테카를로 트리 탐색을 통한 반복적 개선을 지원합니다. pip로 설치할 수 있으며, 전체 TeX Live, Ghostscript, Poppler 설치가 필요하고 GPU(8‑b 모델) 또는 CPU(1‑b)에서 실행됩니다. 저장소는 CLI/웹 UI, Python API 예제, Hugging Face의 모델 가중치, 훈련 데이터셋 재생성 스크립트를 제공합니다.
mrpulor-gh/nuphus-mcp
이 리포지토리는 AI 데스크톱 및 브라우저 자동화에 관한 진정한 소프트웨어 프로젝트로, JSON-RPC를 표준 입력/출력을 통해 사용하는 Rust 기반의 MCP 서버를 제공하여 AI 에이전트가 로컬 컴퓨터를 제어할 수 있게 합니다. 로컬 OCR 및 선택적 비전 모델 통합도 지원합니다.
NaomiProject/Naomi
Naomi는 오픈소스이며 항상 음성 입력을 수신하는 음성 어시스턴트 플랫폼(파이썬, 리눅스/Raspberry Pi)으로, 가정용 기기 제어, 정보 질의, 간단한 파이썬 모듈을 통한 사용자 정의 '스킬' 추가가 가능합니다.
xorbitsai/xagent
정적 워크플로 빌더를 동적 런타임 계획으로 대체하여 개인, 팀, 엔터프라이즈를 위한 복잡하고 모호한 지식 작업을 처리하는 에이전트 플랫폼.
tidyverts/fable
ARIMA 및 지수 평활법을 포함하여 tidyverse 워크플로우와 통합된 시계열 예측 모델 컬렉션을 제공하는 R 패키지입니다.
noCaptchaAi/NoCaptcha-Ai-Browser-Extension
API 키를 사용하여 백그라운드에서 다양한 유형의 CAPTCHA를 자동으로 감지하고 해결하는 브라우저 확장 프로그램입니다.
polm/cutlet
다양한 로마자 표기 체계와 URL 슬러그 생성을 지원하는 일본어 텍스트를 로마자로 변환하는 도구입니다.
NeuralEnsemble/PyNN
수정 없이 여러 시뮬레이터 및 뉴로모픽 하드웨어에서 실행할 수 있는 뉴런 네트워크 모델을 구축하기 위한 시뮬레이터 비종속 Python 언어.
apple-aiml-research/ml-hierarchical-confusion-matrix
Neo는 오픈소스 JavaScript 라이브러리(패키지 `@apple/hierarchical-confusion-matrix`)로, 계층적 및 다중 출력 클래스 레이블을 지원하는 인터랙티브한 혼동행렬 시각화를 제공합니다. npm을 통해 설치하고, 스펙과 `{actual, observed, count}` 레코드 배열을 전달하면 웹 페이지 어디에든 매트릭스를 삽입할 수 있습니다. 평탄, 계층적(`:`), 다중 출력(`,`), 그리고 복합 레이블 구조를 지원하며, 실시간 데모, 단위 테스트, 완전한 TypeScript 소스 트리가 포함되어 있습니다.
arrayfire/arrayfire
CPU, GPU 및 기타 하드웨어 가속기에서 병렬 계산을 위한 고수준 추상화를 제공하는 일반 목적의 텐서 라이브러리입니다.
YeeZTech/YeeZ-Privacy-Computing
Fidelius는 Intel SGX 기반의 프라이버시 컴퓨팅 미들웨어로, 원본 데이터가 계산에는 사용 가능하지만 참여자들에게는 보이지 않도록 보장하여 안전한 데이터 협업을 가능하게 합니다.
xianyu110/clawbot
Clawdbot은 Claude, GPT, Gemini 등 다양한 LLM에 구성 가능한 API 프록시 엔드포인트를 통해 연결하는 오픈소스이며, 로컬에서 실행 가능한 AI 어시스턴트입니다. 웹 및 터미널 UI, Telegram/Discord/WhatsApp 봇을 제공하며, 모든 데이터는 호스트에 저장됩니다. README에는 설치 방법(노드 22+, npm 또는 스크립트), 모델 및 채널 설정을 위한 온보딩 워즈드, 다중 모델 프록시를 위한 상세한 JSON 설정, 노드 버전 문제, 환경 변수 오용, 필수 필드 누락과 같은 일반적인 실수, 게이트웨이, 로그, 진단을 관리하는 데 사용하는 CLI 명령어의 완전한 세트가 포함되어 있습니다.
hildensia/bayesian_changepoint_detection
GPU 가속을 지원하는 PyTorch 기반 시계열 데이터의 베이즈 변화점 탐지 라이브러리로, 온라인 및 오프라인 방법 모두를 지원합니다.
esrrhs/majiang_algorithm
밀리초 단위의 승리 패 조합(winning-hand) winning-hand detection과 AI 기반의 버림패 결정 기능을 위해 사전 계산된 룩업 테이블을 사용하는 고성능 마작 알고리즘 라이库입니다.
RobotWebTools/web_video_server
ROS 이미지 토픽을 다양한 형식으로 웹 브라우저에 스트리밍하여 로봇 카메라 피드를 쉽게 원격 모니터링할 수 있는 HTTP 서버입니다.
L-a-r-t/chatgpt-to-notion
ChatGPT, Claude, Mistral 등의 여러 LLM에서 나온 프롬프트와 응답을 Notion 데이터베이스에 직접 저장할 수 있는 브라우저 확장 프로그램입니다.
93won/lightweight_vio
실시간 상태 추정을 위한 경량 스테레오 시각 관성 오도메트리 시스템.
microsoft/Cognitive-Samples-VideoFrameAnalysis
Microsoft Cognitive Services Vision API를 사용하여 웹캠 비디오 프레임을 준실시간으로 분석하기 위한 C# 라이브러리 및 샘플 애플리케이션.
apache/singa
Apache SINGA는 여러 대의 머신을 사용하여 대규모 신경망을 훈련할 수 있는 분산형 딥러닝 시스템입니다.
zhanghang1989/PyTorch-Encoding
이미지 분류 및 세맨틱 세그멘테이션을 위한 고급 인코딩 모듈과 모델 주(zoo)를 제공하는 PyTorch 라이브러리입니다.
CCNYRoboticsLab/imu_tools
각속도, 가속도, 자기장 데이터를 융합하여 안정적인 자세 추정치를 제공하는 ROS 기반 IMU 필터 및 시각화 도구 모음입니다.
ddemidov/vexcl
OpenCL 및 CUDA용 C++ 벡터 표현식 템플릿 라이브러리로, GPGPU 개발의 반복 코드를 줄입니다.
Farama-Foundation/SuperSuit
Gymnasium 및 PettingZoo용 강화학습 환경의 전처리를 쉽게 할 수 있도록 도와주는 미크로랩퍼 모음입니다.
ML-KULeuven/problog
논리 프로그램과 확률적 사실을 결합하여 불확실성을 다루고 복잡한 추론 작업을 수행할 수 있는 확률론적 논리 프로그래밍 도구 상자입니다.
herin7/gitforme
AI 기반의 코드 탐색 플랫폼으로, 인터랙티브 대시보드와 코드베이스 인식 AI 챗 어시스턴트를 통해 GitHub 리포지토리를 이해하는 데 도움을 줍니다.
joeylitalien/noise2noise-pytorch
Noise2Noise 논문의 비공식 PyTorch 구현으로, 가우시안, 푸아송, 텍스트 오버레이 또는 몬테카를로 렌더링 노이즈를 사용하여 노이즈만 있는 데이터로 U‑Net 노이즈 제거기를 학습하고 테스트하는 스크립트를 제공합니다.
Datayoo/HuggingFists
광범위한 코딩 없이 LLM과 Hugging Face 모델을 사용하여 워크플로를 시각적으로 구축하고 예약할 수 있는 로우코드 데이터 플로우 도구.
GaoQ1/rasa_nlu_gq
BERT 기반 의도 분류 및 BiLSTM+CRF 엔티티 추출을 포함한 고급 중국어 NLP 기능을 Rasa NLU에 추가하는 확장 기능입니다.
Jazee6/cloudflare-ai-web
Cloudflare Workers AI와 AI Gateway를 사용하여 다중 모델 채팅 UI를 빠르게 배포할 수 있는 웹 기반 AI 플랫폼 인터페이스입니다.
SaiAkhil066/CORTEX-AI-SUPER-RAG
클라우드 의존 없이 고정밀 문서 Q&A를 제공하는 로컬 에이전트형 RAG 엔진. 9단계 파이프라인, GraphRAG 및 신경망 재랭킹을 포함.
apple-aiml-research/ml-aim
멀티모달 이해 및 이미지 인식에 높은 성능을 제공하는 대규모 자기회귀형 비전 인코더 패밀리입니다.
Spr-Aachen/Easy-Voice-Toolkit
Easy Voice Toolkit은 오픈소스 음성 모델(Whisper, GPT-SoVITS)을 GUI/Colab 워크플로우에 통합하여 오디오 정리, 전사, 음성 변환 데이터셋 구축, 맞춤 음성 모델 학습, 변환 음성 생성을 수행합니다. 즉시 실행 가능한 Windows 휴대용 패키지와 Colab 노트북을 제공하며, 개발자 친화적인 설치 가이드를 포함합니다. 이 프로젝트는 학술용으로만 사용되며 향후 LLM 챗봇 통합 및 Linux 지원을 계획하고 있습니다.
yzhao062/combo
combo는 기계학습 모델과 점수를 통합하기 위한 파이썬 도구 상자입니다. 스태킹, 동적 분류기/앙상블 선택, 이상 탐지기 융합과 같은 앙상블 기법을 통일된 API로 지원하며, scikit-learn, XGBoost, LightGBM, pyod의 모델을 활용해 분류, 클러스터링, 이상 탐지 작업을 수행할 수 있습니다.
djcopley/ShellOracle
자연어 설명에서 쉘 명령어를 생성하고 다양한 LLM 제공자를 사용하여 프롬프트에 직접 삽입하는 터미널 유틸리티입니다.
apple-aiml-research/ml-gmpi
2D GANs를 Multiplane Images로 변환하여 3D 뷰 합성 및 메쉬 추출을 가능하게 하는 3D 인식형 생성 모델입니다.
hzxie/GaussianCity
GaussianCity는 Gaussian Splatting을 사용하여 무한한 대규모 도시 환경을 생성하는 생성형 3D 도시 합성 도구입니다.
DaoyuanLi2816/mini-verl
모델 역할을 단계별로 스케줄링하여 단일 NVIDIA GPU에서 verl RLHF 실험(PPO 및 GRPO 등)을 실행할 수 있게 하는 도구.
daodao97/chatmcp
Model Context Protocol (MCP)와 통합된 크로스플랫폼 AI 채팅 클라이언트로, LLM을 외부 데이터 소스 및 도구에 연결 가능.
JingyunLiang/VRT
VRT는 동영상 슈퍼리졸루션, 디블러링, 노이즈 제거, 프레임 보간 및 공간-시간 SR을 처리하는 Transformer 기반 모델인 Video Restoration Transformer의 PyTorch 구현입니다. 시간적 상호 자기 주의(TMSA)와 병렬 왜곡을 사용하여 장거리 시간 의존성을 포착하며, 9개 벤치마크에서 최첨단 PSNR 성능을 달성합니다. 리포지토리에는 사전 학습된 가중치, 테스트 스크립트, Colab 데모, 표준 동영상 데이터셋에서의 학습 지침이 포함되어 있습니다.
lxtGH/OMG-Seg
A unified framework for visual perception and reasoning that combines image, video, and pixel-level segmentation into a 시각적 지각 및 추론을 위한 통합된 프레임워크로, 이미지, 비디오, 픽셀 수준의 세그멘테이션을 단일 모델로 결합하여 전문화된 모델의 필요성을 줄입니다.
ARM-software/armnn
Arm Cortex-A CPU 및 Arm Mali GPU에서 TensorFlow Lite 및 ONNX 모델을 가속화하는 고성능 ML 추론 엔진입니다.
stotko/stdgpu
커스텀 커널에서 유연하고 신뢰할 수 있는 데이터 관리를 가능하게 하는, GPU용 경량 C++17 라이브러리로 STL 유사한 일반적인 데이터 구조를 제공합니다.
HarborYuan/ovsam
수천 개의 객체 클래스에 대한 동시에 상호작용형 분할과 개방형 어휘 인식을 가능하게 하는 Segment Anything Model (SAM)의 개방형 어휘 확장입니다.
google/jax-cfd
JAX‑CFD는 미분 가능한 CFD를 위한 JAX 기반 연구용 라이브러리입니다. 유한체적법 및 유사 스펙트럼법 솔버, 선택 사항인 ML 증강 모델, 데이터 유틸리티를 제공하여 난류 시뮬레이션에 대한 경사도 기반 실험을를 가능하게 합니다. pip를 통해 설치할 수 있으며, Colab 데모가 포함되어 있으며, 현재는 유지보수가 중단되었습니다. 최신 대체재를 권장합니다.
hzxie/CityDreamer
CityDreamer은 레이아웃 생성기, 배경 요소 생성기, 건물 인스턴스 생성기를 결합하여 무한하고 사실적인 3D 도시 풍경을 생성하는 연구용 PyTorch 프레임워크입니다. 대규모 OSM/GoogleEarth 데이터셋에서의 훈련 코드, 사전 학습된 체크포인트, 웹 데모, 동영상 렌더링을 위한 CLI를 포함합니다.
cvg/DeepLSD
DeepLSD는 딥러닝과 이미지 기울기를 결합하여 현실 세계 이미지에서 선분을 추출하고 정제하는 고정밀 선분 검출기입니다.