251

VCPToolBox: 연상 기억과 자율 스케줄링을 갖춘 지속적인 AI 에이전트를 위한 인프라

VCP는 수동적 검색을 의미론적 중력 시스템으로 대체하여, AI 에이전트가 지속적인 장기 기억과 자율적인 존재감을 가질 수 있도록 하는 AI 에이전트용 인프라입니다.

252

ODS: GPU 감지 및 서비스 오케스트레이션을 자동화하는 원-커맨드 로컬 AI 서버 스택

완전한 프라이버시를 위해 사용자의 하드웨어에 추론, 채팅, RAG 및 자동화 도구를 배포하는 과정을 자동화하는 로컬 AI 서버 스택입니다.

253

OnlySwitch: 중앙 집중식 시스템 토글 및 AI 기반 자연어 제어를 위한 macOS 메뉴 바 유틸리티

시스템 설정을 단순화하고 일상적인 작업을 수행하기 위해 토글 스위치와 사용자 정의 가능한 단축키의 중앙 집중식 허브를 제공하는 macOS 메뉴 바 유틸리티입니다.

254

jcode: 시맨틱 메모리와 협업형 멀티 에이전트 스웜을 갖춘 고성능 코딩 에이전트 하네스

시맨틱 메모리, 협업을 위한 멀티 에이전트 스웜, 그리고 매우 리소스 효율적인 CLI 인터페이스를 특징으로 하는 고성능 코딩 에이전트 하네스.

255

spiceai: 클러스터 사이드카 아키텍처를 갖춘 데이터 기반 AI 에이전트를 위한 가속 SQL 및 LLM 추론 엔진

Rust로 작성된 휴대 가능하고 가속된 SQL 쿼리, 검색, LLM 추론 엔진으로, 데이터 기반 AI 앱 및 에이전트가 연합 데이터에 밀리초 수준의 지연 시간으로 접근할 수 있게 합니다.

256

sherpa-onnx: 다양한 하드웨어와 언어에서 음성 인식 및 합성을 지원하는 고도로 휴대 가능한 로컬 오디오 AI 프레임워크

다양한 하드웨어 플랫폼과 프로그래밍 언어에서 로컬로 음성‑텍스트 변환, 텍스트‑음성 변환 및 기타 오디오 AI 작업을 실행할 수 있는 휴대 가능한 프레임워크.

257

moonshine: 실시간 대화형 에이전트를 위한 저지연 온디바이스 음성 툴킷

저지연 음성-텍스트 변환 및 텍스트-음성 변환 기능을 갖춘 실시간 온디바이스 음성 에이전트 및 애플리케이션 구축을 위한 오픈 소스 AI 툴킷.

258

diffusion-pipe: 대규모 이미지 및 비디오 확산 모델을 위한 파이프라인 병렬 훈련 프레임워크

다중 GPU에 걸쳐 대규모 이미지 및 비디오 확산 모델을 훈련하여 VRAM 제한을 극복할 수 있게 해주는 파이프라인 병렬 훈련 스크립트

259

runanywhere-sdks

iOS, Android, Web, React Native 및 Flutter에서 LLMs, 음성-텍스트 변환 및 텍스트-음성 변환을 기기에서 완전히 실행할 수 있는 크로스 플랫폼 SDK 제품군.

260

stable-diffusion.cpp: 이미지 및 비디오 확산 모델을 위한 경량 C++ 추론 엔진

최소한의 의존성으로 이미지 및 비디오 생성을 위한 확산 모델(SD, FLUX, Wan)을 실행할 수 있는 경량화된 순수 C/C++ 구현체입니다.

261

ai-toolkit: 소비자용 하드웨어에서 확산(diffusion) 이미지, 비디오 및 오디오 모델을 미세 조정하기 위한 올인원 트레이닝 스위트

GUI 또는 CLI를 통해 소비자용 하드웨어에서 이미지, 비디오 및 오디오 모델의 미세 조정을 가능하게 하는 확산 모델용 올인원 트레이닝 스위트입니다.

262

InvokeAI: 통합 캔버스와 노드 기반 워크플로우를 갖춘 시각 미디어를 위한 전문적인 크리에이티브 엔진

통합 캔버스와 노드 기반 워크플로우를 통해 고정밀 이미지 생성을 지원하는, 시각 미디어 생성 및 정제를 위한 전문적인 크리에이티브 AI 엔진입니다.

263

diffusers: 이미지, 오디오 및 3D 구조 전반에 걸친 최첨단 확산 모델을 실행하고 학습하기 위한 모듈식 툴박스

이미지, 오디오 및 3D 분자 구조를 생성하기 위해 사용되는 최첨단 사전 학습된 확산 모델을 위한 모듈식 라이브러리.

264

mockserver-monorepo: API 종속성을 시뮬레이션하고 혼돈 엔지니어링을 수행하기 위한 다중 프로토콜 목업 서버 및 프록시

API 종속성을 시뮬레이션하고 네트워크 트래픽을 기록하며 혼돈 엔지니어링을 수행할 수 있는 HTTP(S) 목업 서버 및 프록시입니다.

265

rf-detr: SOTA 객체 탐지, 인스턴스 세그멘테이션 및 키포인트 탐지를 위한 실시간 트랜스포머 아키텍처

DINOv2 기반의 실시간 트랜스포머 아키텍처로 최신 최고 수준의 객체 탐지, 인스턴스 세그멘테이션 및 키포인트 탐지를 구현합니다.

266

codex-slides: 코드와 문서를 프로덕션 수준 프레젠테이션으로 변환하는 에이전트 기반 AI 슬라이드 스튜디오

Codex 코딩 에이전트를 위한 오픈소스 AI 슬라이드 스튜디오로, 프롬프트, 저장소, 파일을 실시간 편집이 가능한 워크플로를 통해 전문 프레젠테이션으로 변환합니다.

267

bitsandbytes: PyTorch용 k-bit 양자화 라이브러리로 LLM 추론 및 훈련의 메모리 소비를 줄입니다

4-bit 및 8-bit 양자화를 통해 추론 및 훈련 모두에서 접근 가능한 대규모 언어 모델을 가능하게 하는 PyTorch 라이브러리.

268

PINTO_model_zoo: 엣지 디바이스에서의 교차 프레임워크 배포를 위한 사전 변환 및 사전 양자화된 모델 모음

TensorFlow Lite, ONNX, CoreML과 같은 다양한 프레임워크를 위해 사전 변환 및 사전 양자화된 AI 모델의 종합적인 저장소로, 엣지 디바이스 배포를 간소화합니다.

269

opencvsharp: 포괄적인 컴퓨터 비전 및 이미지 처리 기능을 제공하는 OpenCV용 크로스 플랫폼 .NET 래퍼

OpenCV의 포괄적인 이미지 처리 및 컴퓨터 비전 기능을 .NET 생태계로 가져오는 크로스 플랫폼 .NET 래퍼입니다.

270

opencv: 시각 인식 및 AI를 위한 포괄적인 오픈소스 컴퓨터 비전 라이브러리

OpenCV는 개발자가 소프트웨어에 시각 인식 및 AI를 구현할 수 있도록 도구와 알고리즘을 제공하는 오픈소스 컴퓨터 비전 라이브러리입니다.

271

OmniVoice-Studio: zero-shot 클로닝, 비디오 더빙 및 멀티 엔진 음성 합성을 위한 로컬 오픈 소스 보이스 스튜디오

646개 언어에 걸쳐 zero-shot 음성 클로닝, 비디오 더빙 및 멀티 엔진 TTS/ASR 기능을 제공하는 ElevenLabs의 완전한 로컬 오픈 소스 대안입니다.

272

WindsurfAPI: Windsurf의 내부 모델 액세스를 표준 OpenAI 및 Anthropic 호환 엔드포인트로 변환하는 API 게이트웨이

Windsurf/Devin의 내부 AI 모델 액세스를 서드파티 클라이언트에 사용할 수 있도록 표준 OpenAI, Anthropic, Gemini API로 변환하는 프록시 서비스.

273

fsrs4anki: 기계 학습 기반의 간격 반복 스케줄러로 Anki 복습 간격을 최적화

사용자의 기억 패턴을 기반으로 기계 학습을 활용해 카드 복습 간격을 최적화하는 최신 Anki 간격 반복 스케줄러.

274

m_flow: 인지 스타일 메모리 검색을 위한 경로 비용 점수를 사용하는 그래프 라우팅 RAG 시스템

M-flow는 계층적 메모리 구조와 경로 비용 점수를 활용하여 AI 에이전트를 위한 보다 정확하고 추론 기반의 검색을 제공하는 그래프 기반 RAG 프레임워크입니다.

275

Skywork-R1V: 고급 시각적 사고사슬 기능과 복잡한 벤치마크에서의 SOTA 성능을 갖춘 멀티모달 추론 모델

Skywork-R1V는 강화 학습과 시각적 사고사슬을 활용하여 복잡한 시각 논리, 수학, 물리 작업에서 최첨단 성능을 달성하는 오픈소스 멀티모달 추론 모델입니다.

276

llm-space: AI 에이전트 빌더를 위한 데스크톱 프로토타이핑 및 디버깅 환경

에이전트 빌더가 로컬 우선 데이터 저장 방식을 통해 AI 에이전트를 프로토타이핑하고, 추적하고, 디버깅하며, 평가할 수 있는 데스크톱 애플리케이션.

277

Helios: 고품질 분당 스케일 합성을 위한 실시간 14B 비디오 생성 모델

Helios는 단일 H100 GPU에서 최대 19.5 FPS로 고품질의 분당 스케일 비디오를 실시간으로 생성할 수 있는 14B 실시간 장시간 비디오 생성 모델입니다.

278

LightX2V: 다양한 하드웨어에서 효율적인 이미지 및 비디오 합성을 위한 고성능 추론 프레임워크

단계 증류와 양자화를 사용하여 추론 시간과 VRAM 사용량을 크게 줄이는 고성능 이미지 및 비디오 생성을 위한 경량 추론 프레임워크.

279

ort: 하드웨어 가속 ONNX 모델 추론 및 학습을 위한 Rust 인터페이스

다양한 하드웨어 가속기와 프레임워크를 지원하는, 하드웨어 가속 ONNX 머신러닝 모델의 추론 및 학습을 위한 Rust 인터페이스.

280

huggingface.js: Hugging Face 리포지토리를 관리하고 모델 추론을 실행하는 JS/TS 라이브러리 모음집

Hugging Face Hub와 인터랙션하고 수천 개의 ML 모델에 대해 추론을 실행하는 JavaScript와 TypeScript 라이브러리 모음집입니다.

281

spikingjelly: 대규모 스파이킹 신경망 훈련 및 추론을 위한 PyTorch‑네이티브 프레임워크

스파이킹 신경망(SNN)을 위한 PyTorch‑네이티브 프레임워크로, 신경형 하드웨어에서의 훈련, 추론 및 배포를 위한 도구를 제공합니다.

282

physicsnemo: 과학 및 공학을 위한 물리 정보 기반 AI 모델 구축 및 학습을 위한 확장 가능한 딥러닝 프레임워크

NVIDIA GPU에 최적화된, 과학 및 공학을 위한 물리 정보 기반 AI 모델 구축 및 학습을 위한 오픈 소스 딥러닝 프레임워크.

283

lightly: self-supervised pre-training을 위한 모듈형 컴퓨터 비전 프레임워크

PyTorch를 사용하여 레이블이 없는 이미지 데이터로 모델을 학습시키기 위한 모듈형 빌딩 블록을 제공하는 자기지도 학습용 컴퓨터 비전 프레임워크입니다.

284

boxmot: 통합 Python 및 C++ 구현을 갖춘 플러그형 다중 객체 추적 프레임워크

탐지기, 추적기 및 ReID 모듈을 교체할 수 있는 통합 인터페이스를 제공하는 플러그형 Python 및 C++ 다중 객체 추적 라이브러리.

285

yolov3: 멀티스케일 예측 및 에지 및 서버 배포를 위한 다양한 모델 변형을 갖춘 실시간 객체 탐지 프레임워크

YOLOv3 실시간 객체 탐지 모델의 PyTorch 구현체로, 다양한 모델 변형에 대해 학습, 추론 및 배포를 위한 도구를 제공합니다.

286

onnxruntime: 머신러닝 모델을 위한 크로스 플랫폼 추론 및 학습 가속기

다양한 하드웨어 및 운영 체제에서 고성능 추론 및 학습을 위한 크로스 플랫폼 머신러닝 가속기.

287

supervision: 데이터 처리 및 시각화를 위한 모델-agnostic 컴퓨터 비전 툴킷

모델-agnostic한 데이터 로딩, 시각화 및 데이터셋 관리를 위한 포괄적인 컴퓨터 비전 툴킷.

288

streamlit: 대화형 데이터 및 AI 애플리케이션을 빠르게 구축하고 공유하기 위한 Python 프레임워크

데이터 대시보드, 보고서 및 AI 채팅 애플리케이션을 위한 스크립트를 대화형 웹 앱으로 변환하는 오픈 소스 Python 프레임워크입니다.

289

yolov5: 객체 감지, 분할 및 분류를 위한 빠르고 프로덕션 검증된 컴퓨터 비전 프레임워크

실시간 객체 감지, 이미지 분할 및 이미지 분류를 위한 PyTorch 기반의 빠르고 사용하기 쉬운 컴퓨터 비전 모델.

290

mirage: AI 에이전트가 다양한 데이터 소스와 상호작용하기 위해 bash 명령을 사용할 수 있게 하는 통합 가상 파일 시스템

AI 에이전트를 위한 통합 가상 파일 시스템으로, S3, Google Drive, Slack 등 다양한 서비스를 하나의 파일 시스템으로 마운트하여 에이전트가 bash 명령으로 데이터를 조작할 수 있게 합니다.

291

liteflow: 복잡한 비즈니스 로직과 AI 에이전트를 통합 컴포넌트로 오케스트레이션하는 규칙 엔진 프레임워크

Java용 최신 규칙 엔진 프레임워크로, 복잡한 비즈니스 오케스트레이션을 분리하고 AI 에이전트를 오케스트레이션 가능한 컴포넌트로 취급합니다.

292

SenseNova-Skills: AI 에이전트를 위한 인포그래픽 생성 및 심층 연구를 포함한 엔드‑투‑엔드 사무 기능 모음

AI 에이전트를 위한 전문 사무 스킬 모음으로, 자동 인포그래픽 생성, PPT 제작, Excel 데이터 분석, 심층 연구를 가능하게 합니다.

293

holaOS: 100개 이상의 업무 통합을 통해 내구성 있는 전문 메모리를 구축하는 로컬 퍼스트 워킹 에이전트

HolaOS는 로컬 퍼스트 AI 워킹 에이전트로, 100개 이상의 업무 도구와 통합하여 사용자가 직접 제어하는 내구성 있는 전문 컨텍스트 메모리를 구축합니다.

294

InsForge: 에이전트 코딩을 위한 올인원 백엔드 플랫폼으로 AI 에이전트를 위한 인프라 기본 요소를 도구로 제공

AI 코딩 에이전트에게 데이터베이스, 인증, 스토리지 등 도구와 인프라를 제공하여 전체 스택 애플리케이션을 엔드‑투‑엔드로 구축·배포할 수 있게 하는 오픈소스 백엔드 플랫폼.

295

zcf: 한 번의 클릭으로 Claude Code와 Codex AI 코딩 에이전트를 초기화하는 제로-컨피그 설정 도구

워크플로우, API 구성, MCP를 포함한 Claude Code와 Codex를 위한 원클릭 설정을 제공하는 제로-컨피그 초기화 도구.

296

antigravity-awesome-skills: 에이전트 우선 로컬 컨트롤 플레인으로 에이전트가 선택한 스킬 스택을 기록하고 검증하는

소프트웨어 프로젝트를 위한 재현 가능한 스킬 스택을 검색, 선택, 구성할 수 있도록 AI 코딩 에이전트를 허용하는 로컬 컨트롤 플레인과 1,988개 이상의 스킬 라이브러리.

297

oh-my-openagent: 코딩 어시스턴트를 병렬 개발 팀으로 전환하는 AI 에이전트 오케스트레이션 레이어

여러 코딩 에이전트와 모델을 하나의 병렬 개발 팀으로 통합하는 AI 에이전트 오케스트레이션 레이어로, 복잡한 소프트웨어 엔지니어링 작업을 자동화하는 단일 명령을 제공합니다.

298

openlit: AI 엔지니어링을 위한 OpenTelemetry‑네이티브 관측 및 평가 플랫폼

오픈소스 AI 엔지니어링 플랫폼으로, OpenTelemetry‑네이티브 관측, 자동 평가, 프롬프트 관리를 제공하여 LLM 애플리케이션을 지원합니다.

299

langwatch: 엔드‑투‑엔드 시뮬레이션과 프로덕션 가시성을 갖춘 LLM 평가 및 AI 에이전트 테스트 플랫폼

엔드‑투‑엔드 시뮬레이션, 프로덕션 가시성, 그리고 거버넌스를 위한 AI 게이트웨이를 제공하는 LLM 평가 및 AI 에이전트 테스트 플랫폼.

300

arc-kit: 구조화된 전략 및 설계 워크플로우를 위한 AI 지원 엔터프라이즈 아키텍처 거버넌스 하네스

엔터프라이즈 아키텍트가 아키텍처 거버넌스를 전략, 설계 및 전달을 위한 체계적인 워크플로우로 전환할 수 있도록 돕는 AI 지원 툴킷입니다.