voice-pro: YouTube 처리, 음성 복제 및 다국어 번역을 위한 올인원 AI 더빙 스튜디오
ASR, TTS 및 음성 복제를 하나의 워크플로우로 통합하여 음성 인식, 번역 및 다국어 더빙을 지원하는 AI 기반 웹 애플리케이션입니다.
opencodex: 어떤 LLM이라도 Codex, Claude Code, Grok Build과 함께 실행할 수 있는 범용 제공자 프록시
OpenAI Codex, Claude Code, Claude Desktop, Grok Build과 함께 어떤 LLM 제공자든 사용할 수 있도록 그들의 API 응답을 번역하는 로컬 프록시입니다.
mesh-llm: 여러 머신에 걸쳐 GPU 및 메모리 리소스를 풀링하여 대규모 모델을 실행하는 분산 추론 시스템
여러 머신에 걸쳐 GPU 및 메모리를 풀링하여 OpenAI 호환 API를 통해 대규모 모델을 실행하는 분산 LLM 추론 시스템.
omnigent: 여러 기기에서 여러 AI 에이전트를 오케스트레이션하고 관리하기 위한 오픈 소스 메타 하네스
AI 에이전트를 위한 공통 오케스트레이션 레이어를 제공하여 사용자가 런타임을 교체하고, 정책을 강제하며, 여러 기기에서 실시간으로 협업할 수 있게 해주는 오픈 소스 메타 하네스입니다.
EverOS: Markdown을 신뢰할 수 있는 단일 원천으로 사용하는 에이전트를 위한 로컬 우선 메모리 런타임
앱과 장치 간에 휴대 가능하고 지속적인 장기 메모리를 제공하기 위해 Markdown을 신뢰할 수 있는 원천으로 사용하는 AI 에이전트를 위한 로컬 우선 메모리 런타임입니다.
semantic-router: 이기종 LLM 인프라 전반에 걸친 Mixture-of-Models 시스템 구축을 위한 프로그래머블 라우팅 레이어
Mixture-of-Models 시스템을 위한 프로그래머블 라우팅 레이어로, 이기종 컴퓨팅 및 인프라 전반에 걸친 LLM 요청 라우팅을 최적화하여 품질, 비용 및 지연 시간을 개선합니다.
openmed: 개인 정보 식별 해제 및 의료 엔터티 추출을 위한 로컬 퍼스트 임상 텍스트 파이프라인
Python, Swift, Android 및 브라우저에서 장치 내에서 실행되는 임상 엔터티 추출 및 PII 비식별화를 위한 로컬 퍼스트 헬스케어 AI 런타임.
wigolo: wigolo: AI 에이전트를 위한 로컬 우선 웹 인텔리전스
wigolo는 AI 에이전트를 위한 로컬 우선 웹 인텔리전스 툴킷으로, 핵심 기능을 위해 API 키를 요구하지 않으면서 검색, fetch, crawl, extract, cache, find-similar, research, agent 도구를 제공합니다. MCP 서버, REST 엔드포인트 또는 SDK로 실행되며, 모든 데이터를 `~/.wigolo/`에 비공개로 유지하고 고급 작업을 위한 선택 사항인 LLM 기반 합성을 제공합니다.
markstream-vue: Markstream — AI 채팅을 위한 스트리밍 마크다운 렌더러
Vue 3 / Nuxt / VitePress 패키지는 마크다운을 스트리밍되는 대로 (예: LLM 토큰 스트림에서) 점진적으로 렌더링하여 플리커를 최소화하고 AI 채팅 인터페이스에서 부드러운 경험을 제공합니다.
note-gen: AI를 사용하여 흩어진 정보 조각들을 구조화된 노트로 정리하는 로컬 퍼스트 Markdown 앱
음성 녹음 및 스크린샷과 같은 흩어진 정보 조각들을 AI를 사용하여 구조화된 노트로 정리하는 로컬 퍼스트 Markdown 앱입니다.
ms-swift: ms‑swift: LLM 및 멀티모달 모델 미세 조정을 위한 확장 가능한 경량 인프라
ms‑swift는 수백 개의 LLM 및 멀티모달 모델의 미세 조정, 서빙 및 평가를 위한 경량 풀스택 프레임워크로, LoRA 방식의 효율적인 학습, 고급 병렬 처리, 양자화, RLHF 및 Gradio 기반 UI를 제공합니다.
banana-slides: 자연어 프롬프트와 문서를 통해 편집 가능한 슬라이드와 내레이션 비디오를 생성하는 AI 네이티브 프레젠테이션 생성기
자연어 편집과 nano banana pro 모델을 사용하여 아이디어, 문서, 또는 이미지로부터 편집 가능한 전문적인 슬라이드를 생성하는 AI 네이티브 프레젠테이션 앱입니다.
airllm: 소비자 GPU에서 한 레이어씩 로드하여 massive LLM을 실행하는 메모리 효율적인 추론 엔진
AirLLM은 한 번에 하나의 모델 레이어만 VRAM에 로드하여 저사양 GPU에서도 massive LLM(최대 671B 파라미터)을 실행할 수 있게 하는 라이브러리입니다.
DeepSeek-Reasonix: DeepSeek‑Reasonix: 터미널을 위한 설정 기반, 플러그인 기반 AI 코딩 에이전트.
DeepSeek-Reasonix는 설정 및 플러그인 기반 하네스를 통해 DeepSeek 모델을 사용하는 터미널 AI 코딩 에이전트이며, 토큰 비용을 낮게 유지하기 위해 DeepSeek의 prefix cache에 최적화된 단일 정적 Go 바이너리로 제공됩니다.
WrenAI: AI 에이전트가 모든 데이터베이스에서 관리되는 대시보드를 배포할 수 있게 해주는 오픈 소스 생성형 BI 엔진
AI 에이전트가 모든 데이터베이스에서 관리되는 SQL을 생성하고, 차트를 만들며, 공유 가능한 대시보드를 배포할 수 있도록 컨텍스트 레이어를 제공하는 오픈 소스 생성형 BI 엔진입니다.
screenpipe: 화면과 오디오를 캡처하여 검색 가능한 히스토리와 AI 에이전트를 지원하는 로컬 우선 AI 메모리 시스템
화면과 오디오 활동을 캡처하여 검색 가능한 히스토리를 생성하고 AI 에이전트에게 컨텍스트를 제공하는 로컬 우선 AI 메모리 도구입니다.
openai-agents-python: 음성 및 샌드박스 실행 지원을 갖춘 다중 에이전트 워크플로 구축을 위한 제공업체에 구애받지 않는 프레임워크
경량이며 제공업체에 구애받지 않는 프레임워크로, 다양한 LLM에서 텍스트, 음성, 샌드박스 실행을 지원하며 다중 에이전트 워크플로를 구축합니다.
LightRAG: 효율적인 대규모 인덱싱을 위해 벡터와 그래프 검색을 연결하는 경량 그래프 기반 RAG 프레임워크
지식 그래프와 벡터 임베딩을 결합하여 깊은 문맥적 이해와 효율적인 증분 업데이트를 제공하는 경량 그래프 기반 RAG 프레임워크입니다.
vox-director: 단일 주제로부터 편집 스타일의 종이 콜라주 설명 영상을 제작하는 자동화 파이프라인
스크립트, 키프레임, 모션, 오디오에 이르기까지 모든 과정을 처리하여 Vox 스타일의 종이 콜라주 설명 영상을 제작하는 과정을 자동화하는 에이전트 기술.
caveman: Caveman – AI 코딩 에이전트를 위한 토큰 절약 플러그인
Caveman은 AI 코딩 에이전트가 간결한 원시인 스타일의 언어로 말하게 하여, 모든 기술적 내용을 유지하면서 산문의 출력 토큰을 최대 65%까지 절약하는 플러그인입니다.
browser-use: LLM이 자동화된 웹 작업을 위해 웹 브라우저를 제어할 수 있게 하는 AI 에이전트 프레임워크
AI 에이전트가 자연어 명령을 통해 양식 채우기, 데이터 추출, QA 테스트와 같은 작업을 수행하기 위해 웹 브라우저를 제어할 수 있게 하는 라이브러리 및 프레임워크입니다.
sglang: RadixAttention 및 광범위한 하드웨어 지원을 특징으로 하는 LLM 및 멀티모달 모델용 고성능 서빙 프레임워크
SGLang은 고급 캐싱 및 스케줄링을 통해 다양한 하드웨어에서 추론 처리량과 지연 시간을 최적화하는 LLM 및 멀티모달 모델용 고성능 서빙 프레임워크입니다.
CodeWhale: BYOK 및 세밀한 권한 제어를 지원하는 모델 불가지론적 터미널 코딩 에이전트
어떠한 LLM 제공자라도 사용하여 코드를 읽고, 파일을 편집하고, 명령을 실행할 수 있는 터미널용 오픈 소스 모델 불가지론적 코딩 에이전트.
mempalace: verbatim 저장 및 플러그형 벡터 백엔드를 갖춘 로컬 우선 AI 메모리 시스템
대화 기록을 요약본이 아닌 원문 텍스트로 저장하고, 요약 없이 시맨틱 검색을 사용하여 높은 정밀도의 검색을 제공하는 로컬 우선 AI 메모리 시스템입니다.
mnemosyne: Mnemosyne: 로컬 우선 AI 메모리 레이어
Mnemosyne는 AI 에이전트를 위한 로컬 우선, SQLite 기반 메모리 레이어로, 외부 서비스나 클라우드 의존 없이 작동 메모리, 에피소딕 메모리, 그리고 시간적 지식 그래프(TripleStore)를 제공합니다.
ECC: ECC: AI 코딩 어시스턴트를 위한 에이전트 하네스 운영체제
ECC는 AI 코딩 에이전트에게 에이전트, 기술, 명령, 훅, 메모리, 보안 스캐닝으로 구성된 조정된 엔지니어링 시스템을 제공하여 코드를 계획, 테스트, 구현, 리뷰, 검증, 기억, 개선할 수 있도록 하는 에이전트 하네스 운영체제입니다.
inkos: 다차원 연속성 감사 및 오픈 월드 인터랙티브 픽션 기능을 갖춘 전문 스토리 생성 에이전트 시스템
멀티 에이전트 감사 파이프라인과 구조화된 장기 기억을 통해 서사적 일관성을 보장하는 장편 스토리 생성 및 인터랙티브 픽션용 AI 에이전트 시스템.
apfel: apfel: macOS를 위한 CLI 및 OpenAI 호환 서버로서의 Apple 온디바이스 LLM
apfel은 Apple Silicon Mac에서 프라이빗하고 무료인 AI를 사용할 수 있도록 Apple의 온디바이스 LLM을 터미널과 로컬 OpenAI 호환 서버로 제공합니다.
OpenOutreach: OpenOutreach: B2B 리드 생성을 위한 셀프 호스팅 AI 영업 에이전트
라이선스된 데이터에서 기업 프로필을 찾고, AI를 사용하여 최적의 리드를 선별하며, 사용자의 자체 메일함에서 개인화된 이메일을 보내 B2B 리드 생성을 자동화하는 셀프 호스팅 방식의 오픈 소스 AI 영업 에이전트입니다.
herdr: 여러 AI 에이전트를 관리하고 조정하기 위한 터미널 기반 에이전트 멀티플렉서
지속적인 세션과 소켓 API를 통해 사용자가 여러 AI 에이전트를 모니터링, 관리 및 조정할 수 있게 해주는 터미널 기반 에이전트 멀티플렉서.
open-connector: OpenConnector – LLM 에이전트가 수천 개의 SaaS 도구에 안전하고 재사용 가능한 접근을 제공하는 통합된 자체 호스팅 가능한 커넥터 카탈로그
OpenConnector는 AI 에이전트가 사전 구축된 Actions 카탈로그를 통해 1 000+ SaaS 서비스를 호출할 수 있게 해주는 오픈소스 게이트웨이입니다. API 키/OAuth 토큰을 안전하게 저장하고, 검사 가능한 요청/응답 스키마를 제공하며, 로컬에서 실행하거나 Cloudflare Workers, Fly.io, 또는 OOMOL의 호스티드 SaaS에서 실행할 수 있습니다. TypeScript SDK, CLI, MCP, 또는 직접 OpenAPI 호출을 통해 통합이 가능하며, 웹 콘솔은 관리 및 디버깅 UI를 제공합니다.
apify-mcp-server: AI 에이전트를 수천 개의 기성 웹 스크래퍼 및 자동화 도구와 연결하는 MCP 서버
AI 에이전트가 웹 스크래핑, 데이터 추출 및 자동화를 위해 수천 개의 Apify Actors를 사용할 수 있게 해주는 MCP 서버로, 동적 도구 검색 및 에이전트 결제 기능을 특징으로 합니다.
open-code-review: 결정론적 엔지니어링과 에이전트 워크플로우를 결합하여 고정밀 결함 탐지를 수행하는 AI 기반 코드 리뷰 CLI 도구
결정론적 엔지니어링과 에이전트 워크플로우를 결합하여 고정밀, 라인 단위 코드 결함 탐지를 제공하는 AI 기반 코드 리뷰 CLI 도구입니다.
SmartSub: SmartSub – 원클릭 비디오 자막, 번역 및 AI 보이스오버 데스크톱
SmartSub (妙幕)은 오픈‑소스 크로스‑플랫폼 데스크톱 앱으로, 비디오 다운로드, 로컬·클라우드 ASR 모델을 통한 음성 전사, 수십 개 서비스의 자막 번역, 교정, 제로‑샷 보이스 클론을 포함한 보이스오버 생성, 그리고 자막을 비디오에 입히거나 Mux하는 전체 과정을 오프라인 우선으로 제공하며 선택적인 GPU 가속을 지원합니다.
openlake: KV cache offloading 및 모델 학습을 최적화하는 GPU 워크로드용 분산 스토리지 엔진
GPU 워크로드를 위해 Rust로 구축된 고성능 분산 스토리지 엔진으로, 빠른 KV cache offloading 및 S3 호환 객체 스토리지를 제공하여 LLM 추론 및 학습을 최적화합니다.
Vibe-Skills: VibeSkills: AI 에이전트를 위한 Skill 오케스트레이션 하네스로, 로컬 Skills를 라우팅하고 L/XL 레벨에서 작업을 계획하며 진행 상황을 기록하고 17가지 검사로 결과를 검증합니다.
VibeSkills는 로컬에 설치된 Skills를 오케스트레이션하여 복잡한 작업을 계획, 실행, 검증하며, 레벨 기반 작업 분해, Skill 선택, 실행 추적, 그리고 17점 검증 검사를 제공합니다.
llama.cpp: 다양한 하드웨어에서 로컬로 LLMs와 VLMs를 실행하기 위한 고성능 C/C++ 추론 엔진
순수한 C/C++ 구현으로 LLM 및 VLM 추론을 지원하여 최소한의 설정으로 넓은 범위의 하드웨어에서 고성능 로컬 실행을 가능하게 합니다.
DiffSynth-Studio: 생성형 이미지, 비디오 및 오디오 모델의 최첨단 탐색 및 학습을 위한 오픈 소스 확산 모델 엔진
이미지, 비디오 및 오디오를 위한 최첨단 생성 모델을 통합, 학습 및 배포할 수 있는 통합 프레임워크를 제공하는 오픈 소스 확산 모델 엔진.
OpenBiliClaw: 정보 코쿤을 깨뜨리기 위해 로컬 심리 프로필을 구축하는 크로스 플랫폼 개인화 콘텐츠 발견 에이전트
Bilibili, YouTube, X와 같은 여러 플랫폼에 걸쳐 개인화된 콘텐츠를 선제적으로 발견하기 위해 사용자의 깊은 심리 프로필을 구축하는 로컬 및 개인정보 보호 중심의 AI 에이전트입니다.
PyRIT: 생성형 AI 시스템의 리스크를 선제적으로 식별하기 위한 오픈 소스 프레임워크
PyRIT는 보안 전문가와 엔지니어가 생성형 AI 시스템의 리스크를 선제적으로 식별할 수 있게 해주는 오픈 소스 프레임워크입니다.
natively-cluely-ai-assistant: 탐지 불가능한 스텔스 모드와 로컬 RAG 메모리를 갖춘 프라이빗하고 저지연인 인터뷰 코파일럿
인터뷰와 회의 중에 저지연, 프라이빗, 그리고 탐지 불가능한 실시간 지원을 제공하는 실시간 AI 인터뷰 코파일럿 및 회의 어시스턴트입니다.
sie: 단일 클러스터에서 100개 이상의 오픈 모델을 제공하는 에이전트를 위한 셀프 호스팅 추론 엔진
단일 API를 통해 여러 오픈 소스 모델을 제공하여, 서로 다른 에이전트 작업을 위한 별도의 모델 서버가 필요하지 않게 해주는 셀프 호스팅 추론 엔진입니다.
ao: 양자화, 희소성 및 메모리 효율적 학습을 위한 PyTorch 네이티브 최적화 라이브러리
추론을 가속화하고 VRAM 사용량을 줄이기 위해 양자화, 희소성 및 메모리 효율적 학습 도구를 제공하는 모델 최적화용 PyTorch 네이티브 라이브러리입니다.
pyod: 다중 모달 데이터용 에이전트 기반 워크플로우를 갖춘 포괄적인 이상 탐지 툴킷
다중 데이터 모달리티에 걸친 이상 탐지를 위한 포괄적인 Python 라이브러리로, AI 기반 이상 탐지 워크플로우를 제공합니다.
skypilot: 여러 클라우드와 클러스터에 걸쳐 AI 컴퓨팅을 관리하고 확장하기 위한 통합 제어 평면
통합 인터페이스를 사용하여 모든 클라우드 제공업체, Kubernetes 또는 Slurm 클러스터에서 AI 워크로드를 실행, 관리 및 확장하는 시스템.
machine-learning-for-trading: ML 기반 트레이딩 전략을 구축하고 배포하기 위한 엔드‑투‑엔드 연구‑생산 파이프라인
데이터 수집 및 연구부터 실시간 프로덕션 배포까지 전체 파이프라인을 포괄하는 ML 기반 트레이딩 전략 개발을 위한 종합적인 프레임워크 및 코드베이스.
N.E.K.O: 지속적인 메모리와 데스크톱 자동화를 갖춘 능동적인 다중모달 AI 동반자
실시간 음성/시각 이해, 지속적인 5차원 메모리, 데스크톱 자동화 기능을 갖춘 능동적인 디지털 라이프를 만드는 오픈 소스 AI 동반자 플랫폼.
loop-engineering: AI 코딩 에이전트를 조정하는 자동 제어 시스템 설계 프레임워크
AI 코딩 에이전트를 조정하는 자동 제어 시스템을 설계하기 위한 프레임워크로, 수동 프롬프트를 구조화된 반복 가능한 루프로 대체합니다.
faceswap: 사진 및 비디오에서 얼굴을 인식하고 교체하는 딥러닝 도구
추출-학습-변환 파이프라인을 통해 사진 및 비디오에서 얼굴을 인식하고 교체하는 딥러닝 도구.
Maestro: 병렬 실행 및 자동 플레이북을 통한 AI 코딩 에이전트 플릿 관리용 크로스 플랫폼 오케스트레이터
여러 AI 코딩 에이전트를 병렬로 오케스트레이션하는 크로스 플랫폼 데스크톱 앱으로, 자동 플레이북, Git 워크트리 격리, 키보드 우선 인터페이스를 특징으로 합니다.