eracle/OpenOutreach

OpenOutreach는 자체 호스팅 CLI로, LLM과 라이선스된 리드 데이터 서비스를 사용하여 간단한 제품 설명을 기반으로 B2B 잠재 고객을 발견, 평가, 이메일 발송합니다. 두 개의 하위 도구(OpenOutFind(검색 및 평가)와 OpenOutSend(이메일 강화 및 발송))를 원커맨드 워크플로우로 묶고, LLM 키, BetterContact API 키, SMTP 자격 증명만 필요로 하며, 각 리드에 사람이 읽을 수 있는 이유를 포함한 가져오기 가능한 CSV 파일을 출력합니다.

Aethena-Lab/Z3r0

Z3r0는 React UI, FastAPI 제어 플레인, LightRAG 검색을 갖춘 다중 에이전트 런타임, 그리고 Docker 기반 사전 환경 실행을 통합한 AI 기반 레드팀 워크벤치입니다. 모든 작업은 변경 불가능한 증거로 기록되며, 재생 가능한 타임라인을 제공하여 승인된 펜테스트를 감사 가능하고 공동 작업이 가능한 환경으로 만듭니다.

mvanhorn/cli-printing-press

CLI Printing Press는 Claude Code(또는 Codex)를 사용하여 어떤 API나 웹사이트를 토큰 효율적인 Go CLI와 일치하는 MCP 서버로 변환하는 Go 기반 생성기입니다. 자동으로 문서를 조사하고 트래픽을 크롤링하며, 로컬 SQLite 데이터 레이어를 구축하고, 복합 분석 명령어를 추가하며, 출력을 검증하고 공개 라이브러리에 출판할 수 있습니다. 단일 스크립트로 설치한 후, AI 어시스턴트 세션 내에서 `/printing-press <api>`를 실행하면, ESPN, flight‑goat, linear‑pp-cli와 같은 설치 가능한 CLI를 얻을 수 있으며, 오프라인에서 작동하고, 컴팩트한 JSON을 출력하며 AI 에이전트에 최적화되어 있습니다.

agent-of-empires/agent-of-empires

Agent of Empires (AoE)는 Linux/macOS에서 AI 코드 에이전트를 지속적인 tmux 세션에서 실행하는 세션 매니저입니다. TUI, 웹 대시보드, CLI, HTTP API를 추가하고, Git worktree, Docker/Podman 사전 격리, 차이점 보기, 상태 감지 기능을 제공하여 여러 에이전트를 안전하고 원격으로 모니터링하고 제어할 수 있습니다.

2akouwu/reverify

Reverify는 LLM이 바이너리(또는 소스 코드)에 대한 사실을 제안하고 이를 실제 파일과 대조하여 결정론적으로 검증할 수 있게 해주는 Python 툴킷입니다. 순수 Python 파서/디스어셈블러와 선택적 네이티브 백엔드(Capstone, Unicorn, LIEF, Z3, angr)를 제공합니다. 검증된 사실은 원장에 저장되어 AI 에이전트가 신뢰할 수 있는 상태를 잃지 않고 컨텍스트를 롤오버할 수 있게 합니다. 이 도구는 PyPI에 패키징되어 있으며, CLI와 에이전트 통합을 위한 MCP 서버를 포함하고 있습니다. 실제 Windows 바이너리를 대상으로 한 벤치마크에서 AI의 환각으로 인한 주장을 100% 잡아내는 것으로 확인되었습니다.

alchaincyf/huashu-skills

53개의 Claude 호환 *에이전트 스킬*(디자인, 데이터, 영상, 글쓰기, 성격 기반 추론 등)의 체계적인 목록으로, 설치 방법, 업데이트 체크 기능, 기계가 읽을 수 있는 카탈로그를 제공합니다. 사용자에게 맞춤형 코드 없이도 실제 생산성 작업을 수행할 수 있도록 합니다.

HazyResearch/ThunderKittens

ThunderKittens는 고속 딥러닝 커널(예: GEMM, FlashAttention)을 작성하기 위한 헤더 온리 CUDA 라이브러리입니다. 텐서 코어 호출, 비동기 메모리 이동, 공유 메모리 벤딩을 추상화하면서도 코드는 컴팩트하고 타입 안전합니다. Hopper/Blackwell(및 Vera Rubin) GPU를 대상으로 설계되어 연구자와 엔지니어가 C++에서 호출하거나 PyTorch용으로 래핑할 수 있는 최고 성능에 근접한 커널을 생성할 수 있습니다.

Blue-B/WhisperSubTranslate

whisper.cpp를 사용한 음성 인식과 Hy-MT2 또는 클라우드 API를 활용한 번역을 통해 로컬에서 비디오 오디오를 다국어 자막으로 변환하는 애플리케이션.

AISBench/benchmark

AISBench Benchmark는 LLM, 다중 모달 모델, AI 에이전트를 위한 오픈소스 평가 프레임워크입니다. 로컬 실행 또는 서비스 기반 모델에 대해 다양한 공개 데이터셋을 활용한 정확도(accuracy) 테스트와 지연 시간, 처리량, 캐시를 포함한 성능 테스트를 지원합니다. 최근 추가된 기능으로는 Harbor 에이전트 벤치마크, 프리픽스 캐시 스트레스 테스트, 응답 이상 탐지 등이 있습니다.

cortexkit/magic-context

Magic Context는 CortexKit 플러그인으로, 코딩 에이전트에 자가 관리형 장기 메모리를 제공합니다. 채팅 기록에서 유용한 사실을 추출하고, 백그라운드에서 통합하며, 세션 간에 자동으로 회상합니다. 이를 통해 AI 코딩 도구에서 흔한 압축 중단을 제거합니다.

Taxuspt/garmin_mcp

Garmin Connect에 로그인하는 Python 기반 MCP 서버로, LLM(예: Claude)이 사용할 수 있는 110개 이상의 건강, 활동, 훈련 도구(읽기 및 제한된 쓰기)를 공개합니다. Claude Desktop의 `.dxt` 확장 프로그램으로 설치하거나 로컬에서 실행 가능. `garmin-mcp-auth`로 한 번 인증 후, LLM은 걸음 수, 수면, 워크아웃, FIT 파일 다운로드, 워크아웃 생성 및 스케줄링 등을 쿼리할 수 있습니다.

bybit-exchange/svg-diagram

svg‑diagram는 AI 코딩 에이전트가 생성하는 SVG 다이어그램에 대해 엄격한 시각 스타일을 정의하고, 완성된 SVG가 그 스타일을 따르는지 확인하는 명령줄 린터(`svg‑lint`)를 제공하는 의존성 없는 Node 스킬입니다.

snakers4/silero-vad

6,000개 이상의 언어에서 높은 정확도와 낮은 지연 시간으로 오디오 스트림 내 음성을 식별하는 사전 학습된 경량 음성 활동 감지(VAD)입니다.

awslabs/cli-agent-orchestrator

CLI Agent Orchestrator (CAO)는 로컬 서버를 실행하고, 격리된 tmux 세션에서 AI 코딩 CLI(Claude Code, Copilot 등)를 시작하며, 여러 에이전트를 병렬 또는 순차 워크플로우로 감독하기 위한 통합 CLI/Web UI를 제공하는 Python 도구입니다. 스킬, 영구 메모리, 플러그인, 심지어 Kubernetes 배포까지 지원하여 개발자가 AI 코딩 어시스턴트 팀을 오케스트레이션할 수 있게 합니다.

yusufkaraaslan/Skill_Seekers

Skill Seekers는 Python CLI(옵션으로 MCP 서버 포함)로 18종류의 문서/코드(웹사이트, GitHub, PDF, 동영상, 채팅 내보내기 등)를 스크래핑하고, LLM으로 자료를 포괄적인 `SKILL.md`로 강화한 후, 22개의 AI/RAG 타겟(Claude, Gemini, OpenAI, LangChain, LlamaIndex, Pinecone 등)에 패키징합니다. 또한 19개의 AI 코딩 어시스턴트(Cursor, Windsurf, Cline 등)에 직접 패키지된 스킬을 설치할 수 있습니다.

MinishLab/semble

Semble는 CPU 전용 Python 라이브러리/CLI/MCP 서버로, 코드베이스를 약 0.5초 내에 인덱싱하고 자연어 코드 질의를 약 1ms 내에 응답합니다. 트랜스포머 수준의 관련성은 유지하면서 grep+read 기반 베이스라인 대비 약 99%의 토큰을 절약합니다. 정적 코드 임베딩(Model2Vec)과 BM25를 결합해 결과를 융합하고 코드 인식 재순위를 적용합니다. Claude Code, Codex, Cursor, OpenCode 등과 통합 가능하며, API 키나 GPU가 필요 없습니다.

Muesli-HQ/muesli

Muesli는 Apple Silicon 최적화 모델(Parakeet, Whisper, Nemotron 등)을 사용하여 macOS에서 디바이스 내 음성 인식 및 회의 트랜스크립션을 제공하는 네이티브 앱입니다. 낮은 지연 시간의 트랜스크립션을 실현하며, OpenAI/OpenRouter를 통한 호스팅된 ASR도 옵션으로 제공됩니다. 주요 기능으로는 누르고 말하기 입력, 음성 기반 편집(Quill), VAD 기반 채우기, 화자 분리, AI 생성 회의 메모, iCloud 텍스트 동기화, Siri/Shortcuts 통합, 에이전트 자동화를 위한 JSON 우선 CLI가 포함됩니다.

SakiRinn/LiveCaptions-Translator

Windows Live Captions를 LLM 및 기존 번역 API와 통합하여 투명한 오버레이를 통해 번역된 자막을 제공하는 Windows 11용 실시간 오디오 번역 도구입니다.

QuentinFuxa/WhisperLiveKit

최신 동시 음성 연구와 다중 모델 백엔드를 활용한 초저지연, 자체 호스팅 가능한 음성-텍스트 변환 파이프라인. 실시간 자막 생성 및 번역을 가능하게 합니다.

w8123/EnterpriseAgentFramework

ReachAI는 OA, ERP, CRM 등 기존 Java 기업 시스템에 AI 어시스턴트를 추가하는 오픈소스 플랫폼입니다. 앱을 스캔하고, 주석이 달린 비즈니스 메서드를 재사용 가능한 능력으로 등록하며, LLM이 통합 코드를 생성(_AI-코딩_)하고, 사용자 요청을 통제되고 버전 관리된 워크플로우를 통해 실행하며, 완전한 감사 추적을 제공합니다. 스택에는 Spring Boot, AgentScope, LangGraph4j, Vue 프론트엔드, MySQL/Redis/Milvus가 포함되며, MIT 라이선스입니다.

muscriptor/muscriptor

트랜스포머 디코더 아키텍처를 사용하여 오디오 녹음을 MIDI 및 전문 악보로 변환하는 다중 악기 음악 변환 모델.

Tencent/WeSmartFlow

WeSmartFlow는 LLM 에이전트를 사용하여 학습 목표를 이해하고, 개인화된 학습 경로를 생성하며, 대화형 시각화, 퀴즈, HTML 지식 카드를 만들고, 개인 지식 그래프에 학습 진행 상황을 저장하는 오픈 소스 에이전트 기반 적응형 학습 플랫폼(Python 3.10+, Vue 3)입니다. 전체 코스 생성, 플러그인 방식의 '학습 월드', WeClaw 채널을 통한 선택적 WeChat 통합을 지원합니다. 리포지토리에는 재사용 가능한 agent_core 라이브러리, FastAPI 백엔드, Vue 프론트엔드, 그리고 새로운 교육 경험을 구축하고 배포하기 위한 도구가 포함되어 있습니다.

OpenMOSS/MOSS-TTS-Nano

0.1B 파라미터의 다국어, 초소형 음성 생성 모델로 실시간 CPU 기반 추론과 고해상도 보이스 클로닝을 지원합니다.

abus-aikorea/voice-pro

음성 인식, 번역, 보이스 클로닝을 통합하여 자동 더빙 및 다국어 콘텐츠 제작을 지원하는 AI 기반 멀티미디어 도구

DrewThomasson/ebook2audiobook

DRM이 없는 전자책을 음성 클론과 1158개 언어를 지원하는 고급 AI 텍스트 음성 합성 엔진을 사용해 오디오북으로 변환하는 CPU/GPU 변환기입니다.

whiteguo233/OpenBiliClaw

OpenBiliClaw는 Bilibili, YouTube, Reddit 등 다양한 콘텐츠 플랫폼에서의 활동을 기반으로 당신의 심리적 프로필을 구축하는 로컬에서 실행되는 오픈소스 AI 에이전트입니다. 이 프로필을 활용해, 당신이 본 적 없는 콘텐츠를 적극적으로 탐색하고, 선택 이유를 설명하며, 모든 데이터를 당신의 기기 내부에 보관합니다. 브라우저 확장, Go/Python 백엔드(옵션의 오프라인 임베딩 모델 포함), 데스크톱 및 모바일용 웹 UI, Flutter 네이티브 클라이언트, 그리고 옵션의 DeepSeek Harness 통합을 포함합니다. 설치는 4단계: 확장 추가, 백엔드 설치(설치 프로그램 또는 AI 지원 스크립트), 소스 플랫폼 로그인, 로컬 웹 UI 열기. 프로젝트는 개인정보 보호, 크로스플랫폼 추천, 지속적인 자기학습을 강조합니다.

zhizhuodemao/js-reverse-mcp

js‑reverse‑mcp 는 LLM 에이전트가 Chrome에서 JavaScript를 디버깅하고 역공학할 수 있도록 해주는 Node.js MCP 서버입니다. DevTools 데이터(스크립트, 브레이크포인트, 네트워크, WebSocket, 스토리지)를 24개의 간결한 도구로 정리하여 AI 기반 추론에 최적화했으며, 악성 봇 방지 사이트용 옵션 스텔스 계층(Patchright 포크 및 CloakBrowser)을 포함합니다.

crynta/terax-ai

Terax는 GPU 가속 터미널, CodeMirror 에디터, Git UI, 웹 미리보기 기능을 통합한 오픈소스이자 가벼운 데스크톱 IDE입니다. 클라우드 LLM 또는 로컬 모델과 연동하는 통합 AI 사이드패널을 갖추고 있으며, AI 기반 코드 제안, 편집 차이점, 에이전트 워크플로우를 제공합니다. macOS, Linux, Windows용 약 7 MB의 Tauri 기반 앱으로 작동합니다.

snyk/agent-scan

Snyk Agent Scan은 마신상의 AI 에이전트 구성 요소(MCP 서버, 스킬, 다양한 에이전트)를 자동 탐지하고 프롬프트 인젝션, 시크릿 유출, 악성 코드와 같은 보안 위험을 점검하는 CLI 도구입니다. 설정 파일을 자동 탐지하고, 사용자 동의를 얻어 옵션으로 MCP 서버를 시작하며, 정제된 데이터를 Snyk의 분석 서비스로 전송하고 점수화된 위험 지표를 보고합니다. `uvx` 또는 서명된 바이너리로 설치하고, Snyk API 토큰을 설정한 후 스캔을 실행하세요(권장: 사전 환경 내).

Blueturboguy07/cue

cue는 화면 위에 투명한 패널을 띄워 화면, 마이크, 그리고 (Windows의 경우) 회의 오디오를 캡처하고, 선택한 언어 모델로 해당 스트림을 전송하여 회의 및 코딩 시 실시간 지원을 제공하는 오픈 소스 Electron 데스크톱 앱입니다. macOS 15.4+ 및 Windows 10 2004+에서 작동하며, OpenAI, Anthropic, Gemini, Azure, Ollama 또는 모든 OpenAI 호환 엔드포인트를 지원하고, 기기 내 전사를 위해 로컬 Whisper-cpp를 사용할 수 있습니다. 이 앱은 OS 수준의 제외 플래그를 통해 화면 공유 도구에서 숨겨진 상태를 유지하려고 시도하지만, 이는 최선의 노력(best-effort)입니다. 설치는 사전 빌드된 바이너리나 npm을 통한 소스 설치로 가능하며, 첫 실행 시 OS 권한, API 키 설정 및 선택적인 Zoom 설정을 안내합니다. 원격 측정 데이터는 수집되지 않으며, 키와 선택적인 이력서 텍스트는 로컬에 저장됩니다.

ArvinLovegood/go-stock

go‑stock은 실시간 주식 데이터와 LLM 기반 분석을 결합한 Windows/macOS 데스크톱 앱으로, 차트 도구, AI 에이전트, 백테스팅, 알림, 스킬 공유 시스템을 제공합니다. OpenAI, 로컬 모델, 중국 클라우드 모델 등 다양한 LLM 제공업체와 호환되며, GPL‑v3 라이선스로 제공됩니다.

kyutai-labs/moshi

Moshi는 특수한 스트리밍 오디오 코덱인 Mimi를 사용하여 실시간, 저지연의 양방향 음성 대화에 적합한 풀디플렉스 음성-텍스트 기반 모델입니다.

Spark-To-Paper-Skills/paperjury

PaperJury는 LLM 에이전트를 사용해 LaTeX/Markdown 논문의 구조적 사전 검토를 수행하는 Claude Code(또는 Codex) 플러그인입니다. '검토 → 판단 → 편집 → 재검사' 루프를 반복하며, 각 의견을 '안전하게 수정 가능', '저자 필수', '무효'로 분류합니다. 직접 편집, 리뷰, 자동 모드의 세 가지 방식으로 특정 변경 요청, 모크 피어 리뷰, 또는 안전 보호 장치를 갖춘 자동 운영이 가능합니다. LaTeX 컴파일, 준수 검사, 결정 기록을 포함한 결정론적 스크립트를 제공합니다. 12개 논문에 대한 벤치마크 결과, 문제 탐지 F1 스코어는 0.656, 위험한 편집은 4배 감소했습니다. 설치는 Claude Code 마켓플레이스 또는 간단한 git clone으로 가능하며, 전후 PDF가 포함된 완전한 '도그푸드' 샘플도 제공됩니다.

xlite-dev/LeetCUDA

LeetCUDA는 400페이지 분량의 학습 도서와 PyTorch용으로 래핑된 200개 이상의 CUDA 커널(고성능 HGEMM 및 Flash-Attention 구현 포함)을 제공하는 GPL-v3 저장소로, NVIDIA Tensor-Core GPU 기반의 AI 워크로드를 타겟팅합니다.

21st-dev/magic-mcp

기존 Magic-MCP 호출을 새로운 21st MCP 서버로 전달하는 소형 npm proxy입니다. 이전 설정을 유지하면서 업데이트된 AI 컴포넌트 생성 도구에 액세스할 수 있습니다.

persiyanov/herdr-reviewr

herdr‑reviewr는 *herdr* AI 어시스턴트용 터미널 UI 플러그인으로, 에이전트의 코드 변경 사항을 실시간으로 보여주고, 특정 줄에 주석을 달아 그 주석을 에이전트에게 다시 전송할 수 있습니다. 분할 패널 또는 독립형 앱으로 작동하며, 여러 가지 차이점 범위, 퍼지 파일 검색, PR 읽기 전용 보기, 테마 설정, 완전한 키바인딩 사용자 정의를 지원합니다.

jerrywu001/cc-sessions-viewer

Sessions Viewer 는 Tauri + Vue 3 로 구축된 크로스플랫폼 데스크톱 앱으로, Claude Code, Codex, Grok Build, Kimi Code, Pi, Antigravity CLI, opencode 와 같은 AI 코딩 어시스턴트에서 생성한 로컬 트랜스크립트 파일을 열고, 검색, 재생, 계속할 수 있게 해줍니다. 도구 호출의 정확한 재생, 글로벌 검색, 스플릿 패인 레이아웃, 토큰 비용 분석, 내장 또는 외부 터미널에서의 1클릭 재개를 제공하며, 원본 JSONL 파일은 읽기 전용 상태로 유지됩니다.

rullerzhou-afk/clawd-on-desk

Clawd on Desk는 AI 코드 에이전트(Claude, Copilot, Gemini, Cursor 등)의 실시간 활동을 시각화하는 크로스플랫폼 데스크톱 펫입니다. 생각, 타이핑, 도구 사용, 권한 요청, 작업 완료 등의 애니메이션을 표시합니다. 훅 파일을 통해 수십 가지 에이전트를 지원하며, 클릭 가능한 권한 버블(옵션으로 Telegram/Feishu/Slack 전달), 세션 대시보드, 읽기 전용 모바일 PWA, 사용자 정의 테마를 제공합니다.

xifan2333/fcitx5-vinput

LLM 기반 후처리와 텍스트 수정 기능을 갖춘 로컬 또는 클라우드 기반 음성 인식을 지원하는 Fcitx5용 음성 입력 애드온입니다.

jeecgboot/jimureport

JimuReport는 무료 오픈소스 로우코드 보고서 제품군으로, 전통적인 표 형식 보고서, 대시보드/대형 화면 디자이너, 대화형 AI BI(ChatBI)를 결합합니다. 내장된 Claude-Code 스킬을 통해 사용자는 자연어 프롬프트나 스크린샷에서 시각화를 생성하거나 편집할 수 있습니다. Spring Boot 스타터를 통해 통합되며, 30개 이상의 데이터 소스(중국 정부 승인 데이터베이스 포함)를 지원하고, 로컬, Docker 또는 클라우드 데모로 실행할 수 있습니다.

NVIDIA-NeMo/Speech

ASR, TTS, 음성 LLM을 포함한 전문적인 음성 AI 모델 개발 및 배포를 위한 PyTorch 기반 툴킷입니다.

HEXUXIU/M365-Copilot2API

M365 Copilot2API는 Microsoft 365 Copilot의 프라이빗 WebSocket 프로토콜을 표준 OpenAI 및 Anthropic 호환 REST 엔드포인트로 변환하는 Go 기반의 자체 호스팅 게이트웨이입니다. 익숙한 `/v1/chat/completions` (및 관련) API를 제공하고, 스트리밍, 함수 호출, 멀티모달 입력을 지원하며, 계정/OAuth 관리, API 키 처리, 프록시 풀, 사용량 통계 및 자동 세션 정리를 위한 웹 UI를 포함합니다. 이 도구를 사용하면 기존 OpenAI/Anthropic 클라이언트(Claude Code, Cursor 등)가 코드를 다시 작성하지 않고도 M365 Copilot을 호출할 수 있지만, 비공식이며 개인 연구 목적으로만 사용됩니다.

Starmel/OpenSuperWhisper

Whisper와 Parakeet 엔진을 사용한 실시간 음성 인식을 제공하는 macOS 앱으로, 키보드와 마우스의 유연한 트리거를 통해 빠른 음성-텍스트 변환을 지원합니다.

QoderAI/better-harness

Better Harness는 AI 코딩 에이전트(Claude Code, Codex, Qoder, Cursor, GitHub Copilot 등)의 전체 워크플로우를 분석하는 오픈소스 도구입니다. 프로젝트 및 세션 증거를 수집하고 '에이전트 작업 루프'(작업 이해, 제어된 실행, 변경 검증, 신뢰할 수 있는 전달, 학습 캡처)의 5가지 차원을 평가하며, 우선순위가 지정된 증거 기반의 발견 사항과 수정 제안이 포함된 시각적 HTML 보고서를 생성합니다. 누락된 증거는 명시적으로 표시되어 팀이 AI 생성 코드의 이점을 누리면서도 반복성, 검증 및 학습을 개선할 수 있도록 돕습니다.

yctimlin/mcp_excalidraw

로컬 Excalidraw 캔버스를 AI 에이전트가 CLI, MCP, REST를 통해 제어할 수 있는 프로그래밍 가능한 워크벤치로 바꿔주는 서버.

open-legal-products/mike

Mike는 OpenAI, Anthropic, Gemini 또는 로컬 Ollama를 사용하는 LLM을 통해 법무 문서와 채팅하고, 검토하며, 조사할 수 있는 오픈소스이자 자체 호스팅 가능한 법무 AI 플랫폼입니다. Next.js 프론트엔드, Express 백엔드, Supabase 인증/PostgreSQL, R2 호환 스토리지가 포함되며, Slack 및 Microsoft Word용 커넥터도 제공합니다.

pyannote/pyannote-audio

사전 학습된 PyTorch 모델을 사용하여 음성 녹음에서 누가 언제 말했는지 식별하는 오픈소스 Python 툴킷입니다.

livecontext-ai/livecontext-ce

LiveContext CE는 단일 채팅 프롬프트로 전체 워크플로우, 범위가 지정된 LLM 에이전트, 데이터 테이블 및 작은 웹 앱을 생성하는 오픈 소스 셀프 호스팅 AI 자동화 플랫폼입니다. 시각적 워크플로우 엔진, 에이전트별 예산이 책정된 AI 에이전트, 700개 이상의 내장 통합 기능, 그리고 선택적인 브라우저 렌더링 추가 기능이 포함되어 있으며, 모두 단일 Docker-Compose 스택으로 배포할 수 있습니다.