lennney/stop-that-shit

Stop That Shit 는 AI 코드 에이전트(Codex, Claude Code, OpenCode, Hermes CLI, Pi)에 보호 계층을 추가하는 플러그인입니다. 네 가지 질문으로 구성된 'Stop Ladder'를 통해 에이전트가 제안하는 작업(파일 쓰기, 종속성 설치, 해시 생성 등)이 정말로 필요한지 판단합니다. 가드는 이러한 작업을 인터셉트하여 사용자가 명시적으로 승인하지 않으면 차단하고 명확한 STOP 메시지를 반환합니다. 별도의 기술인 STSS 는 에이전트의 텍스트 출력에서 불필요한 방어적 언어를 제거합니다. 프로젝트에는 다섯 개의 에이전트용 어댑터, 테스트 스위트, 각 호스트용 설치 스크립트가 포함되어 있습니다.

altic-dev/FluidVoice

macOS용 오픈소스 음성-텍스트 변환 앱으로, 로컬 AI를 통한 음성 인식과 시스템 제어를 가능하게 합니다.

index-tts/index-tts

단일 오디오 클립에서 목소리를 복제하며, 5개 언어에 대해 감정, 속도 및 발음을 세밀하게 제어할 수 있는 제로샷 텍스트 음성 변환(TTS) 시스템입니다.

fastapi/fastapi

FastAPI는 고성능이며 타입 힌트 기반의 Python 웹 프레임워크로, API를 빠르고 안정적으로 구축할 수 있습니다. 자동 검증, 직렬화, 인터랙티브한 OpenAPI 문서를 제공하며, 개발 속도가 빠르고 프로덕션 준비가 되어 있습니다.

bethington/ghidra-mcp

Ghidra MCP Server는 Ghidra의 전체 리버스 엔지니어링 엔진(디컴파일, P-code 에뮬레이션, 라이브 디버깅, 구조체 생성 등)을 Model Context Protocol을 통해 노출하는 프로덕션 준비 완료 브리지입니다. 253개의 읽기/쓰기 도구, 배치 최적화 작업, AI 중심 문서화 워크플로우를 제공하며, stdio, HTTP 또는 SSE 전송을 통한 헤드리스, Docker 또는 GUI 배포를 지원합니다.

OpenByteInc/QuantDinger

QuantDinger는 오픈소스이자 자체 호스팅 가능한 AI 강화 거래 운영 체제입니다. Python 전략 작성, 백테스트, 종이 거래 시뮬레이션, 암호화폐 거래소 및 전통적 브로커에서 실시간 주문 실행이 가능합니다. 여러 LLM 제공자 통합, Flask-Gunicorn API, Docker-compose 배포, 옵션의 Prometheus/Grafana 관찰성, AI 기반 자동화를 위한 보안 토큰 기반 에이전트 게이트웨이를 제공합니다.

Significant-Gravitas/AutoGPT

AutoGPT는 자율 AI 에이전트를 구축, 배포 및 관리하기 위한 오픈 소스 플랫폼입니다. 사용자는 평이한 영어로 목표를 설명하거나 시각적으로 워크플로우를 구성할 수 있습니다. 시스템은 LLM 기반 에이전트를 생성하여 45개 이상의 통합 서비스(Gmail, Slack, GitHub 등)와 상호 작용하며 보고서 작성, 인시던트 분류, 마케팅 문구 생성 등의 작업을 완료합니다. 이 프로젝트는 유료 호스팅 서비스와 무료 자체 호스팅 Docker 어플라이언스를 제공하며, 핵심 플랫폼은 Polyform Shield 라이선스를, 클래식 에이전트 코드는 MIT 라이선스를 따릅니다.

stemdeckapp/stemdeck

Demucs를 사용하여 곡을 보컬, 드럼 등 고립된 트랙으로 분리하는 무료로 로컬에서 작동하는 오디오 스템 분리 도구로, DAW 스타일의 미키서를 통해 로컬 재생 및 내보내기가 가능합니다.

QwenAudio/qwen-audio-agent

AI 에이전트가 복잡한 백그라운드 작업을 동시에 실행하면서 사용자와 지속적인 대화를 유지할 수 있는 실시간 음성 런타임.

Gentleman-Programming/gentle-shell

gentle-shell™는 npm으로 배포되는 터미널 UI로, Pi 개발 환경 내에 LLM 기반 코딩 에이전트를 실행합니다. 작업, 변경 사항, 에이전트 계층을 통합한 단일 워크스페이스를 제공하며, 선택적 형식적 사양 기반 개발(SDD)과 가벼운 유기적 개발(ODD)을 지원합니다. 적용 전에 구체적인 변경 사항을 네이티브로 리뷰할 수 있으며, 선택적 보조 패키지를 통해 확장 가능합니다. `pi install npm:gentle-pi@2.6.0`로 설치하고 `pi`로 실행합니다.

risa-labs-inc/BossConsole

BossConsole (BOSS)은 AI 에이전트를 위한 오픈소스, 크로스 플랫폼 데스크톱 하네스입니다. Kotlin Multiplatform과 JVM으로 구축되었으며, 네이티브 에디터, 임베디드 Fluck 브라우저, 공유 가능한 터미널, Git/Docker/K8s 도구 및 플러그인 'Toolbox'를 제공합니다. 모든 기능은 MCP 도구(`mcp__boss__*`)로 노출되어 모든 모델(Claude Code, Codex, Gemini, OpenCode 등)이 호출할 수 있으며, 세밀한 RBAC, 도구별 킬 스위치, 서명된 플러그인 기능을 갖추고 있습니다. 핫 리로드를 통해 에이전트는 런타임에 새로운 도구를 진화시킬 수 있습니다. Homebrew, 스크립트 또는 OS 패키지를 통해 설치 가능하며 Apache-2.0 라이선스를 따릅니다.

MengTo/Skills

AI 코딩 에이전트(Codex, Claude, Cursor 등)를 위한 단계별 버전 관리 프롬프트/워크플로우 레시피인 123개의 '스킬'을 담은 Markdown 기반 라이브러리입니다. 각 스킬은 `agent-skills/<category>/<skill>/SKILL.md`에 위치하며 데모, 에셋, 참조 링크를 포함할 수 있습니다. 이 저장소를 통해 개발자는 프롬프트를 재사용 가능한 코드 자산으로 취급하여 UI 디자인, Web-GL, Three.js 게임 및 미디어 생성 워크플로우를 반복 가능하게 만듭니다. MIT 라이선스로 제공되며 모든 LLM 기반 개발 도구에서 컨텍스트로 로드할 수 있습니다.

kirodotdev/KiroCrew

Kiro Crew는 에이전트 상태(메모리, 교훈, 기술)를 재시작 후에도 유지하는 오픈소스 온프레미스 AI 에이전트 플랫폼입니다. 장시간 실행 또는 예약된 작업을 인간의 개입 없이 수행할 수 있으며, 데스크톱 앱, 웹 대시보드, CLI 또는 채팅 통합(Slack, Discord 등)을 통해 접근 가능합니다. 1줄 스크립트, Docker, 또는 네이티브 데스크톱 패키지를 통해 설치할 수 있으며, Gateway 프로세스는 모든 데이터를 로컬에 저장하고 사전 방어 및 승인 정책을 강제합니다.

modelscope/FunASR

오프라인, 스트리밍, 에지 배포를 위한 산업용 음성 인식 툴킷으로, ASR, VAD, 문장 부호 복원, 화자 다이어라이제이션의 통합 파이프라인을 제공합니다.

zubair-trabzada/geo-seo-claude

Claude Code 스킬로 웹사이트의 AI‑검색(GEO) 가시성을 감사하고, 인용 가능성, 브랜드 신호, 콘텐츠 품질, 기술 SEO 및 스키마를 평가한 후, 마크다운 또는 PDF 클라이언트 보고서를 생성합니다.

thewh1teagle/vibe

Whisper와 같은 AI 모델을 사용하여 디바이스에서 음성을 텍스트로 변환하는 사생활 보호 및 오프라인 오디오 및 비디오 변환 도구입니다.

Gentleman-Programming/engram

Engram은 AI 코딩 에이전트에게 지속적이고 검색 가능한 메모리 저장소(SQLite + FTS5)를 제공하는 단일 바이너리 Go 프로그램입니다. Claude Code, Gemini CLI, VS Code Copilot, Cursor 등 MCP 호환 에이전트와 CLI, HTTP API, MCP, 터미널 UI를 통해 작동합니다. 제로 의존성, 로컬 우선 저장소를 지원하며, 클라우드 복제도 선택적으로 가능합니다. `mem_save`, `mem_search`, `mem_context`, `mem_session_summary` 등 다양한 메모리 명령어를 통해 에이전트가 결정, 버그 수정, 설계 근거를 세션과 팀 간에 기억할 수 있도록 합니다.

modelbus/one-api-pro

OneAPI Pro는 Vue 3 관리 UI를 갖춘 Go 기반 오픈소스 AI API 게이트웨이입니다. 많은 LLM 제공업체에 대한 액세스를 통합하고, 토큰/역할 관리, 구독 청구, 사용량 대시보드를 추가하며, 분산형 멀티노드 클러스터링을 지원합니다. 정적 바이너리 또는 Docker 이미지로 배포할 수 있습니다.

ggml-org/whisper.cpp

whisper.cpp는 OpenAI의 Whisper 음성 인식 모델을 순수 C/C++로 구현한 것입니다. CPU 및 다양한 가속기(Apple Silicon, NVIDIA CUDA, AMD ROCm, Intel OpenVINO 등)에서 오프라인으로 실행되며, 혼합 정밀도 및 양자화 모델을 지원합니다. 또한 간단한 C-API와 언어 바인딩을 제공하여 데스크톱, 모바일, 임베디드 및 웹 플랫폼에 쉽게 통합할 수 있습니다.

echo-loop/Echo-Loop

집중 청취, 샤도잉, 재설명의 사이클을 간격 반복과 결합한 AI 기반 영어 청취 및 발화 학습 앱

ace-step/ACE-Step-1.5

ACE‑Step 1.5는 언어 모델 기반 계획과 Diffusion‑Transformer 오디오 디코더를 결합한 오픈소스 음악 생성 기초 모델입니다. RTX 3090에서 10초 미만으로 10초~10분 길이의 전체 곡을 생성 가능하며, 기준 모델은 4GB 미만의 VRAM으로 작동하고, 몇 곡만으로도 LoRA 미세조정이 가능합니다. 리포지토리는 Gradio 및 REST 인터페이스, 주요 OS용 실행 스크립트, 여러 모델 크기(4 B XL 버전 포함), 가사, 스타일, 템포, 악기 구성에 대한 광범위한 제어 기능을 제공합니다.

michael-denyer/pstack-claude

pstack‑claude는 MIT 라이선스 플러그인으로, Claude Code용 54개의 재사용 가능한 "Agent Skills"(예: TDD, CI 수정, PR 요약)을 제공하며, 공유 스킬 디렉토리를 통해 Codex, Prime Agent, opencode 및 Gemini‑CLI에서도 사용할 수 있습니다. Claude 세션에 poteto‑mode 지시를 자동 주입하고, Codex용 생성된 슬래시 명령 스텁을 제공하며, 스킬 세트를 업스트림 Cursor 버전과 동기화하는 CI를 포함합니다.

lightpanda-io/browser

Lightpanda Browser는 AI 에이전트와 대규모 웹 자동화를 위해 구축된 Zig로 작성된 경량 헤드리스 브라우저입니다. 완전한 V8 JavaScript 엔진을 실행하고, CDP 및 WebDriver BiDi 인터페이스를 제공하며, LLM이 평범한 영어 태스크를 통해 브라우저를 제어하고 결정론적인 JavaScript 스크립트를 기록하는 "에이전트" 모드를 포함합니다. 벤치마크에 따르면 헤드리스 Chrome보다 메모리가 약 16배 낮고 페이지 로드가 약 9배 빠릅니다. Homebrew, AUR, 직접 바이너리 또는 Docker를 통해 설치할 수 있으며, Linux/macOS(Windows는 WSL2)를 지원하고 주요 LLM 제공자와 통합됩니다. 이 프로젝트는 MIT 라이선스를 사용하며, 적극적으로 테스트(단위, 엔드투엔드, Web Platform Tests)되고 있으며, 커뮤니티 Discord에 의해 뒷받침됩니다.

m-bain/whisperX

OpenAI의 Whisper에 배치 추론, 단어 단위 타임스탬프 및 화자 분리 기능을 추가하여 강화한 고속 자동 음성 인식 시스템입니다.

rafal-qa/slopo

Slopo는 코드 임베딩 모델(Jina AI, Voyage AI, 또는 로컬 Ollama)을 사용하여 저장소 전체에서 의미적으로 유사한 코드 조각을 찾는 Python 기반 CLI입니다. 소스 파일을 인덱싱하고, 벡터 임베딩을 계산하고, 유사한 스니펫을 클러스터링하며, 사람의 검토를 사람이나 AI 코딩 에이전트가 검토할 수 있도록 Markdown 또는 요약된 보고서를 출력합니다. 설치는 `uv tool install slopo`를 통해 이루어지며, 설정은 `slopo init`으로 수행합니다. 이 도구는 리팩토링을 돕고 AI 토큰 사용량을 줄이기 위해 숨겨진 비정형 코드 중복을 탐지지합니다.

jzjzzzzzzz/agent-me

Agent‑Me는 개인의 Markdown 지식베이스를 검사 가능한 AI '트윈'으로 전환하는 오픈소스 FastAPI + React 시스템입니다. 결정론적 다단계 파이프라인(검색 → 계획 → 조사 → 비판 → 작성 → 선택적 검증)을 실행하고, 모든 답변에 대한 완전한 실행 추적을 반환하여 모든 답변을 증거 기반으로 하고 감사 가능하게 만듭니다. 리포지토리는 Docker-compose 및 로컬 툴체인 설정, 선택적 OpenAI 호환 LLM 통합, 결정론적 피규어를 갖춘 테스트 세트, 개발자가 아키텍처를 확장할 수 있는 이중 언어 커리큘럼을 제공합니다.

NVIDIA/skills

NVIDIA Agent Skills는 cuDF, cuOpt, DeepStream, Jetson, NeMo, DOCA 등 NVIDIA 소프트웨어를 설치, 구성, 사용하는 방법을 가르치는 포터블 지침 세트(스킬)의 카탈로그입니다. 스킬은 오픈소스 `skills` CLI(`npx skills add nvidia/skills …`)로 설치 가능하며 특정 에이전트에 타겟팅할 수 있습니다. 리포지토리는 제품 리포지토리의 스킬 정의를 미러링하고 자동 동기화 파이프라인을 통해 최신 상태로 유지됩니다.

OpenMinis/OpenMinis

OpenMinis는 iOS 및 안드로이드용 오픈소스 모바일 AI 에이전트로, 어떤 LLM(Claude, GPT, Gemini 등)도 디바이스에서 직접 실행할 수 있습니다. 사전화된 Alpine Linux 셸(iSH on iOS, PRoot on Android)을 제공하여 에이전트가 패키지 설치, 스크립트 실행, 파일 조작이 가능하며, 건강, 캘린더, 홈킷, 블루투스, 클립보드, 미디어 등 네이티브 디바이스 서비스를 도구로 사용할 수 있습니다. 사용자는 재사용 가능한 "스킬"(SKILL.md 포함 폴더)을 만들고, 별도의 워크스페이스로 작업을 정리할 수 있습니다. 일반적인 사용 사례로는 영양 기록, 아침 브리핑, 채팅에서 작업 추출, Obsidian 동기화, 공유 → 이벤트 자동화 등이 있습니다. 코드베이스는 iOS용 Swift/SwiftUI, 안드로이드용 Kotlin/Compose로 구성되며, GPL-v3 라이선스입니다.

Gnosil/semantix

Semantix는 LLM 코딩 에이전트에 세션 간 메모리를 추가하는 Go 기반 CLI 도구입니다. 완료된 세션에서 재사용 가능한 "슬라이스(slices)"를 추출하여 로컬에 저장하고, 유사한 작업 시작 시 일치하는 슬라이스를 바이트 안정적인 접두사로 주입하여 공급자의 프롬프트 캐시 적중률을 높이고 추론 비용을 절감합니다. 전체 에이전트(`semantix-agent`)로 실행하거나 도구 등록, 미들웨어, 게이트웨이를 통해 기존 에이전트에 커널로 부착할 수 있습니다. 데모에서 최대 99.8%의 캐시 적중률과 약 80%의 비용 절감 효과를 보고하며, Claude Code, LangChain 및 모든 OpenAI 호환 클라이언트와 통합됩니다.

MaxHu-xuan/chat-archive-guard

ChatArchiveGuard는 채팅 내보내기 파일(텍스트, JSON/JSONL, SQLite)을 로컬에서 스캔하여 비밀/PII 패턴, 형식 오류 및 SQLite 무결성을 감지하고, 데이터를 수정하거나 업로드하지 않고 집계 수와 커버리지 플래그를 보고하는 Python 전용 CLI입니다.

trailofbits/skills

Trail of Bits Skills는 수십 가지 보안 중심의 "스킬"(예: 정적 분석, 스마트 계약 감사, YARA 규칙 작성, 변형 테스트)을 추가하는 Claude Code/Codex 플러그인 마켓플레이스입니다. 단일 명령어 `/plugin marketplace add trailofbits/skills`로 설치한 후, LLM에서 개별 플러그인을 호출하여 구체적인 분석을 수행하고 구조화된 결과를 얻을 수 있습니다.

cubeplexai/cubeplex

CubePlex는 격리되고 지속 가능한 워크스페이스에서 팀이 관리형 AI 에이전트를 실행할 수 있는 오픈소스 클라우드 네이티브 플랫폼입니다. 다중 모델 채팅, 재사용 가능한 스킬, 스코프 메모리, 도구 커넥터, IM 통합, 내장 거버넌스를 제공하며 Docker Compose 또는 Helm/Kubernetes로 배포할 수 있습니다.

coldteadotai/pr-lens

PR Lens는 GitHub 통합 도구로, 풀 리퀘스트의 diff를 애니메이션 아키텍처 및 데이터 흐름 다이어그램으로 전환합니다. GitHub App, CI Action, 로컬 CLI, 또는 코딩 에이전트 스킬을 통해 사용 가능하며, `.github/pr‑lens.yml` 파일로 구성할 수 있습니다. 시각적 출력은 리뷰어가 코드를 깊이 파고들기 전에 변경의 범위와 영향을 이해하는 데 도움을 줍니다.

k2-fsa/sherpa-onnx

다양한 하드웨어와 운영 체제에서 음성 인식, 음성 합성 및 기타 오디오 AI 기능을 로컬에서 실행할 수 있는 포터블 프레임워크.

vshulcz/deja-vu

deja‑vu 는 코드 생성 에이전트(Claude Code, Codex, Cursor, Copilot 등)를 위한 로컬 전용 메모리 계층입니다. 이 에이전트들이 이미 작성하는 트랜잭션 파일을 인덱싱하고, 빠르게 검색 가능한 인덱스를 구축한 후, 동일한 머신에서 실행되는 모든 에이전트 세션에 관련된 과거 결정을 자동으로 삽입합니다. 주요 기능으로는 후행 자연어 검색, 에이전트 간 리콜, 컴팩션에 강건함, 상태 추적, 노후 경고, 머신 간 동기화/핸드오프, 시크릿 자동 마스킹이 있습니다. 1줄 스크립트, Homebrew, Scoop, Go, NPM 으로 설치 가능하며, `deja install --auto` 는 감지된 에이전트에 작은 MCP 서버를 연결합니다. `deja "jwt refresh token"`, `deja wip`, `deja blame <file>`, `deja sync ssh <host>` 등의 명령어를 사용하고, 로컬 LLM을 통한 세마틱 임베딩도 선택적으로 활용 가능합니다. 모든 처리는 머신 내부에서 이루어지며, 내장된 개인정보 보호 기능이 있습니다.

Javis603/token-monitor

Token Monitor는 35개 이상의 AI 코딩 어시스턴트의 로컬 로그와 API 키 잔고를 읽어 실시간 토큰 사용량, 비용, 할당량 한도를 표시하는 크로스플랫폼 데스크톱 위젯입니다. 자체 호스팅 또는 Cloudflare 허브를 통해 여러 기기 간에 요약 정보를 동기화할 수 있습니다. 세션별 분석, 역사적 히트맵, CSV/JSON 내보내기, 고도로 사용자 정의 가능한 UI를 제공하며, 원시 프롬프트 데이터는 모두 개인 정보 보호를 위해 로컬에 유지됩니다.

chidiwilliams/buzz

Buzz는 OpenAI의 Whisper를 사용하여 오디오/비디오(또는 YouTube 링크)를 클라우드에 데이터를 전송하지 않고 오프라인에서 자막화 및 번역하는 데스크톱 앱입니다. 실시간 마이크 자막, 발화자 식별, 음성 분리, 여러 하드웨어 가속 백엔드(CUDA, Apple-silicon, Vulkan), 서브타이틀 형식 내보내기, 검색 가능한 뷰어, 폴더 감시 자동화, CLI, 플러그인 시스템을 지원합니다. DMG(macOS), 설치 프로그램(Windows), Flatpak/Snap/AppImage(Linux), 또는 pip(Python)로 설치 가능. MIT 라이선스.

Arize-ai/phoenix

Arize Phoenix는 트레이싱, 평가, 실험, 디버깅이 가능한 오픈소스이며 자체 호스팅 가능한 AI 오브저버빌리티 플랫폼입니다. LangChain, OpenAI Agents, Claude 등 다양한 프레임워크와 OpenAI, Anthropic, Bedrock, Google GenAI 등 다양한 프로바이더를 OpenTelemetry/OpenInference 인스트루먼테이션을 통해 지원합니다.

resemble-ai/chatterbox

GPU 및 CPU 배포를 위한 다양한 모델 크기로 저지연 음성 클로닝과 다국어 음성 생성을 제공하는 오픈소스 텍스트-음성 모델 패밀리입니다.

XiaoMaColtAI/math-modeling-skill

오픈소스 AI 에이전트 기술로 수학 모델링 대회 작업을 분석, 코딩, 논문의 3단계로 구조화. Python/MATLAB 지원, 출판 수준의 그래프 생성, 재현성 보장, Word/LaTeX 논문 출력. 내장된 품질 검사 서브에이전트 포함. DeepSeek Harness 플러그인 및 완전한 테스트 세트 제공.

huggingface/speech-to-speech

저지연, 모듈식 음성 에이전트 파이프라인으로 VAD, STT, LLM, TTS 구성 요소를 조율하여 실시간 음성 대화를 가능하게 합니다.

makecindy/cindy

Cindy는 오픈소스이며 크로스플랫폼인 AI 에이전트 클라이언트(Electron 데스크톱 + React-Native 모바일)로, 여러 LLM 허니스(Claude Code, Codex 등)를 로컬 파일 접근, 브라우저/OS 제어, 지속적 메모리, 확장 가능한 "스킬"과 통합합니다. 리포지토리는 클라이언트 코드, 공유 TypeScript 패키지, 앱 빌드/실행 도구를 포함합니다. 백엔드 서비스는 별도에 존재합니다. 클라우드 기반 사용(Cindy 계정을 통한)과 완전히 로컬 에이전트(로그인 스킵)를 모두 지원합니다. Apache-2.0 라이선스.

QwenAudio/CosyVoice

CosyVoice는 고품질의 제로샷 다국어 음성 합성 및 보이스 클로닝을 위해 설계된 고급 LLM 기반 텍스트 음성 변환(TTS) 시스템입니다.

yuanbw2025/storyforge

StoryForge는 오픈소스이며 브라우저 기반의 AI 지원 서사 창작 툴킷입니다. 장편/단편 소설 작성을 가능하게 하고, 각본이나 만화로 변환하며, 세계관을 플레이 가능한 경험(런테이블, 채팅, 텍스트 어드벤처 등)으로 전환할 수 있습니다. 모든 데이터는 로컬(IdxexedDB)에 저장되며, 사용자가 자체 LLM API 키를 제공합니다. 플랫폼에는 버전 인식 "Harness" 계층이 있어 모든 AI 호출을 기록하고, 메모리 검색을 관리하며, 저자가 확인한 채택을 강제함으로써 장간 및 파생 제품 간 장기 일관성을 보장합니다.

visualbruno/3DGenStudio

3D Gen Studio는 오픈소스이며 AI 기반의 데스크톱/웹 앱으로, 엔드투엔드로 3차원 자산을 구축할 수 있습니다. 칸반 보드 또는 노드 그래프 인터페이스를 ComfyUI 워크플로우와 외부 3차원 생성 API와 결합하여 이미지-메시 파이프라인, 자동 UV/리톱로지, AI 기반 자동 릴리그(SkinTokens + 선택적 Kimodo 모션), LOD/최적화, 게임용 최적화 검사 등을 제공하며, 모든 데이터는 로컬 디스크에 저장됩니다.

breezeblue-ai/breeze-tts

Breeze TTS 2는 실시간 상호작용을 위해 설계된 오픈 가중치 이중 언어 텍스트 음성 변환 모델로, 자연어 음성 디자인과 초저지연 스트리밍을 특징으로 합니다.

leo-lilinxiao/codex-autoresearch

Codex‑autoresearch는 Git 기반의 Codex 스킬로, 자율적인 루프를 실행합니다: 단일 코드 변경 제안 → 커밋 → 수치 메트릭(예: 테스트 실패 수) 측정 → 메트릭이 개선되고 선택적 가드를 통과하면 변경 유지, 그렇지 않으면 되돌림. 사용자가 지정한 목표에 도달할 때까지 반복하며, 불변의 이벤트 로그와 HTML 리포트를 저장합니다. 포그라운드 또는 백그라운드 실행 가능, 모든 측정 가능한 결과에 대응 가능하며, 엄격한 안전성(모든 시도는 실제 커밋, 실패 시 명확한 오류로 중단)을 보장합니다.

liliu-z/stashbase

StashBase는 로컬 우선의 데스크톱 앱으로, 개인 파일(PDF, 문서, 이미지, 녹음 파일 등)에서 검색 가능하고 링크된 Markdown 위키를 생성하여 AI 에이전트가 그 컨텍스트로 사용할 수 있도록 합니다. 의미 기반 검색, OCR/음성 인식 기능을 제공하며 OpenQuill, Claude Code, Codex 또는 어떤 MCP 호환 클라이언트와도 통합되지만, 모든 원본 파일은 당신의 기계에 그대로 보관됩니다.