jkawamoto/mcp-youtube-transcript

긴 동영상에 대응하기 위한 페이지네이션을 갖춘, AI 에이전트가 YouTube 동영상의 자막과 메타데이터를 가져올 수 있는 MCP 서버

tiktoken-go/tokenizer

OpenAI 모델과 호환되는 토큰으로 텍스트를 인코딩 및 디코딩할 수 있는 순수 Go로 작성된 OpenAI 토크나이저 포트.

gordonmurray/firnflow

객체 저장소를 주 백엔드로 사용하고, 저지연 검색을 위한 계층형 RAM/NVMe 캐시를 갖춘 다중 테넌트 벡터 및 풀텍스트 검색 엔진입니다.

SoarGroup/Soar

Soar는 지능적인 행동을 보이는 시스템을 개발하기 위한 인지 아키텍처로, 추론과 문제 해결을 위한 프레임워크를 제공합니다.

pykt-team/pykt-toolkit

표준화된 데이터 전처리 및 다양한 모델 구현을 통해 딥러닝 지식 추적 모델을 훈련하고 벤치마킹할 수 있는 PyTorch 기반 라이브러리.

pipecat-ai/voice-ui-kit

Pipecat AI 음성 애플리케이션용 사용자 인터페이스를 빠르게 구축하고 배포할 수 있는 React 기반 UI 키트입니다.

pzqpzq/LSF_MDia

MDia는 LLM의 중간 추론을 재사용 가능한 '방언 카드'(LSF)로 체계화하는 Python 라이브러리이며, 생성, 진화, 프로파일링, 라우팅, 감사까지 수행하는 결정론적 8단계 파이프라인(collect → create → evolve → profile → select → run → validate-rules → report)을 제공합니다. 블랙박스 LLM API를 지원하며, 여러 라우팅 계획을 포함하고, 100개 규칙의 백업을 제공하며, 테스트 평가 전에 결정을 고정함으로써 재현성을 보장합니다. 리포지토리에는 API 키 없이 작동하는 토이 오프라인 데모, 풍부한 문서, MIT 라이선스, ICML 2026 포스터 및 arXiv 논문에 대한 인용이 포함되어 있습니다.

clearbluejar/pyghidra-mcp

Ghidra의 리버스 엔지니어링 스위트를 LLM 에이전트와 통합하여 자동 디컴파일, 의미론적 코드 검색 및 바이너리 분석을 가능하게 하는 MCP 서버입니다.

yehonathanlitman/Lift4D

Lift4D는 각 프레임의 3D 추정을 변형 가능한 모델에 융합하여 단일 시점의 '실제 환경' 영상에서 시간적으로 일관된 4D 자산을 재구성합니다.

agent-network-protocol/anp

AI 에이전트가 표준화된 인터페이스를 통해 서로를 탐색하고 인증하며 안전하게 통신할 수 있도록 하는 Agent Network Protocol (ANP)의 다국어 SDK 및 참조 구현입니다.

martin-rizzo/ComfyUI-ZImagePowerNodes

Z-Image Turbo 모델에 최적화된 ComfyUI 커스텀 노드 모음으로, 스타일 제어 강화, 저단계 일관성, 구성 다양성을 제공합니다.

Quantatirsk/qwen3-asr

Qwen3‑ASR는 Qwen3‑ASR 모델(0.6 B 및 1.7 B)을 감싸는 자체 호스팅 음성-텍스트 서버입니다. GPU‑vLLM 백엔드 또는 CPU‑Rust 백엔드를 자동 선택하며, OpenAI 및 Alibaba 호환 HTTP/WebSocket API를 제공합니다. 화자 분리, VAD 기반 세그멘테이션, 배치 추론을 지원하며 Docker, 커스텀 GPU 이미지, 오프라인 tar볼로 배포 가능합니다. MIT 라이선스입니다.

aws/mcp-proxy-for-aws

AWS 호스팅의 MCP 서버에 AI 애플리케이션과 에이전트가 연결될 수 있도록 해주는 브리지로, AWS IAM(SigV4) 인증을 자동으로 처리합니다.

IBM/LNN

LNN은 논리 공식을 가중치가 있는 신경망으로 표현하는 파이썬 라이브러리로, 모순되거나 불완전한 지식이 있어도 해석 가능하고 미분 가능한 추론과 학습을 가능하게 합니다.

llt22/talkio

로컬 우선, 멀티모델 AI 채팅 클라이언트로, 사용자 정의 성격과 MCP 도구 지원을 통해 다양한 AI 모델 간 그룹 대화를 가능하게 합니다.

Lamatic/AgentKit

AgentKit는 70개의 완성된 "킷"(완전한 앱, 파이프라인 또는 템플릿)을 제공하는 오픈소스 SDK입니다. 킷은 간단한 구성 파일로 정의되며, 시각적 플로우 스튜디오에서 편집 가능하고, 서버리스로 실행되는 Next.js 앱으로 배포됩니다. 지원 트리지, 코드 리뷰, RAG 채팅, 채용 어시스턴트, 법무/의료 봇 등 다양한 비즈니스 중심의 에이전트를 커버하여 신뢰할 수 있고 엔터프라이즈 수준의 AI 에이전트를 즉시 구축할 수 있는 플랫폼입니다.

Ammaar-Alam/minebench

MineBench는 “a medieval castle”과 같은 프롬프트에 대해 복셀 좌표를 출력하게 함으로써 LLM의 3D 공간 추론 능력을 평가하는 웹 기반 벤치마크입니다. 생성된 결과물을 시각화하고, 사람이 직접 일대일로 비교하며, Bradley-Terry 시스템을 통해 모델의 순위를 매깁니다. 플랫폼에는 쌍별 투표를 위한 Arena, 커스텀 결과물을 위한 Sandbox, 커뮤니티 프롬프트 Gallery, 그리고 내보보기 옵션(GLB, STL, .vox, .schem)이 포함됩니다. 주요 LLM 제공업체를 지원하며 Node.js, pnpm, 그리고 Docker를 통해 로컬에서 실행할 수 있습니다.

yejy53/GenClaw

GenClaw는 최종 렌더링 전 제어 가능한 캔버스로 실행 가능한 시각적 스케치(SVG, HTML/CSS)를 사용하는 코드 기반의 에이전트 프레임워크입니다.

redis/agent-memory-server

AI 에이전트를 위한 관리형 메모리 계층으로, 2계층 세션 및 장기 기억 모델을 사용하여 세션 간에 사실과 선호도를 영구 저장합니다.

ammaarreshi/RedAlert2-Mac-iOS-iPad

커스텀 RTS 터치 컨트롤과 재구축된 스커미시 AI를 특징으로 하는 iOS 및 iPadOS용 Command & Conquer: Red Alert 2 및 Yuri's Revenge의 네이티브급 포팅 버전.

freestylefly/wesight-obsidian

로컬 AI 에이전트(Claude Code, Codex, OpenCode)와 소셜 미디어 및 전문 문서용 다중 플랫폼 배포 워크벤치를 통합하는 Obsidian 플러그인입니다.

Entrpi/ds4-on-spark

NVIDIA DGX Spark에서 DeepSeek-V4-Flash를 고성능으로 서빙하기 위한 스택으로, 지속적 배치, 예측 디코딩, 대규모 컨텍스트 창용 메모리 게이버넌스를 포함.

cvs-health/uqlm

다양한 불확실성 정량화 기술을 사용하여 모델 출력에 신뢰도 점수를 할당하는 LLM 환각 탐지용 Python 라이브러리.

agentscope-ai/Trinity-RFT

탐색, 학습, 데이터 버퍼링을 분리하여 다양한 RL 알고리즘과 에이전트 워크플로우를 지원하는 LLM 강화 미세조정을 위한 일반 목적 프레임워크입니다.

vvvvvjdy/D-OPSD

D-OPSD는 스텝 디퓨전 모델이 빠른 인퍼런스 능력을 유지하면서 새로운 스타일과 개념을 지속적으로 튜닝할 수 있게 해주는 온폴리시 셀프 디스틸레이션 프레임워크입니다.

modelstudioai/cli

Aliyun Model Studio CLI (bailian‑cli)는 Alibaba Cloud AI 플랫폼용 터미널 도구로, 텍스트, 이미지, 동영상, 음성 생성, 자산 이해, 관리형 에이전트 오케스트레이션, 데이터셋 검증, 피니튜닝, 배포 및 계정 관리를 위한 명령어를 제공합니다. npm 또는 단일 줄 스크립트로 설치 가능하며, API 키 또는 OAuth로 인증한 후 `bl …` 명령어를 실행하거나, AI 에이전트가 자연어 프롬프트를 CLI 호출로 번역해주는 기능을 활용할 수 있습니다.

physiclaw/PhysiClaw

PhysiClaw는 로봇 암과 카메라를 사용해 스마트폰을 물리적으로 조작하는 AI 에이전트로, API나 소프트웨어 설치 없이도 어떤 앱에서도 작업을 자동화할 수 있습니다.

mit-acl/mighty

MIGHTY는 UAV, 멀티 UAV 스웜 및 지상 로봇을 위해 Hermite spline을 사용하여 빠르고 매끄러운 궤적을 계획하는 ROS 2 라이브러리입니다. Gazebo, RViz 시뮬레이션 또는 실제 하드웨어에서 실행되며, Docker, 네이티브 Ubuntu, Jetson 설치 옵션을 제공하며 IEEE RA-L 논문에 기술되어 있습니다.

aerostack2/aerostack2

모듈성과 군집 능력을 중심으로 하는 자율형 멀티 에어리얼 로봇 시스템 구축을 위한 ROS 2 프레임워크입니다.

visose/Robots

Rhino 8 및 Grasshopper용 플러그인으로, 다양한 산업용 로봇을 위한 제조사별 코드를 생성, 시뮬레이션 및 생성할 수 있습니다.

vmayoral/robot_hacking_manual

로봇 사이버 보안에 관한 포괄적인 입문 시리즈 및 매뉴얼으로, 취약점을 강조하고 보안 우선 로봇 개발을 촉진하기 위한 사례 연구와 튜토리얼을 제공합니다.

OpenLegged/URDF-Studio

URDF Studio는 URDF/MJCF/USD 모델을 편집하고, 여러 로봇을 조립하며, 다양한 형식으로 내보내고, AI 어시스턴트를 통해 생성 및 검사를 수행할 수 있는 브라우저 기반 로봇 저작 작업장입니다. React, Three.js, TypeScript, Zustand로 구축되었으며, 재사용 가능한 `@urdf-studio/react-robot-canvas` 컴포넌트도 함께 제공됩니다. Apache-2.0 라이선스.

gazebosim/ros_gz

ROS와 Gazebo 시뮬레이터를 연결하는 통합 패키지 모음으로, 로봇 시뮬레이션에서 양방향 통신 및 센서 데이터 전송을 가능하게 합니다.

real-stanford/umi-on-legs

인간의 시연과 시뮬레이션으로 학습된 전신 제어기를 결합하여, 팔이 달린 4족 보행 로봇의 이동 조작 기술을 구현하기 위한 프레임워크입니다.

nasa/ogma

NASA의 Core Flight System 및 ROS와 같은 시스템에 안전한 런타임 모니터를 통합하고, 실시간 C99 글루 코드를 자동으로 생성하는 도구입니다.

Teddy-Liao/walk-these-ways-go2

Unitree Go2 4족 보행 로봇을 위한 Sim-to-Real 보행 제어 스타터 키트입니다. walk-these-ways 프레임워크를 unitree_sdk2 아키텍처에 맞게 조정했습니다.

NVIDIA-ISAAC-ROS/isaac_ros_nvblox

nvblox용 ROS 2 통합으로, 시각 기반 장애물 회피를 위한 실시간 3D 장면 재구성과 2D 비용 맵 생성이 가능해집니다.

abizovnuralem/go2_omniverse

Nvidia Isaac Sim에서 Unitree Go2 및 G1 로봇의 고정밀 디지털 트윈 프로젝트로, 물리적 로봇과 가상 복제본 간의 실시간 동기화를 가능하게 합니다.

SJTU-ViSYS/M2DGR

M2DGR은 지상 로봇을 위한 풍부한 센서 데이터와 도전적인 실제 환경 시나리오를 특징으로 하는 대규모 멀티모달 SLAM 데이터셋입니다. 내비게이션 알고리즘의 벤치마크로 사용됩니다.

RoboVerseOrg/RoboVerse

여러 시뮬레이션 프레임워크와 데이터셋을 단일 인터페이스로 통합하는 확장 가능한 로봇 학습용 통합 플랫폼 및 벤치마크.

NetManAIOps/ChatTS

ChatTS는 다변량 시계열 데이터를 네이티브하게 이해하고 추론할 수 있도록 설계된 멀티모달 LLM으로, 사용자가 수치 데이터에 대해 대화형 질문-응답을 수행할 수 있게 합니다.

FrigadeHQ/yap

macOS용 가벼운 디바이스 내 음성 입력 도구로, Apple의 네이티브 음성 API를 사용하여 개인 정보를 보호하면서도, 어떤 활성 애플리케이션에도 전사된 텍스트를 붙여넣을 수 있습니다.

jamsch/expo-speech-recognition

iOS, Android, Web 에서 일관된 API 를 제공하는 React Native 및 Expo 전용 크로스플랫폼 라이브러리입니다.

octimot/StoryToolkitAI

비디오 푸티지를 텍스트로 변환하고 인덱싱하며 검색하는 AI 기반 영화 편집 어시스턴트입니다. 편집자는 LLM을 사용하여 편집 소프트웨어로 내보낼 스토리 셀렉션을 자동으로 생성할 수 있습니다.

cmusphinx/pocketsphinx

PocketSphinx는 저자원 장치에서 효율적으로 작동하는 오픈소스이며, 오프라인으로 동작하는 음성-텍스트 변환 엔진(C 라이브러리와 Python 바인딩 포함)입니다. 오디오 인식 또는 정렬을 수행하고 결과를 JSON 형식으로 출력하는 명령줄 도구와 API를 제공합니다.

sanjay3290/ai-skills

AI 코딩 어시스턴트가 데이터베이스, 생산성 도구 및 클라우드 인프라와 상호 작용할 수 있도록 하는 휴대용 표준화 기술 모음입니다.

basetenlabs/truss

AI/ML 모델을 본격적인 운영 환경으로 패키징하고 배포하기 위한 CLI 도구로, 컨테이너화, GPU 구성, 종속성 관리를 자동화합니다.

xxxily/hello-ai

AI 기반의 탐색 허브로, 자율 에이전트를 사용해 GitHub에서 고품질 오픈소스 AI 프로젝트를 탐색하고 평가하여 자동 업데이트되는 디렉터리로 정리합니다.