Iamshankhadeep/ccseva

Claude Code의 토큰 소비량, 비용, 서버 측 사용 제한을 실시간으로 추적할 수 있는 네이티브 Swift macOS 메뉴바 앱입니다.

wildminder/AI-windows-whl

Windows에서 설치하기 어려운 AI/ML 라이브러리를 위해 사전 컴파일된 Python wheels 컬렉션을 엄선하여 제공하며, 소스 코드 빌드 과정을 생략할 수 있습니다.

gavamedia/deltafin

Deltafin은 Rust 기반의 네이티브 바이너리로, 소비자용 하드웨어(macOS arm64 또는 Linux x86_64/aarch64)에서 전체 2.8T 파라미터 Kimi K3 Mixture-of-Experts 모델을 실행합니다. 16개의 전문가 모두 유지, 전체 다운로드 및 요청 시 스트리밍 설치 지원, 선택적 Qwen 드래프트 모델 가속, CLI 기반 채팅/완성, OpenAI 호환 서버 제공. 프로젝트는 MIT 라이선스, 모델 가중치는 원래 조건 하에 제공.

mmschlk/shapiq

기계학습 모델 예측에서 특징의 연계를 설명하기 위해 임의의 차수의 샤프리 상호작용을 근사하는 Python 패키지입니다.

automateyournetwork/netclaw

수백 개의 스킬과 MCP 통합을 사용하여 멀티벤더 네트워크 전반의 모니터링, 문제 해결, 구성을 자동화하는 CCIE 수준의 AI 네트워크 엔지니어링 에이전트.

NadirRouter/NadirClaw

프롬프트를 가장 저렴한 실행 가능한 모델로 라우팅하고 필요한 경우에만 프리미엄 모델로 에스컬레이션하여 API 비용을 40-70% 절감하는 로컬 LLM 라우팅 프록시입니다.

FlashML-org/flashlib

Triton과 CuteDSL을 기반으로 구축된 GPU 라이브러리로, k-means, PCA, ANN 검색과 같은 전통적 기계학습 연산자의 고성능 구현을 제공합니다.

google-deepmind/simply

인간과 AI 에이전트 모두가 수행하는 신속한 LLM 반복 및 자동화된 AI 연구를 위해 설계된 최소한의 확장 가능한 JAX 기반 연구 코드베이스입니다.

ROCm/aiter

AMD ROCm용 고성능 AI 연산자 라이브러리로, AI 추론 및 훈련 워크로드를 위한 최적화된 GPU 커널을 제공합니다.

apple/foundation-models-utilities

Apple Foundation Models 프레임워크용 유틸리티 패키지로, 챗 완성 클라이언트, 컨텍스트 창 관리, LLM용 동적 스킬 활성화를 제공합니다.

pipecat-ai/voice-ui-kit

Pipecat AI 음성 애플리케이션용 사용자 인터페이스를 빠르게 구축하고 배포할 수 있는 React 기반 UI 키트입니다.

microsoft/RAMPART

에이전트형 AI 애플리케이션의 보안 및 안전성 테스트를 위한, pytest에 통합된 레드팀용 프레임워크입니다.

stevibe/BenchLocal

Bench Packs라고 불리는 다양한 벤치마크 세트에 대해 로컬 또는 원격 모델에서 LLM 성능을 실행하고 비교할 수 있는 로컬 우선 데스크톱 애플리케이션입니다.

vgvassilev/clad

C++용 Clang 컴파일러 플러그인으로, 소스 코드를 변환하여 도함수, 기울기, 헤세 행렬을 계산하는 함수를 생성함으로써 자동 미분을 제공합니다.

scverse/rapids-singlecell

대규모 데이터셋에서의 계산을 가속화하는 NVIDIA RAPIDS를 활용한 단세포 분석용 GPU 가속 라이브러리로, scverse 생태계와 통합됩니다.

dorjeduck/llm.mojo

안드레이 카르파티의 llm.c를 Mojo 언어로 포트한 것으로, 저수준 LLM 학습에서 C와 동등한 성능을 달성할 수 있음을 보여줍니다.

WeZZard/jlens-qwen36

Apple Silicon의 Qwen3.6-27B용 시각적 디버거로, 야코비안 렌즈를 사용하여 모델의 내부 잠재 표현을 시각화하고 편집합니다.

AlexsJones/llmserve

추론 백엔드와 로컬 모델 파일을 자동 감지하여 LLM 서빙을 간소화하는 TUI 기반 모델 관리자 및 서버 실행기.

tuchg/Lucarne

로컬 AI 에이전트를 Telegram과 WeChat에 연결하는 가벼운 백그라운드 데몬으로, 사용자가 모바일 알림을 통해 원격으로 에이전트를 모니터링하고 제어할 수 있도록 합니다.

NVIDIA-NeMo/Evaluator

벤치모크 환경, 트래픽 관리를 위한 플러그형 인터셉터 프록시, 그리고 모델 성능 분석을 위한 멀티 포맷 보고서 기능을 갖춘 LLM 평가 프레임워크입니다.

flagos-ai/FlagTree

FlagTree는 여러 AI 칩을 위한 통합 오픈소스 컴파일러로, 다양한 Triton 기반 백엔드를 통합하여 "한 번 개발하면 어디서나 실행" 워크플로우를 가능하게 합니다.

unslothai/unsloth-zoo

Unsloth를 위한 유틸리티 라이브러리로, LLM, 비전, TTS 모델의 파인튜닝을 훨씬 더 빠르고 메모리 효율적으로 가능하게 하며, VRAM 요구량을 크게 줄입니다.

standardagents/composer-api

macOS 로컬 서버를 통해 Cursor의 자체 모델(예: Composer 2.5, Grok 4.6)을 OpenAI 호환 API 엔드포인트로 노출합니다.

kubeshark/kubeshark

eBPF를 사용하여 트래픽을 인덱싱하고 MCP 통합을 통해 AI 기반 트러블슈팅을 제공하는 Kubernetes용 네트워크 관측성 도구입니다.

maxritter/pilot-shell

Claude Code와 Codex를 둘러싸는 전문적인 컨텍스트 및 하네스 엔지니어링 시스템으로, 프로덕션 수준 소프트웨어에 필요한 지속 가능한 컨텍스트, 품질 게이트, 런타임 검증을 제공합니다.

Agent-Field/pr-af

동적 파이프라인과 증거 기반 검증을 사용하여 심층 아키텍처 감사를 수행하고 시스템 전반의 취약점을 찾아내는 오픈소스 에이전트형 코드 리뷰어입니다.

NVIDIA/cuvs

벡터 유사도 검색 및 클러스터링을 위한 GPU 가속 라이브러리로, AI 및 데이터 마이닝을 위한 근사 최근접 이웃 알고리즘의 고성능 구현을 제공합니다.

codelibs/fess

OpenSearch를 기반으로 구축된 엔터프라이즈 검색 서버로, 웹사이트, 파일 시스템, 클라우드 데이터 저장소에서 문서를 크롤링하고 인덱싱하여 중앙 집중식 전체 텍스트 검색을 제공합니다.

syncable-dev/memtrace-public

AI 코드 에이전트를 위한 구조적 기억 시스템으로, 코드베이스를 로컬에서 이시기적 지식 그래프로 변환하여 빠르고 저비용의 아키텍처 쿼리를 가능하게 합니다.

JuliaDynamics/Agents.jl

에이전트가 환경 및 서로에게 반응하는 시뮬레이션을 가능하게 하는 고성능 Julia 프레임워크입니다.

Haervwe/open-webui-tools

Open WebUI를 위한 20개 이상의 도구, 함수 파이프 및 필터의 포괄적인 컬렉션으로, 학술 연구, 멀티모달 생성 및 자율 에이전트 기능을 추가합니다.

kiwifs/kiwifs

AI 에이전트와 인간 모두를 위한 쓰기 가능하고 검색 가능하며 버전 관리 가능한 마크다운 파일 시스템. 네이티브 MCP 지원과 Git 기반 감사 기능을 갖추고 있습니다.

agentic-in/inferoa

루프 엔지니어링을 위해 설계된 추론 네이티브 에이전트로, 토큰 사용과 캐시 재사용을 최적화하여 효율적이고 장기적인 재귀 AI 워크플로를 유지합니다.

leyten/shard

분산된 GPU에서 VRAM과 컴퓨팅을 통합하여 오픈 인터넷에서 거대 AI 모델을 실행할 수 있는 프로토콜 및 엔진.

9tigerio/db2rest

데이터베이스에 대한 보안 엔드포인트를 자동으로 생성하여 AI 및 데이터 기반 애플리케이션 개발을 빠르게 할 수 있는 로우코드 REST API 플랫폼입니다.

bghira/SimpleTuner

이미지, 동영상, 오디오 생성 모델을 위한 포괄적인 트레이닝 프레임워크로, 사용자 친화적인 웹 UI와 기업용 오케스트레이션을 제공합니다.

lucienhuangfu/eLLM

CPU 서버를 위한 LLM 추론 프레임워크로, 메모리 사용량을 최적화하여 장기적, 다중 턴 추론 및 초장문 컨텍스트 작업에서 GPU를 능가합니다.

jjang-ai/mlxstudio

Apple Silicon에서 MLX 프레임워크를 사용해 로컬에서 LLM, VLM 및 이미지 생성 모델을 실행하는 네이티브 macOS 데스크톱 앱.

openvinotoolkit/model_server

OpenVINO Model Server (OVMS)는 OpenAI 호환 REST 또는 KServe gRPC API를 통해 LLM, 비전-언어 모델, 전통적인 딥러닝 모델을 제공하는 C++ 추론 서버입니다. Intel CPU, GPU, NPU에 최적화되어 있으며, 지속적 배치, 스트리밍, 모델 버전 관리, 핫 리로드, Prometheus 메트릭 등의 기능을 제공합니다. Docker, 바이너리, Kubernetes를 통해 배포 가능하며, TensorFlow, ONNX, OpenVINO IR, GGUF 등 다양한 모델 포맷을 지원하고 표준 클라이언트 라이브러리와 통합됩니다.

john-rocky/CoreML-Models

iOS 및 macOS에서 온디바이스 AI를 구현하기 위한 미리 변환된 Core ML 모델과 샘플 앱의 종합적인 컬렉션.

weslynn/AlphaTree-graphic-deep-neural-network

논문, 코드, 딥러닝 모델 다이어그램을 연결하여 개발자가 AI 애플리케이션 엔지니어링으로 전환할 수 있도록 돕는 구조화된 시각적 로드맵 및 리소스 컬렉션입니다.

Nixtla/neuralforecast

시계열 예측에서 높은 성능, 사용 편의성, 효율성을 위해 설계된 30개 이상의 최첨단 신경망 예측 모델 라이브러리입니다.

plurai-ai/intellagent

수천 개의 현실적인 엣지 케이스 상호작용을 시뮬레이션하여 대화형 AI 에이전트를 스트레스 테스트하고, 실패 지점을 찾아 성능을 최적화하는 멀티 에이전트 프레임워크.

GoogleCloudPlatform/agent-starter-pack

Google Cloud에서 GenAI 에이전트를 위한 프로덕션 수준 템플릿과 인프라 자동화를 제공하는 Python 패키지로, 프로토타입에서 프로덕션까지의 과정을 간소화합니다.

lumina-ai-inc/chunkr

레이아웃 분석과 OCR을 사용하여 PDF, PPT, 워드 문서, 이미지를 구조화된 RAG 대응 청크로 변환하는 오픈소스 문서 인텔리전스 API입니다.

automl/auto-sklearn

scikit-learn 추정기의 드롭인 대체품으로 작동하는 자동 기계 학습 툴킷으로 모델 선택과 하이퍼파라미터 튜닝을 자동화합니다.

auto-differentiation/xad

성능 중심 시스템을 위한 저런타임 오버헤드로 전진 및 역방향 모드 자동 미분을 제공하는 고성능 C++ 라이브러리입니다.

mcpware/cross-code-organizer

AI 코딩 도구용 크로스 하네스 구성 오거나이저로, 메모리, 스킬, MCP 서버를 관리하는 통합 대시보드를 제공하고 토큰 사용량을 최적화하며 도구 포이즈닝을 감지합니다.