databrickslabs/dbldatagen

Databricks에서 Spark를 사용하여 테스트, 벤치마킹 및 데모용으로 확장 가능한 합성 데이터를 생성하기 위한 Python 라이브러리입니다.

k8sgpt-ai/k8sgpt-operator

AI 기반 클러스터 분석 및 트러블슈팅을 가능하게 하며, 특정 워크로드 실패에 대한 자동 복구 기능을 제공하는 Kubernetes 오퍼레이터.

AIProxyTeam/AIProxySwift

API 키를 보호하고 레이트 제한을 관리할 수 있는 선택적 보안 프록시 백엔드를 갖춘 Swift 라이브러리. 다양한 AI API를 앱에 통합할 수 있도록 지원합니다.

domdomegg/airtable-mcp-server

LLM이 Airtable 데이터베이스의 레코드, 스키마, 댓글을 관리할 수 있도록 읽기 및 쓰기 접근 권한을 제공하는 MCP 서버입니다.

ServiceNow/PipelineRL

GPU 활용도를 극대화하면서도 온폴리시 데이터의 최신성을 유지하기 위해 실시간 가중치 업데이트를 활용하는 확장 가능한 비동기 강화학습 프레임워크.

google/gemma.cpp

Google의 Gemma 모델을 위한 경량이고 독립적인 C++ 추론 엔진으로, 연구 및 실험용으로 최소한의 CPU 최적화 구현을 제공합니다.

Entrpi/ds4-on-spark

NVIDIA DGX Spark에서 DeepSeek-V4-Flash를 고성능으로 서빙하기 위한 스택으로, 지속적 배치, 예측 디코딩, 대규모 컨텍스트 창용 메모리 게이버넌스를 포함.

ModelEngine-Group/unified-cache-management

KV 캐시를 지속적으로 저장하고 스파스 어텐션 및 스토리지-컴퓨팅 분리를 구현함으로써 LLM 추론 지연과 GPU 메모리 사용량을 줄이는 캐시 관리 프레임워크입니다.

vuejs-ai/vue-tui

컴포넌트, Flexbox 레이아웃, 반응형 상태를 사용하여 인터랙티브한 터미널 사용자 인터페이스(TUI)를 구축하는 Vue 네이티브 프레임워크.

ekimetrics/adaptive-chunking

5가지 내재적 품질 지표를 평가하여 각 문서에 대해 최적의 청킹 전략을 자동으로 선택하는 RAG 파이프라인용 프레임워크입니다.

langchain-ai/langchain-google

Google의 생성형 AI, Gemini API 및 Vertex AI 서비스용 LangChain 통합의 중앙 집중형 컬렉션입니다.

MatthewZMD/aidermacs

Aider용 Emacs 통합으로 AI 페어 프로그래밍과 자동 코드 편집 기능을 Emacs 에디터에 제공합니다.

PaddlePaddle/FastDeploy

PaddlePaddle 기반의 LLM 및 VLM용 프로덕션 급 배포 툴킷으로, 고성능 추론과 광범위한 하드웨어 호환성을 제공합니다.

TorchIO-project/torchio

PyTorch용 Python 라이브러리로, 3D 의료 영상의 효율적인 로딩, 전처리 및 증강 도구를 제공합니다.

google-deepmind/dm-haiku

JAX의 순수 함수 변환을 유지하면서 객체 지향 모델 정의를 가능하게 하는 JAX용 신경망 라이브러리.

FluxML/Flux.jl

순수 Julia 기반 머신러닝 프레임워크로, 네이티브 GPU와 자동 미분 지원을 활용한 경량 추상화를 제공하여 모델을 구축하고 학습할 수 있습니다.

tencentmusic/cube-studio

Cube Studio는 데이터 과학 및 AI를 위한 통합 개발 환경으로, 개발 생명주기 전반에 걸쳐 일관된 환경을성을 제공하는 데 중점을 둡니다.

xberg-io/html-to-markdown

Rust 코어와 16개 언어의 바인딩을 갖춘 고성능 손실 없는 HTML-to-Markdown 변환기로, 실제 세계의 잘못된 HTML을 처리하도록 설계됨.

run-llama/llama_deploy

LlamaDeploy는 AI 워크플로우를 배포하고 서빙하기 위한 도구이지만, 현재는 llama-agents로 대체되어 지원이 중단되었습니다.

google-deepmind/acme

Acme는 강화 학습 연구를 위한 프레임워크로, RL 알고리즘 개발 및 테스트를 위한 확장 가능한 빌딩 블록과 베이스라인 에이전트를 제공합니다.

Dao-AILab/sonic-moe

NVIDIA Hopper 및 Blackwell GPU에 최적화되어 메모리 사용량을 줄이고 학습 스루풋을 높이는 고성능 Mixture-of-Experts (MoE) 구현체입니다.

Emericen/tiny-qwen

Qwen 3.8의 최소한의 PyTorch 재구현으로, 읽기 쉬운 코드베이스와 더 쉬운 모델 배포를 위한 int4 양자화 지원을 제공합니다.

galilai-group/stable-pretraining

stable-pretraining는 PyTorch Lightning 기반의 기초 모델 연구용 프레임워크로, SimCLR, DINO, MAE, CLIP 등 자기지도 학습, 감독 학습, 다중 모달 전처리를 사전 기반 설계, 실시간 평가 콜백, GPU 측 증강, SLURM 수준의 오케스트레이션을 통해 간소화합니다. 실험적인 JAX 백엔드도 포함되어 있습니다.

xtensor-stack/xsimd

다양한 CPU 아키텍처에서 수치 계산을 가속화하기 위한 C++ 라이브러리로, SIMD 인트린직스에 대한 통합 래퍼를 제공합니다.

intel/linux-npu-driver

Intel® Core™ Ultra CPU에 통합된 에너지 효율적인 AI 추론 가속을 위한 Intel® NPU용 Linux 커널 드라이버입니다.

baidu/vLLM-Kunlun

Kunlun XPU에서 vLLM을 실행할 수 있게 하는 하드웨어 플러그인으로, 최적화된 커널과 다양한 LLM 및 멀티모달 모델 지원을 제공합니다.

UbiquitousLearning/mllm

모바일 및 엣지 디바이스에 최적화된 가벼운 멀티모달 LLM 추론 엔진으로, 다양한 NPU와 GPU를 지원하며 고급 양자화 기능을 제공합니다.

fabsig/GPBoost

트리 부스팅, 가우시안 프로세스, 혼합 효과 모델을 결합하여 비선형성 및 공간적/그룹적 효과와 같은 데이터 의존성을 처리하는 소프트웨어 라이브러리.

arcjet/arcjet-js

프롬프트 인젝션 탐지, 토큰 예산 관리, 봇 및 민감한 데이터 유출 차단을 제공하는 AI 애플리케이션용 런타임 보안 플랫폼입니다.

AgentTorch/AgentTorch

수백만 개의 상호작용하는 에이전트를 시뮬레이션하여 복잡한 사회적 동역학을 모델링하는 GPU 최적화 플랫폼.

webmachinelearning/webnn

Web Neural Network API를 위한 W3C 사양으로, 웹 애플리케이션이 머신러닝 모델의 하드웨어 가속에 액세스할 수 있는 표준화된 방법을 제공합니다.

CyberAgentAILab/cmaes

연속, 정수, 범주형 변수의 블랙박스 최적화를 위한 실용적인 Python 라이브러리로, CMA-ES 및 그 변종을 구현합니다.

rodmarkun/SmolML

교육 목적을 위해 완전히 자체 구현된 순수한 Python 기계학습 라이브러리로, 핵심 ML 알고리즘의 투명한 구현과 자동 미분 엔진을 제공합니다.

Context-Engine-AI/Context-Engine

MCP를 통해 AI 코딩 어시스턴트에게 심층적인 코드베이스 컨텍스트, 메모리 및 탐색 도구를 제공하는 시맨틱 코드 검색 및 심볼 인텔리전스 시스템입니다.

kkokosa/dotLLM

C#/.NET으로 네이티브하게 작성된 고성능 LLM 추론 엔진으로, Python이나 llama.cpp에 의존하지 않고 Transformer 모델에 대한 네이티브 CPU/GPU 지원을 제공합니다.

clearml/clearml-agent

ClearML Agent은(는) 로컬 및 클라우드 리소스를 사용하여 제로 설정으로 ML 실험 실행을을 자동화하는 MLOps/LLMOps 스케줄러 및 오케스트레이션 도구입니다.

sb-ai-lab/LightAutoML

탭류, 텍스트, 이미지, 시계열 데이터에 대해 사전 구성된 프리셋 또는 사용자 정의 파이프라인을 통해 ML 모델을 생성할 수 있는 자동 기계학습 프레임워크입니다.

aiyiyi121/sxdevops

IT 운영을 위한 제어된 AI 기반 워크플로우에 관찰 가능성, 이벤트 추적, 작업 실행을 통합하는 오픈소스 지능형 운영(AIOps) 에이전트 플랫폼.

gpustack/gguf-parser-go

GGUF 모델 메타데이터를 분석하고 전체 파일 다운로드 없이 메모리 사용량과 성능을 추정하는 Go 기반 도구.

ServerlessLLM/ServerlessLLM

공유 GPU 위에서 여러 AI 모델을 효율적으로 배포할 수 있는 고성능 시스템으로, 초고속 체크포인트 로딩과 GPU 멀티플렉싱을 통해 서버리스 추론을 가능하게 합니다.

tairov/llama2.mojo

순수 Mojo로 작성된 고성능 Llama 2 추론 구현체로, SIMD 및 벡터화를 활용하여 CPU 성능을 최적화합니다.

clay-good/OpenLore

정적 분석을 기반으로 한 결정론적이고 로컬 우선의 메모리 및 거버넌스 시스템으로, AI 코드 에이전트의 코드베이스 방향성과 안전한 변경을 보장합니다.

saurabhkumar8112/cyclomatic-complexity-skill

AI 생성 로직의 유지보수성과 인간이 읽기 쉬운 형태를 위해 코드의 사이클로매틱 복잡도를 측정하고 줄이는 Claude 스킬입니다.

cursor/community-plugins

컴포넌트를 자동 탐지하고 AI 에이전트를 사용해 제출된 플러그인을 보안 스캔하는 Cursor AI 에디터용 커뮤니티 디렉터리

ROCm/MIOpen

AMD의 고성능 기계학습 기본 연산 라이브러리로, ROCm 호환 플랫폼에서 딥러닝을 위한 최적화된 커널을 제공합니다.

supermemoryai/smfs

Supermemory 컨테이너를 로컬 파일 시스템 또는 가상 bash 환경으로 노출하여, 표준 Unix 도구를 사용한 메모리 관리와 시맨틱 검색을 가능하게 하는 도구입니다.

proliferate-ai/proliferate

개발자가 여러 코딩 에이전트를 병렬로 실행할 수 있게 해주는 오픈소스 AI IDE로, 각 작업에 격리된 git worktree와 환경을 제공합니다.

0xNyk/lacp

정책 게이트, 리스크 티어 라우팅, 증거 기반 검증을 강제하는 로컬 제어 플레인과 실행 래퍼로, 더 안전한 에이전트 워크플로우를 보장합니다.