BinarCode/laravel-restify
단일 코드베이스에서 Eloquent 모델을 JSON:API 엔드포인트와 AI 에이전트용 MCP 서버로 자동 변환하는 Laravel 패키지입니다.
Stevenic/vectra
메타데이터 필터링, 코사인 유사도, 로컬 또는 API 기반 임베딩을 지원하는 로컬 파일 기반 메모리 내 벡터 데이터베이스입니다.
metaopt/torchopt
이중 최적화 및 메타학습을 위한 명시적, 음함수, 제로차 미분을 지원하는 효율적인 PyTorch 라이브러리입니다.
Esri/deep-learning-frameworks
ArcGIS Pro 및 Server 내에서 사용하기 위해 254개의 딥러닝 및 머신러닝 라이브러리를 번들로 제공하여 지리공간 AI 문제를 해결하는 설치 프로그램 모음입니다.
otwld/ollama-helm
Kubernetes에 Ollama LLM 서버를 배포하는 Helm 차트로, CPU 또는 GPU 지원, 모델 사전 풀, 사용자 정의 모델 빌드, Ingress/Gateway-API, 자동 스케일링 및 선택적 Knative Service를 지원합니다.
FutureMLS-Lab/OSCAR
OSCAR는 오프라인 스펙트럼 공분산 인식 회전을 사용하는 2비트 KV 캐시 양자화 방법으로, 메모리 사용량을 8배 줄이면서 거의 BF16 정밀도를 유지한다.
actions/ai-inference
GitHub Copilot CLI를 사용하여 자동화된 워크플로우 내에서 AI 추론을 실행할 수 있는 GitHub Action입니다.
WenjieDu/SAITS
RNN 기반 모델의 속도와 메모리 문제를 해결하는 자기주의 기반의 다변량 시계열 보간 프레임워크
nschaetti/EchoTorch
연구 목적을 위해 설계된 PyTorch 기반의 에코 스테이트 네트워크와 리저보어 컴퓨팅 구현 및 테스트 모듈로, 딥 아키텍처에 통합 가능합니다.
uncomplicate/deep-diamond
CPU 및 GPU 가속을 위한 최적화된 네이티브 라이브러리를 활용하는, 고성능 텐서 및 신경망 계산을 위한 Clojure 라이브러리입니다.
h2oai/h2o4gpu
scikit-learn의 드롭인 대체품으로 작동하는 GPU 가속 기계학습 솔버 모음. Python 및 R API를 제공하여 모델 학습을 더 빠르게 합니다.
microsoft/onnxruntime-extensions
ONNX Runtime에 커스텀 연산자를 확장하여 비전, 텍스트 및 NLP 모델의 전처리와 후처리를 ONNX 그래프 내에서 처리할 수 있도록 하는 C/C++ 라이브러리입니다.
Seeed-Studio/ModelAssistant
저가형 임베디드 장치와 마이크로컨트롤러에 최적화된 AI 알고리즘을 배포하기 위한 툴체인으로, 컴퓨터 비전, 이상 탐지, 시나리오별 작업을 지원합니다.
milvus-io/milvus-lite
개발, 테스트 및 소규모 AI 애플리케이션을 위한 경량이며 순수 Python 기반의 로컬 버전 Milvus 벡터 데이터베이스.
runekaagaard/mcp-alchemy
Claude Desktop 과 SQL 데이터베이스를 연결하는 MCP 서버로, 자연어를 통한 탐색, 스키마 분석 및 쿼리 실행을 가능하게 합니다.
atomicstrata/atomicmemory
AtomicMemory는 LLM 에이전트를 위한 오픈소스, 검사 가능한 메모리 서비스입니다. 수정 인식 업데이트, 모델에 구애받지 않는 임베딩, 관리형 클라우드 및 자체 호스팅 Docker 배포를 제공합니다. 이 프로젝트에는 Rust Core 서버, TypeScript SDK, CLI(`am`), LangChain, LangGraph, Vercel AI 등의 어댑터, 다양한 에이전트 호스트용 플러그인이 포함됩니다. 빠른 시작은 원라인 설치 프로그램으로 클라우드 프로필을 생성합니다. `--local` 플래그는 Core 컨테이너를 사용자 머신에서 실행합니다. 메모리는 CLI 또는 SDK를 통해 프로그래밍 방식으로 수집 및 쿼리할 수 있으며, 에이전트는 MCP 서버를 통해 연결할 수 있습니다. Apache 2.0 라이선스입니다.
blueqat/blueqatSDK
PyTorch 기반의 양자 컴퓨팅 SDK로, 시뮬레이터 또는 실제 하드웨어에서 양자 회로의 시뮬레이션, 최적화, 실행이 가능하며, 미분 실행과 전용 스핀 큐비트 지원을 특징으로 합니다.
DragonKingpin/Hydra
개인이 PB 수준의 데이터 웨어하우스, 대규모 스크래핑, 작업 오케스트레이션을 대규모 조직과 동등한 능력으로 관리할 수 있도록 해주는 분산 인프라 프레임워크입니다.
ROCm/k8s-device-plugin
Kubernetes 디바이스 플러그인으로, AMD GPU를 컨테이너 클러스터 내의 계산 리소스로 등록하고 스케줄링할 수 있도록 합니다.
JamesShi96/project-butler
프로젝트 컨텍스트, 규칙, 진행 상황을 세션 간에 유지하기 위해 구조화된 Markdown 기반 메모리 스택을 사용하는 AI 코딩 어시스턴트용 지속적 메모리 시스템.
SciML/DiffEqGPU.jl
여러 매개변수와 초기 조건에 걸쳐 병렬 해결을 가능하게 하는 미분 방정식 솔버용 GPU 가속 라이브러리입니다.
OpenTabular/DeepTab
테이블 데이터를 위한 딥러닝용 파이썬 라이브러리로, scikit-learn 호환 API와 15개 이상의 신경망 아키텍처를 갖춘 동물원을 제공합니다.
scottvr/wtffmpeg
자연어로 비디오 및 오디오 작업을 설명하면 LLM을 사용해 실행 가능한 ffmpeg 명령어로 변환하는 명령줄 도구입니다.
runpod/runpod-python
RunPod 공식 Python 라이브러리입니다. 서버리스 AI 워커를 생성하기 위한 SDK와 GPU 클라우드 팟 및 엔드포인트를 관리하기 위한 REST API 래퍼를 제공합니다.
HeyWillow/willow
Willow는 음성-텍스트 변환(STT), 텍스트-음성 변환(TTS) 및 LLM 처리를 포함한 빠른 언어 작업을 위한 셀프 호스팅 가능 추론 서버입니다.
EvolvingAgentsLabs/evolving-agents
코드, 목표, 트레이스를 버전 관리하여 성능 저하를 방지할 수 있는 Claude Agent SDK 플러그인으로 제공되는 버전 관리 시스템 및 AI 에이전트 SDK
mratsim/Arraymancer
Nim용 고성능 n차원 텐서 라이브러리로, CPU, CUDA, OpenCL 백엔드에서 과학 계산, 머신러닝 및 딥러닝을 위한 도구를 제공합니다.
langchain-ai/mcpdoc
llms.txt 파일을 통해 AI 에이전트에게 투명하고 감사 가능한 방식으로 문서를 가져오는 MCP 서버입니다.
paperboytm/spool
Spool은 AI 코딩 에이전트 세션을 공유하고 재개할 수 있는 도구로, 세션을 다른 사용자가 읽고 로컬에서 작업을 계속할 수 있는 영구적인 웹 페이지로 변환합니다.
opea-project/GenAIExamples
다양한 하드웨어 플랫폼에서 GenAI 애플리케이션의 확장 및 테스트를 간소화하기 위해 설계된 마이크로서비스 기반의 생성형 AI 예제와 배포 가이드 모음입니다.
flytohub/flyto-core
AI 에이전트를 위한 파이썬 실행 엔진으로, 워크플로우의 모든 단계를 기록하여 실패한 단계에서 재실행 및 재개가 가능하게 하여 전체 프로세스를 다시 시작할 필요 없이 작업을 계속할 수 있도록 합니다.
PaddlePaddle/PaddleScience
딥러닝과 자동 미분을 활용하여 물리학, 화학, 기상학 문제를 해결하는 PaddlePaddle 기반의 과학 계산 스위트입니다.
spitfireuptown/datalinkx
Flink와 SeaTunnel을 사용하여 서로 다른 데이터 소스 간의 데이터 이동을을 관리하고 실행하는 이종 데이터 동기화 서비스입니다.
Picovoice/picollm
스마트폰에서 웹 브라우저에 이르기까지 다양한 장치에서 고정확도, 압축된 LLM을 로컬로 실행할 수 있는 크로스플랫폼 추론 엔진입니다.
quantumaikr/quant.cpp
KV cache 압축을 통해 소비자용 하드웨어에서 긴 문맥의 문서 이해를 가능하게 하여, 청크 기반 RAG의 필요성을 줄여주는 고성능 C 라이브러리입니다.
thomwebb/gac
코드 변경과 개발자 의도를 분석하여 상황에 맞는 잘 포맷된 Git 커밋 메시지를 생성하는 LLM 기반 CLI 도구입니다.
awslabs/generative-ai-cdk-constructs
AWS CDK의 오픈소스 확장으로, AWS에서 생성형 AI 솔루션을 빠르게 배포할 수 있도록 잘 설계된 인프라 패턴을 제공합니다.
IntelLabs/RAG-FiT
증강 데이터셋을 생성하고 PEFT를 사용해 모델을 파인튜닝함으로써 Retrieval Augmented Generation(RAG)에서 LLM 성능을 향상시키는 라이브러리.
invergent-ai/surogate
Surogate는 고성능 LLM 학습(전체 모델, LoRA/QLoRA, RL, MoE, 멀티모달) 및 OpenAI 호환 HTTP API를 통한 고처리량 서빙을 위한 네이티브 C++/CUDA 툴킷입니다. BF16, FP8, NVFP4, GGUF 양자화를 지원하며, 멀티 GPU/CPU 오프로드, 사전 디코딩, 런타임 LoRA 기능을 제공합니다. RTX 50 및 H100 하드웨어에서 vLLM/llama.cpp 대비 2~7배 높은 초당 토큰 수를 기록한 벤치마크 결과를 보였습니다.
SandAI-org/MagiCompiler
학습 및 다중 모달 추론을 위한 메모리와 계산 효율을 최적화하는 Transformer 유사 아키텍처를 위한 고급 컴파일러 및 런타임 확장 프레임워크입니다.
sepandhaghighi/pycm
분류 모델을 평가하기 위한 광범위한 통계 지표와 시각화 도구를 제공하는 Python용 다중 클래스 혼동 행렬 라이브러리입니다.
im4codes/imcodes
원격 기계 제어, 다양한 AI 제공자 간 공유 컨텍스트, 감독된 배달 파이프라인을 가능하게 하는 코딩 에이전트용 메시징 및 메모리 계층입니다.
oxylabs/ai-crawler-py
자연어 프롬프트를 사용해 관련 페이지를 발견하고 웹사이트에서 구조화된 JSON 또는 Markdown 데이터를 추출하는 AI 기반 웹 크롤러입니다.
microsoft/genaiops-promptflow-template
Prompt flow용 LLMOps 템플릿으로, 로컬 실험·평가부터 프로덕션 배포까지 LLM 애플리케이션의 엔드‑투‑엔드 라이프사이클을 효율화합니다.
traceloop/openllmetry-js
JavaScript/TypeScript LLM 애플리케이션용 오픈소스 관측 라이브러리로, OpenTelemetry를 사용해 LLM 제공자와 벡터 데이터베이스에 대한 호출을 추적합니다.
morphik-org/morphik-core
PDF 및 차트와 같이 시각적으로 풍부한 문서를 공간적 또는 시각적 컨텍스트를 잃지 않고 검색하고 이해할 수 있도록 하는 멀티모달 검색 엔진입니다.
aavetis/PRarena
GitHub에서 AI 코딩 에이전트의 풀 리퀘스트 머지율을 분석하여 성공률을 비교하는 추적 시스템 및 대시보드.
Dong90/oh-my-taiyiforge
AI 코딩을 구조화된 9단계 엔지니어링 파이프라인으로 전환하고, 여러 AI 도구 간에 통합 명령을 제공하는 상태 머신 엔진.