devchilll/scope

안전성 가드레일, 컴플라이언스 애스 코드, IAM, 인간 개입 에스컬레이션을 구현한 기업용 AI 에이전트를 위한 프로덕션 준비 완료 거버넌스 프레임워크

ViciousSquid/Dosidicus

사용자가 실시간으로 보고 추적할 수 있는 신경망을 키우며 신경과학을 배울 수 있는 투명한 인지 샌드박스 및 디지털 펫 시뮬레이션.

unifyai/ivy

Ivy는 PyTorch, TensorFlow, JAX, NumPy와 같은 프레임워크 간에 기계 학습 코드, 모델 및 라이브러리를 변환할 수 있도록 하는 트랜스파일러입니다.

OptimalScale/LMFlow

LMFlow는 대규모 언어 모델의 피니튜닝을 위한 확장 가능한 파이썬 도구 상자입니다. 전체 파라미터 학습, LoRA, 메모리 효율적인 LISA 알고리즘, QLoRA 양자화, 그리고 FlashAttention‑2, DeepSpeed, vLLM, SGLang 등의 성능 향상 기술을 지원합니다. 학습 후에는 간단한 챗스타일 추론 스크립트와 선택적 Gradio/Flask 배포 기능을 제공합니다. 이 라이브러리는 Linux/Colab 환경을 대상으로 하며, 멀티모달 모델, 분산 보상 모델 추론 등 추가 기능도 제공합니다.

NVIDIA/apex

NVIDIA가 유지 관리하는 PyTorch용 유틸리티 모음으로, 최적화된 CUDA 확장을 통해 혼합 정밀도 및 분산 학습을 간편하게 만듭니다.

skorch-dev/skorch

PyTorch를 래핑하는 scikit-learn 호환 신경망 라이브러리로, scikit-learn의 파이프라인과 그리드 서치를 PyTorch 모델에서 사용할 수 있게 합니다.

facebookresearch/AugLy

음성, 이미지, 텍스트, 동영상에 대한 100개 이상의 변환을 제공하는 다중 모달 데이터 증강 라이브러리로, 실제 인터넷 데이터에 대한 AI 모델의 강건성을 향상시킵니다.

facebookincubator/AITemplate

NVIDIA 및 AMD GPU에서 고성능 추론 서빙을 위해 깊은 신경망을 최적화된 CUDA/HIP C++ 코드로 변환하는 Python 프레임워크입니다.

facebookresearch/nevergrad

기울기를 필요로 하지 않는 최적화 플랫폼으로, 특히 기계학습에서 하이퍼파라미터 튜닝에 유용합니다.

phodal/auto-dev

Kotlin Multiplatform 기반으로 구축되어 IDE 및 다양한 기기에서 코딩, 리뷰, 리서치 에이전트를 통합하는 AI 네이티브 멀티 에이전트 개발 플랫폼입니다.

PAIR-code/lit

텍스트, 이미지, 표 형식 데이터를 지원하는 시각적이고 인터랙티브한 ML 모델 이해 도구로, 개발자가 모델 예측을 디버깅하고 해석하는 데 도움을 줍니다.

facebookresearch/Pearl

Meta에서 제공하는 프로덕션 준비 완료 강화 학습 라이브러리로, 피드백이 희소하고 액션 공간이 동적인 복잡한 현실 세계 환경에서 작동할 수 있는 모듈식 AI 에이전트를 구축할 수 있도록 지원합니다.

onnx/tensorflow-onnx

TensorFlow, Keras, TensorFlow.js, TFLite 모델을 크로스플랫폼 호환성과 배포에 적합한 ONNX 형식으로 변환하는 도구.

AIStream-Peelout/flow-forecast

다양한 최신 모델을 갖춘 오픈소스 딥러닝 프레임워크로, 시계열 예측, 분류 및 이상 탐지에 특화되어 있습니다.

apache/mahout

Apache Mahout는 양자 회로를 위한 통합 API와 양자 머신러닝을 위한 GPU 가속 데이터 인코딩을 제공하는 Python 라이브러리인 Qumat을 포함하는 머신러닝 환경입니다.

google-parfait/tensorflow-federated

분산된 데이터에서 기계학습과 계산을 위한 오픈소스 프레임워크로, 훈련 데이터를 클라이언트에 로컬로 유지하면서도 글로벌 모델 훈련을 가능하게 합니다.

tensorflow/tfx

TensorFlow Extended (TFX)는 자동화된 기계학습 파이프라인을 구축하고 오케스트레이션할 수 있는 생산 규모의 ML 플랫폼입니다.

mil-tokyo/webdnn

WebGPU, WebGL, WebAssembly를 사용하여 웹 브라우저 내에서 ONNX 모델을 직접 실행하는 브라우저 기반 신경망 추론 엔진입니다.

Cloud-CV/EvalAI

표준화된 리더보드와 제출 인터페이스를 통해 대규모로 기계학습 및 AI 알고리즘을 평가하고 비교할 수 있는 오픈소스 플랫폼입니다.

inducer/pycuda

PyCUDA는 Nvidia의 CUDA API를 위한 Python 래퍼로, 자동 메모리 관리와 C++ 속도를 갖춘 GPU에서 고성능 병렬 계산을 가능하게 합니다.

CannyLab/tsne-cuda

CPU 기반 방법과 비교해 고차원 데이터 시각화에서 막대한 속도 향상을 제공하는 GPU 가속 FIt-SNE 알고리즘 구현입니다.

rentruewang/aioway

기계학습 모델을 명령어로 간주하여 설명 가능하고 자원을 고려한 파이프라인을 자동으로 구축하는 최적화 컴파일러입니다.

csinva/imodels

블랙박스 모델을 대체하기 위해 규칙 집합 및 희소 선형 모델과 같은 scikit-learn 호환 해석 가능한 머신러닝 모델 제품군을 제공하는 Python 패키지입니다.

opendilab/LightZero

몬테카를로 트리 탐색(MCTS)과 심층 강화 학습을 결합하여 MCTS 기반 의사 결정 알고리즘 연구를 표준화하고 가속화하는 경량 PyTorch 툴킷입니다.

intelligent-machine-learning/dlrover

K8s와 Ray에서 자동 장애 복구, 자동 확장, 빠른 체크포인트 복구를 제공하여 대규모 AI 모델 훈련을 단순화하는 자동 분산 딥러닝 시스템입니다.

elixir-nx/axon

Nx를 기반으로 한 수치 가속 기능을 제공하는 Elixir용 신경망 프레임워크로, 모델 생성과 훈련을 위한 고수준 API를 제공합니다.

zama-ai/concrete-ml

완전한 동형 암호화(FHE)를 사용하여 scikit-learn 유사 API로 암호화된 데이터 위에서 추론과 학습을 가능하게 하는 프라이버시 보호 기계학습 라이브러리입니다.

Lightning-AI/lightning-thunder

파이썬스러운 중간 표현과 확장 가능한 변환 플러그인을 통해 훈련 및 추론을 최적화하는 파이토치용 소스 투 소스 컴파일러입니다.

awaescher/OllamaSharp

C# 개발자가 애플리케이션에 로컬 및 원격 AI 모델을 쉽게 통합할 수 있도록 Ollama API에 대한 포괄적인 바인딩을 제공하는 .NET 라이브러리입니다.

tensorflow/text

TensorFlow 그래프 내에서 트레이닝과 추론 모두에서 일관된 전처리를 가능하게 하는 텍스트 처리 클래스와 연산의 모음입니다.

sebp/scikit-survival

scikit-learn 기반의 Python 모듈로, 연구자가 공변량과 사건 발생 시간을 연결하면서도 절단 데이터를 처리할 수 있도록 지원합니다.

mapillary/inplace_abn

PyTorch를 위한 메모리 최적화 Batch Normalization 레이어입니다. BN과 활성화 함수를 인플레이스(in-place) 연산으로 결합하여 학습 중 GPU 메모리 사용량을 최대 50%까지 줄여줍니다.

obot-platform/nanobot

LLM과 MCP 서버를 연결하여 개발자가 AI 에이전트를 구축하고 배포할 수 있는 오픈소스 스탠드얼론 MCP 호스트입니다.

mjpost/sacrebleu

공유 가능하고 비교 가능하며 재현 가능한 BLEU 및 기타 번역 지표를 계산하기 위한 도구로, 테스트 세트 관리와 토큰화를 자동화합니다.

meta-pytorch/data

에포크 중간 체크포인트를 위한 상태 기반 로딩과 데이터 전처리를 위한 조합 가능한 반복자를 제공하는 확장 가능한 PyTorch 데이터 로딩 라이브러리입니다.

fatwang2/search2ai

AI 에이전트를 위한 자체 호스팅 검색 게이트웨이로, 여러 검색 제공자를 하나의 Perplexity 호환 API로 통합하고 자동 폴백을 통해 높은 신뢰성을 제공합니다.

NVIDIA-Merlin/Transformers4Rec

PyTorch 기반 라이브러리로, Hugging Face Transformer 아키텍처를 순차적 및 세션 기반 추천 시스템에 도입하며, 풍부한 탭러 입력 특징과 GPU 가속을 지원합니다.

a-r-j/graphein

생체 분자 구조와 상호작용 네트워크를 기하학적 그래프 표현으로 변환하여 딥러닝에 사용할 수 있는 Python 라이브러리입니다.

Artelnics/opennn

비즈니스, 헬스케어, 공학 분야의 고도 분석에 사용되는 신경망 구현을 위한 고성능 C++ 라이브러리입니다.

hasktorch/hasktorch

PyTorch가 공유하는 핵심 C++ 라이브러리를 활용하는 Haskell용 텐서 및 신경망 라이브러리

wandb/weave

LLM 개발 프로세스에 엄격함을 가져다주는 트레이싱, 로깅, 평가 도구를 제공하는 생성형 AI 애플리케이션 개발을 위한 툴킷입니다.

huggingface/optimum-quanto

가중치와 활성화를 int4 또는 float8과 같은 저정밀도로 변환하여 모델 크기와 메모리 사용량을 줄여주는 Optimum용 PyTorch 양자화 백엔드입니다.

pepperoni21/ollama-rs

Ollama 로컬 모델 HTTP API를 래핑하는 Rust crate로, 텍스트 생성, 채팅(이력 포함), 스트리밍 응답, 모델 관리, 임베딩, 매크로 기반 LLM 도구/함수 호출을 위한 간편한 함수를 제공합니다.

NVIDIA-Merlin/HugeCTR

거대한 임베딩 테이블을 가진 대규모 딥러닝 모델의 효율적인 학습 및 추론을 위한 GPU 가속 추천 프레임워크입니다.

agi-brain/xuance

PyTorch, TensorFlow, MindSpore와 호환되는 모듈화된 DRL 및 MARL 알고리즘의 포괄적이고 통합된 딥 강화 학습 라이브러리.

yongliang-wu/DFT

예측 확률을 기반으로 토큰 손실을 동적으로 재스케일링하여 SFT 중 LLM의 일반화 성능을 향상시키는 방법으로, 특히 추론 작업에 효과적입니다.

libxsmm/libxsmm

다양한 CPU 아키텍처를 통해 딥러닝 및 HPC 워크로드의 최적화를 위해 JIT 코드 생성을 사용하는 고성능 라이브러리입니다.

yandex/YaFSDP

Yandex가 개발한 Sharded Data Parallelism 프레임워크로, 통신 및 메모리 오버헤드를 줄여 LLM 사전 학습을 최적화하며 PyTorch FSDP 대비 최대 20%의 속도 향상을 제공합니다.