ChuckHend/pg_vectorize

텍스트를 임베딩으로 자동 변환하고 벡터, 전체 텍스트, 하이브리드 검색을 오케스트레이션하는 Postgres 서버 및 확장 기능으로 RAG를 가능하게 합니다.

SonySemiconductorSolutions/mct-model-optimization

A model compression toolkit for PyTorch and Keras that optimizes AI models for edge deployment using quantization, pruning, and hardware-aware optimization.

flytohub/flyto-core

AI 에이전트를 위한 Python 실행 엔진으로, 워크플로우의 모든 단계를 기록하여 전체 작업을 다시 실행할 필요 없이 실패 지점부터 결정론적 재실행(replay)을 가능하게 합니다.

GizClaw/flowcraft

플러그인 가능한 메모리, 다중 제공자 추론 백엔드, 지속 가능한 에이전트 실행을 갖춘 확장 가능한 AI 애플리케이션을 구축하기 위한 모듈식 Go 툴킷입니다.

mattt/emcee

OpenAPI 사양을 가진 모든 웹 애플리케이션을 Model Context Protocol (MCP) 서버로 변환하여, AI 모델이 API를 도구로 사용할 수 있게 해주는 도구입니다.

google-research/morph-net

학습 중에 딥 네트워크 구조를 학습하여 리소스 제약 정규화를 통해 FLOPs, 모델 크기 및 레이턴시를 감소시키는 프레임워크.

Pipelex/pipelex

선언적 .mthds 파일 형식을 사용하여 복잡한 AI 워크플로를 오케스트레이션하는 재사용 가능하고 유형화된 AI 프로시저(

JuliaGraphs/GraphNeuralNetworks.jl

그래프 딥러닝을 위한 Julia 라이브러리 모음으로, Flux 및 Lux 프레임워크를 위한 그래프 컨볼루션 레이어와 데이터 구조를 제공합니다.

mosecorg/mosec

Rust 코어와 Python 인터페이스를 사용해 ML 모델을 효율적이고 클라우드에 적합한 마이크로서비스로 전환하는 고성능 모델 서빙 프레임워크입니다.

FluxML/model-zoo

Flux 머신러닝 라이브러리의 레퍼런스 구현 및 데모 모음으로, 비전, 텍스트, 강화학습 모델의 시작점을 제공합니다.

SethGammon/Citadel

Claude Code와 OpenAI Codex와 같은 AI 코딩 에이전트를 위한 운영 계층으로, 리포지토리 상태를 유지하고 다단계 워크플로우를 조율합니다.

feyninc/chonkiejs

RAG 애플리케이션을 위해 설계된 가볍고 효율적인 TypeScript 텍스트 청킹 라이브러리로, 시맨틱, 재귀적, 코드 인식형 분할 등 다양한 전략을 제공합니다.

ModelEngine-Group/DataMate

엔터프라이즈 수준의 데이터 처리 플랫폼으로, 모델 파인튜닝 및 RAG 검색을 위한 데이터 수집, 정제, 주석 작업을 효율화합니다.

callstackincubator/cali

React Native 및 Expo 팀을 위한 역할 기반 CLI로, AI 에이전트를 활용해 모바일 QA, 성능 리뷰 및 구현을 자동화합니다.

LvcidPsyche/auto-browser

AI 에이전트에게 인간의 개입(human-in-the-loop)이 가능한 실제 브라우저, 재사용 가능한 인증 프로필 및 내장된 안전 장치를 제공하는 MCP 네이티브 브라우저 컨트롤 플레인입니다.

Neargye/hello_tf_c_api

TensorFlow C API를 사용하여 네이티브 애플리케이션에서 머신러닝 모델을 실행하기 위한 C++ 예제와 헬퍼 라이브러리 모음.

growthxai/output

프롬프트 관리, 추적 및 평가를 단일 코드베이스에 통합하여 SaaS 파편화를 방지하는 TypeScript 프레임워크입니다.

iflytek/astron-rpa

AI 에이전트와 네이티브로 통합된 엔터프라이즈급 오픈소스 RPA 데스크톱 애플리케이션. 저코드로 데스크톱 소프트웨어 및 웹 페이지 자동화를 가능하게 하며, AI 에이전트와의 깊은 통합을 제공합니다.

HewlettPackard/swarm-learning

블록체인을 활용한 협업으로 원시 데이터를 공유하지 않고 분산된 데이터 소스 간에 협업 모델 학습을 가능하게 하는 탈중앙화·프라이버시 보호 머신러닝 프레임워크.

OtterMind/Nubase

AI 네이티브 백엔드 및 배포 레이어로 코드 에이전트가 데이터베이스, 에지 함수, 프론트엔드를 직접 배포하여 AI 생성 코드를 라이브 앱으로 전환할 수 있습니다.

duncatzat/vigils

AI 에이전트를 위한 로컬 우선 보안 제어 플레인으로, 시크릿 유출을 방지하고 도구 호출을 방화벽으로 차단하며 위조 탐지 가능한 감사 로그를 유지합니다.

aristoteleo/PantheonOS

진화 가능한 멀티 에이전트 프레임워크로 데이터 과학을 자동화·확장하며, 엔드‑투‑엔드 단일 세포 생물학 분석에 특화되어 있습니다.

trvon/yams

콘텐츠 주소 기반 저장소와 하이브리드 검색을 사용하여 코드와 문서를 정리하고 검색하는 로컬 우선의 지속 가능한 메모리 시스템입니다.

Ahmet-Dedeler/ai-llm-comparison

여러 LLM 제공업체의 실시간 가격 및 기능 비교를 제공하는 오픈소스 AI 모델 비교 도구입니다.

Picovoice/picollm

스마트폰에서 웹 브라우저에 이르기까지 다양한 장치에서 고정확도, 압축된 LLM을 로컬로 실행할 수 있는 크로스플랫폼 추론 엔진입니다.

zolotukhin/zinc

Zig로 작성된 빠르고 로컬 GGUF 추론 엔진으로, 소비자 GPU용 명령줄 인터페이스, 브라우저 채팅, OpenAI 호환 API를 제공합니다.

THU-BPM/MarkDiffusion

잠재 확산 모델(LDM)의 생성 미디어에 대한 오픈소스 Python 툴킷으로, AI 생성 이미지 및 동영상에 수식을 삽입, 탐지, 평가할 수 있는 도구를 제공합니다.

graniet/llm

다중 LLM 백엔드와 상호 작용하기 위한 통합 API를 제공하는 Rust 라이브러리로, 다단계 체인, 에이전트 워크플로우 및 표준화된 REST API를 지원합니다.

maze-agent/Maze

이종 리소스 스케줄링과 자동 모델 서빙을 지원하는 LLM 에이전트용 분산 프레임워크로, 에이전트 프로그램을 관측 가능한 워크플로우로 변환합니다.

suyoumo/ClawProBench

OpenClaw 런타임 내에서 AI 에이전트의 능력과 성능을 평가하기 위한 투명한 라이브 실행 벤치마크 허브로, 결정론적 채점을 제공합니다.

whitphx/streamlit-webrtc

실시간 비디오 및 오디오 스트림의 처리와 전송을 가능하게 하는 Streamlit 컴포넌트로, 웹 앱에서 라이브 미디어 처리 및 AI 통합을 구현할 수 있습니다.

ARM-software/ComputeLibrary

Arm Cortex-A, Neoverse 및 Mali GPU 아키텍처에 최적화된 저수준 머신러닝 함수 모음으로 고성능 ML 추론을 제공합니다.

sdv-dev/SDGym

합성 데이터를 모델링하고 생성하는 벤치마크 프레임워크로, 사용자가 다양한 머신러닝 기법의 성능, 메모리 사용량 및 품질을 비교할 수 있습니다.

inseq-team/inseq

시퀀스 생성 모델의 사후 해석성을 위한 PyTorch 기반 툴킷으로, 모델 출력을 설명하는 다양한 특징 귀속 방법을 제공합니다.

aws-samples/well-architected-iac-analyzer

Infrastructure as Code(IaC)와 아키텍처 다이어그램을 AWS Well-Architected 모범 사례에 대해 분석하여 우선순위가 정해진 시정 제안을 제공하는 AI 기반 도구.

sdv-dev/Copulas

코퓰라 함수를 사용하여 다변량 분포를 모델링하고 합성 수치 데이터를 생성하는 파이썬 라이브러리.

SomeOddCodeGuy/WilmerAI

고급 의미적 프롬프트 라우팅과 다중 LLM 조율을 가능하게 하는 노드 기반 워크플로 엔진으로, 사용자가 복잡하고 문맥 인식 가능한 AI 에이전트를 만들 수 있도록 합니다.

quantgirluk/aleatory

다양한 1차원 및 2차원 확률 과정을 시뮬레이션하고 시각화하기 위한 파이썬 라이브러리입니다.

transformerlab/transformerlab-app

DaoyuanLi2816/can-i-finetune-this

소비자용 GPU에서 LoRA 및 QLoRA를 사용하여 LLM을 미세 조정할 때 VRAM 사용량을 추정하고, 성능을 벤치마킹하며, 학습 레시피를 생성하는 CLI 도구입니다.

IntelLabs/RAG-FiT

증강 데이터셋을 생성하고 PEFT를 사용해 모델을 파인튜닝함으로써 Retrieval Augmented Generation(RAG)에서 LLM 성능을 향상시키는 라이브러리.

invergent-ai/surogate

NVIDIA 하드웨어에 최적화되어 있으며 NVFP4와 같은 저정밀도 형식을 지원하는 고성능 LLM 학습 및 추론용 네이티브 C++/CUDA 툴킷입니다.

georgian-io/LLM-Finetuning-Toolkit

구성 파일 기반 CLI 도구로, LLM 파인튜닝 실험을 시작하고 관리하며, 다양한 모델, 프롬프트, 최적화 기법 간에 소거 연구(ablation study)를 수행할 수 있습니다.

nolabs-ai/deepfabric

실제 도구 실행 및 주제 그래프 매핑을 사용하여 에이전트형 LLM을 위한 고품질 학습 데이터셋을 생성하는 합성 데이터 생성 및 평가 프레임워크입니다.

kaito-project/aikit

OCI 규격 컨테이너 이미지와 OpenAI 호환 API를 사용하여 LLM을 호스팅, 배포, 미세 조정하기 위한 포괄적인 플랫폼입니다.

kossisoroyce/timber

클래식 머신러닝 모델과 로봇 URDF 설명을 마이크로초 수준 지연 추론이 가능한 최적화된 독립형 C99 바이너리로 변환하는 컴파일러.

run-house/kubetorch

Pythonic한 서버리스 인터페이스로, ML 개발자가 로컬 환경에서 직접 Kubernetes 클러스터에 워크로드를 실행하고 확장할 수 있으며 시작 시간이 거의 즉시입니다.

tensorflow/model-optimization

양자화 및 가지치기(pruning)와 같은 기술을 사용하여 머신러닝 모델의 배포 및 실행을 최적화하기 위한 도구 모음입니다.