UfoMiao/zcf
ZCF는 Claude Code 및 Codex를 위한 원클릭 초기화 기능을 제공하여 워크플로우, API 및 에이전트 시스템의 구성을 자동화하는 제로 컨피그 설정 도구입니다.
EvolvingAgentsLabs/evolving-agents
코드, 목표, 트레이스를 버전 관리하여 성능 저하를 방지할 수 있는 Claude Agent SDK 플러그인으로 제공되는 버전 관리 시스템 및 AI 에이전트 SDK
mratsim/Arraymancer
Nim용 고성능 n차원 텐서 라이브러리로, CPU, CUDA, OpenCL 백엔드에서 과학 계산, 머신러닝 및 딥러닝을 위한 도구를 제공합니다.
SerialLain3170/AwesomeAnimeResearch
이미지 합성부터 애니메이션 제작까지, 애니메이션 및 카툰 생성에 초점을 맞춘 연구 논문 및 데이터셋 큐레이션 컬렉션.
asyml/texar
Texar는 NLP 및 텍스트 생성을 위한 모듈식 툴킷으로, 사용하기 쉬운 ML 모듈과 사전 학습 모델을 제공하여 빠른 프로토타이핑과 실험을 가능하게 합니다.
Orkas-AI/Orkas-VideoStudio
읽기 쉬운 계획 파일을 통해 AI 코딩 에이전트가 동영상을 구성, 편집, 생성할 수 있도록 하는 툴킷으로, 자동화된 동영상 제작을 위한 결정론적 파이프라인을 제공합니다.
FullAgent/fulling
Fulling은 런타임, 메모리, 스킬을 안전한 Kubernetes 기반 인증 경계 안에 결합한 전용 AI 작업공간을 구축하기 위한 기반입니다.
crabtalk/crabtalk
제한된 하네스를 사용하여 보안적으로 도구를 실행하고, AI 에이전트를 실행하며, 도구를 배분하고 MCP 서버에 연결하는 에이전트 데몬입니다.
opea-project/GenAIExamples
다양한 하드웨어 플랫폼에서 GenAI 애플리케이션의 확장 및 테스트를 간소화하기 위해 설계된 마이크로서비스 기반의 생성형 AI 예제와 배포 가이드 모음입니다.
google-deepmind/dm_pix
PIX는 JAX 기반의 이미지 처리 라이브러리로, GPU/TPU 가속 함수(예: flip, resize)를 제공하며, `jax.jit`으로 컴파일하거나 `jax.vmap`으로 벡터화하거나 `jax.pmap`으로 여러 장치에서 실행할 수 있습니다. 먼저 JAX를 설치한 후 `pip install dm-pix`를 실행하세요. NumPy 이미지 코드와 동일하게 사용할 수 있지만, JAX의 전체 성능과 자동 미분 기능을 제공합니다.
flytohub/flyto-core
AI 에이전트를 위한 파이썬 실행 엔진으로, 워크플로우의 모든 단계를 기록하여 실패한 단계에서 재실행 및 재개가 가능하게 하여 전체 프로세스를 다시 시작할 필요 없이 작업을 계속할 수 있도록 합니다.
hysts/anime-face-detector
PyTorch 기반 도구로, 사전 학습된 Faster R-CNN, YOLOv3 및 HRNetV2 모델을 사용하여 애니메이션 얼굴을 감지하고 28개의 얼굴 랜드마크 포인트를 추정합니다.
RaoFoundation/bittensor
머신 인텔리전스 및 기타 디지털 상품을 위한 경쟁적인 시장을 조성하고, 블록체인 기반 인센티브 시스템을 통해 보상을 받는 탈중앙화 플랫폼 및 SDK입니다.
callstackincubator/cali
React Native 및 Expo 팀을 위한 역할 기반 CLI로, AI 에이전트를 활용해 모바일 QA, 성능 리뷰 및 구현을 자동화합니다.
openonion/connectonion
프로덕션 준비된 AI 에이전트를 빌드하고 배포하기 위한 템플릿 우선 프레임워크로, 내장 도구, 채팅 인터페이스, 고급 디버깅 기능을 제공합니다.
agentic-in/inferoa
루프 엔지니어링을 위해 설계된 추론 네이티브 에이전트로, 토큰 사용과 캐시 재사용을 최적화하여 효율적이고 장기적인 재귀 AI 워크플로를 유지합니다.
Ahmet-Dedeler/ai-llm-comparison
여러 LLM 제공업체의 실시간 가격 및 기능 비교를 제공하는 오픈소스 AI 모델 비교 도구입니다.
z-lab/paroquant
ParoQuant는 학습된 쌍별 회전을 사용하여 가중치 이상치를 줄이고, 효율적인 추론 중에도 높은 정확도를 유지하는 LLM용 INT4 양자화 프레임워크입니다.
Picovoice/picollm
스마트폰에서 웹 브라우저에 이르기까지 다양한 장치에서 고정확도, 압축된 LLM을 로컬로 실행할 수 있는 크로스플랫폼 추론 엔진입니다.
quantumaikr/quant.cpp
KV cache 압축을 통해 소비자용 하드웨어에서 긴 문맥의 문서 이해를 가능하게 하여, 청크 기반 RAG의 필요성을 줄여주는 고성능 C 라이브러리입니다.
dangeng/visual_anagrams
픽셀 기반 확산 모델을 사용하여 회전, 뒤집기 또는 재배열 시 정체성이 변하는 다중 뷰 착시 이미지를 생성하는 도구입니다.
automataIA/graphrag-rs
서버, WASM 및 하이브리드 배포 환경에서 문서로부터 지식 그래프를 구축하고 자연어 질의를 가능하게 하는 고성능 Rust 구현 GraphRAG입니다.
umbertogriffo/rag-chatbot
llama.cpp와 Chroma를 이용한 로컬 RAG 챗봇으로, Markdown 기반 지식 베이스를 증분 인덱싱하여 질문에 답합니다.
hhy-huang/HiRAG
HiRAG는 Retrieval‑Augmented Generation 프레임워크로, 계층적 지식을 활용해 표준 RAG에 비해 LLM 응답의 품질과 포괄성을 향상시킵니다.
Bessouat40/RAGLight
Retrieval-Augmented Generation (RAG)을 구현하기 위한 가볍고 모듈화된 Python 라이브러리입니다. 사용자가 다양한 LLM과 벡터 스토어를 쉽게 통합하여 자신의 문서와 채팅할 수 있도록 합니다.
mkalten/reacTIVision
피델리티 마커와 멀티터치 손가락을 추적하여 물리적 사용자 인터페이스를 만들 수 있게 해 주는 크로스 플랫폼 컴퓨터 비전 프레임워크입니다.
roboflow/roboflow-python
개발자가 모델, 데이터셋, 프로젝트와 프로그래밍 방식으로 상호작용하여 컴퓨터 비전 모델을 자동으로 구축하고 배포할 수 있도록 해주는 Roboflow 공식 Python 패키지입니다.
lessthanoptimal/BoofCV
자바로 작성된 실시간 컴퓨터 비전 라이브러리로, 저수준 이미지 처리, 카메라 캘리브레이션 및 특징 추적을 위한 도구를 제공합니다.
LLPhant/LLPhant
Generative AI와 벡터 데이터베이스를 위한 PHP 라이브러리로, LLM과 벡터 스토어를 PHP 애플리케이션에 통합할 수 있는 통합 인터페이스를 제공합니다.
fudan-generative-vision/Hallo-Live
Hallo-Live는 인과적 듀얼 스트림 Diffusion Transformer를 사용하여 디지털 아바타를 위한 동기화된 오디오와 비디오를 실시간으로 생성하는 텍스트 기반 프레임워크입니다.
open-mmlab/FoleyCrafter
FoleyCrafter는 무음 비디오의 시각적 내용에 기반해 현실감 있고 동기화된 사운드 효과를 생성하는 비디오‑투‑오디오 프레임워크입니다.
thu-ml/DiT-Extrapolation
위치 임베딩 외삽(extrapolation)을 통해 더 긴 비디오와 더 높은 해상도의 이미지를 생성할 수 있게 하는 Diffusion Transformers용 플러그 앤 플레이 프레임워크입니다.
UCSC-VLAA/story-iter
학습이 필요 없는 반복 프레임워크로, 전역 레퍼런스 교차 주의 모듈을 사용해 최대 100 프레임에 걸친 긴 스토리 시각화에서 의미 일관성을 유지합니다.
Shilin-LU/MACE
MACE는 확산 모델을 위한 파인튜닝 프레임워크로, 유명인이나 노골적인 콘텐츠와 같은 최대 100개의 원치 않는 개념을 대량으로 삭제하면서 무관한 모델 지식은 보존합니다.
IntelLabs/RAG-FiT
증강 데이터셋을 생성하고 PEFT를 사용해 모델을 파인튜닝함으로써 Retrieval Augmented Generation(RAG)에서 LLM 성능을 향상시키는 라이브러리.
diffgram/diffgram
스키마, BLOB, 예측 결과를 위한 AI 데이터 스토어이며, 인간의 감독과 멀티모달 데이터 레이블링 도구를 제공합니다.
githubharald/SimpleHTR
TensorFlow 기반 손글씨 텍스트 인식 시스템으로, CNN 및 LSTM 레이어를 사용해 단어 또는 텍스트 라인 이미지를 디지털 텍스트로 변환합니다.
oxylabs/ai-crawler-py
자연어 프롬프트를 사용해 관련 페이지를 발견하고 웹사이트에서 구조화된 JSON 또는 Markdown 데이터를 추출하는 AI 기반 웹 크롤러입니다.
microsoft/genaiops-promptflow-template
Prompt flow용 LLMOps 템플릿으로, 로컬 실험·평가부터 프로덕션 배포까지 LLM 애플리케이션의 엔드‑투‑엔드 라이프사이클을 효율화합니다.
zmedelis/bosquet
프롬프트 템플릿, 체이닝 및 에이전트 도구 통합을 위한 도구를 제공하는 AI 애플리케이션 구축용 LLMOps 프레임워크입니다.
traceloop/openllmetry-js
JavaScript/TypeScript LLM 애플리케이션용 오픈소스 관측 라이브러리로, OpenTelemetry를 사용해 LLM 제공자와 벡터 데이터베이스에 대한 호출을 추적합니다.
aavetis/PRarena
GitHub에서 AI 코딩 에이전트의 풀 리퀘스트 머지율을 분석하여 성공률을 비교하는 추적 시스템 및 대시보드.
ray-project/raydp
RayDP는 Apache Spark를 Ray 위에서 실행할 수 있게 해주며, 단일 Python 프로그램 내에서 통합된 분산 데이터 및 AI 파이프라인을 생성할 수 있도록 합니다.
thiswillbeyourgithub/AnkiAIUtils
AI가 자동으로 Anki 플래시카드에 이미지, 기억법, 설명을 생성하여 학습 효율을 향상시키는 AI 도구 세트입니다.
DigitalSlideArchive/HistomicsTK
HistomicsTK는 전체 슬라이드 병리 이미지를 분석하는 오픈소스 Python 툴킷입니다. 염색 정규화, 핵 세그멘테이션, 특징 추출 기능을 제공하며, 독립형 라이브러리 또는 Digital Slide Archive 웹 플랫폼의 플러그인으로 사용할 수 있습니다.
RTGS2017/NagaAgent
NagaAgent는 Windows/macOS/Linux를 지원하는 크로스플랫폼 데스크톱 AI 어시스턴트로, OpenAI 호환 LLM과의 채팅, JSON 블록을 통한 사용자 정의 도구 호출, Neo4j에 저장된 그래프-RAG 메모리, Live2D 애니메이션 아바타, 리프싱크 기능이 있는 음성 합성/인식, 날씨, 웹 검색, 게임 가이드 등 다양한 플러그인을 지원하는 MCP 프레임워크, 포럼과 스킬 마켓을 포함한 커뮤니티 기능을 제공합니다. Electron/Vue 프론트엔드와 Python FastAPI 백엔드로 구성되며, `uv sync` (또는 pip)로 설치 가능하며, AGPL-3.0 + 독점적 상용 라이선스의 이중 라이선스입니다.
zsyOAOA/ResShift
ResShift는 이미지 초해상도 및 복원을 위한 효율적인 확산 모델로, 샘플링 단계를 줄여 이미지 품질을 손상시키지 않으면서 추론 속도를 향상시킵니다.
Snowflake-Labs/cocoplus
Snowflake Coco를 위한 에이전트 운영 체제로, 데이터 엔지니어링 프로젝트에 구조화된 멀티 에이전트 워크플로우와 거버넌스 기반 실행을 제공합니다.