erwinmsmith/SOMAS

시각-언어 모델과 강화 학습을 결합하여 인간-기계 공동 위기 대응의 안전성과 신뢰성을 보장하는 다중 에이전트 프레임워크입니다.

canwhite/AgentEval

AI 에이전트와 LLM 간의 트래픽을 캡처하여 자동 평가, 행동 진단, 소스코드 프로빙을 제공하는 투명한 HTTP 프록시입니다.

TellinaTool/nl2bash

TensorFlow 기반 번역 모델을 사용하여 자연어 설명을 Linux Bash 명령어로 변환하는 코퍼스와 의미 분석기.

oxylabs/oxylabs-ai-studio-openclaw

OpenClaw 플러그인으로 Oxylabs AI Studio를 통합하여 IP 차단을 회피하고 LLM 대응 데이터를 제공하는 AI 에이전트용 웹 검색 및 콘텐츠 추출 도구를 제공합니다.

giddyyupp/ganilla

실제 이미지를 예술적인 일러스트레이션으로 변환하도록 설계된 생성적 적대 신경망인 GANILLA의 PyTorch 구현체입니다.

dllm-reasoning/d1

d1은 마스크된 감독 미세조정과 새로운 강화학습 방법인 diffu-GRPO를 결합하여 확산형 대규모 언어 모델에서 추론 능력을 확장하는 프레임워크입니다.

pgvector/pgvector-node

Node.js, Deno, Bun 애플리케이션에서 pgvector PostgreSQL 확장 기능을 사용하여 벡터 임베딩을 저장하고 쿼리할 수 있도록 해주는 JavaScript/TypeScript 클라이언트 라이브러리입니다.

hanna-xu/U2Fusion

레이블이 지정된 훈련 데이터 없이 다중 모달, 다중 노출 및 다중 초점 이미지를 하나의 고품질 이미지로 융합하는 통합 비지도 이미지 융합 네트워크입니다.

facefusion/facefusion-pinokio

FaceFusion Pinokio는 Pinokio를 통해 간편한 설치 프로세스를 제공하는 얼굴 조작 플랫폼으로, 이미지 및 동영상 내 얼굴을 교체하고 수정할 수 있습니다.

tensorflow/cloud

개발자가 로컬 환경에서 TensorFlow 및 Keras 모델 학습을 Google Cloud Platform에서 분산 학습 및 튜닝으로 쉽게 이동할 수 있도록 도와주는 API 세트입니다.

GeorgesAlkhouri/nvim-aider

Aider AI 페어 프로그래머를 Neovim 플러그인으로 통합하여 사용자가 에디터에서 버퍼, 진단 정보, 파일을 직접 AI로 전송할 수 있도록 합니다.

liruiw/GenSim

GenSim은 다중 작업 로봇 정책의 훈련 데이터를 보완하기 위해 로봇 시뮬레이션 작업과 환경을 자동으로 생성하는 LLM 기반 파이프라인입니다.

facebookresearch/PhysicsLM4

LLM 및 선형 모델에 Canon 레이어를 구현하여 아키텍처 설계와 지식 저장을 개선하는 연구 리포지토리로, 합성 데이터 생성기와 사전 훈련 레시피를 포함합니다.

GFNOrg/torchgfn

다양한 환경, 손실 함수 및 샘플링 전략을 포함하여 알고리즘 프로토타이핑을 위한 분리된 프레임워크를 제공하는 GFlowNets용 Python 패키지.

usnistgov/dioptra

Dioptra는 NIST의 오픈소스 Docker 기반 플랫폼으로, AI 모델의 신뢰성 기준(공정성, 안전성, 설명 가능성 등)에 대한 테스트를 지원합니다. REST API, 웹 UI, Python 클라이언트를 제공하며, YAML로 실험을 정의하고 PyTorch/TensorFlow용 플러그인을 지원하며, 개발자, 감사자, 연구자, 레드팀을 위한 재현 가능하고 추적 가능한 실행 기록을 제공합니다.

Arch1eSUN/Arcgentic

Codex와 Claude Code를 위한 하네스 엔지니어링 계층으로, AI 코딩을 전문적인 역할(기획, 개발, 감사)을 가진 게이트가 있는 워크플로우로 전환합니다.

skilld-dev/skilld

다수의 AI 에이전트 간에 공유 가능한 인간이 작성한 스킬(표준화된 지침)의 큐레이션된 레지스트리와 CLI. 발견, 설치, 관리를 가능하게 합니다.

Zyphra/ZONOS2

ZONOS2는 Mixture-of-Experts 백본을 사용하는 고해상도 다국어 음성 합성 모델로, 자연스러운 음성 클로닝과 표현력 있는 감정 제어를 제공합니다.

Optimization-AI/LibAUC

불균형 데이터 및 순위 작업에서 AUROC, AUPRC, NDCG와 같은 복잡한 성능 지표를 직접 최적화할 수 있는 딥러닝 라이브러리입니다.

understandable-machine-intelligence-lab/Quantus

Quantus는 PyTorch/TensorFlow를 지원하는 오픈소스 파이썬 라이브러리로, 신뢰성, 강건성, 국소화, 복잡성, 무작위화, 공리적의 6개 범주에 걸쳐 35개 이상의 정량적 지표를 제공합니다. 이미지, 시계열, 표 형식 데이터에 대한 재현 가능하고 배치 효율적인 XAI 기법 평가를 가능하게 하며, 튜토리얼, 문서, 커뮤니티 지원을 제공합니다.

wladradchenko/wunjo.wladradchenko.ru

개인정보 보호를 위해 로컬에서 실행되는 페이스 스와핑, 음성 클로닝 및 비디오 생성을 위한 올인원 AI 미디어 도구

Yuxing-Wang-THU/SurveyBrainBody

에이전트의 형태와 제어를 공동 최적화하여 더 강력한 지능형 로봇과 가상 생물을 창출하는 데 초점을 맞춘 신체적 공동 설계(ECD)의 포괄적 조사 및 분류.

ZhiChengAIR/Chengling-PWM

로봇을 위한 JEPA에 영감을 받은 물리 세계 모델로, 에너지 기반 트랜스포머를 사용하여 물리적 일관성 기반으로 행동 궤적을 시뮬레이션하고 개선합니다.

IvanDrokin/torch-conv-kan

TorchConv‑KAN은 각 커널이 학습 가능한 일변수 함수(KAN, Fast‑KAN, Cheby‑KAN 등)의 집합인 합성곱 레이어를 구현하는 PyTorch 라이브러리입니다. 다양한 레이어 변종, CNN 스타일 모델 패밀리(ResKANet, DenseKANet, VGG‑KAN, U‑Net‑KAN), 사전 학습된 ImageNet‑1k 체크포인트, Accelerate, Hydra, WandB, Ray‑Tune를 사용하는 학습 스크립트를 포함합니다. 프로젝트는 현재 활발히 개발 중이며, 콜모고로프-아르노르드 합성곱에 관한 연구 논문과 함께 제공됩니다.

Agions/splicr

Rust 기반 AI 비디오 내레이션 엔진으로 멀티 에이전트 시스템을 사용하여 CapCut 내보내기를 위한 장면 분석, 대본 작성, 음성 클로닝 및 타임라인 정렬을 자동화합니다.

zaina-ml/ml_forge

코드를 작성하지 않고도 드래그 앤 드롭 인터페이스를 통해 이미지 분류 모델을 구축, 학습, 실행할 수 있는 시각적 PyTorch 파이프라인 에디터입니다.

tryproduck/produck-skills

사용자 피드백을 실행 가능한 PRD로 전환하고 UI 시각적 감각을 향상시키는 데 도움을 주는 문서 중심의 AI 코딩 에이전트 스킬 모음입니다.

tomateo1reg/sora2-watermark-remover-web-gui

비디오를 업로드하고 GPU에서 딥러닝 워터마크 제거 모델을 실행한 후, 현대적인 브라우저 UI 또는 작은 REST API를 통해 정리된 비디오를 반환하는 Flask 기반 웹 앱.

yourdadisco/hotspot_analysis

다양한 소스에서 AI 트렌드를 수집하고, LLM을 활용해 사용자의 특정 비즈니스 요구에 따라 우선순위를 정하는 AI 기반 산업 분석 도구입니다.

jlmelville/uwot

고차원 데이터의 차원 축소를 위한 균일 다양체 근사 및 투영(UMAP) 방법의 R 구현입니다.

erdogant/pca

scikit‑learn의 PCA/SparsePCA/TruncatedSVD를 래핑하고, 사전 제작된 바이플롯, 설명 분산 차트, 이상치 탐지(Hotelling T², SPE/D‑ModX), 특성 중요도 추출, 모델 저장/로드, 분산 정규화 및 새로운 데이터 투영 기능을 추가하여 주성분 분석(PCA)을 간소화하는 Python 라이브러리입니다.

MemeMeow-Studio/MemeMeow

임베딩 모델과 비전 AI를 사용하여 감정이나 장면 설명에 기반해 미ーム을 검색하는 자연어 기반 검색 도구입니다.

Mattie/cataclysm

GPT-4를 사용해 미정의 함수에 대해 동적으로 코드를 생성하고 실행하는 Python 라이브러리로, 개발자가 아직 작성되지 않은 함수를 호출할 수 있게 해줍니다.

xqbase/eleeye

알파-베타 탐색과 비트보드 수 생성을 사용하여 강력한 AI 대전을 제공하는 오픈소스 상기(중국 장기) 엔진입니다.

microsoft/pai

OpenPAI는 조직이 GPU 및 FPGA와 같은 컴퓨팅 자원을 공유하고 AI 자산을 관리하여 트레이닝 파이프라인을 단순화하는 풀스택 AI 플랫폼입니다.

tensorflow/model-analysis

TensorFlow Model Analysis (TFMA)는 대규모 및 슬라이스 인식 평가를 위한 라이브러리입니다. 분산 Beam 파이프라인을 실행하고, Jupyter에서 결과를 시각화하며, TFX/Kubeflow 파이프라인과 통합할 수 있습니다.

tensorflow/transform

TensorFlow에서 데이터 전처리를 위한 라이브러리로, 풀패스 연산을 지원하고 변환을 그래프로 내보내어 훈련-추론 편차를 방지합니다.

tensorflow/data-validation

TensorFlow Data Validation (TFDV)는 기계학습 데이터셋의 통계 계산, 스키마 추론, 이상 탐지를 수행하는 확장 가능한 Python 라이브러리입니다. TensorFlow/TFX 파이프라인과 통합되며, Apache Beam을 사용한 분산 처리를 지원하고 데이터 품질을 검사하기 위한 시각적 UI 도구를 제공합니다.

google/ml-metadata

머신러닝 개발자와 데이터 과학자의 워크플로우와 관련된 메타데이터를 기록하고 검색하는 라이브러리입니다.

MIC-DKFZ/nnDetection

의료 영상 내 객체의 동시에 위치 파악과 분류를 위한 자기 설정 프레임워크로, 설정 프로세스를 자동화하여 다양한 의료 탐지 문제에 적응합니다.

Mark12Ding/SAM2Long

SAM2Long은 오류 누적을 방지하고 장시간 동영상에서의 오브젝트 세그멘테이션을 향상시키기 위한, 학습이 필요 없는 SAM 2의 개선 기술입니다.

ukanwat/aaabench

AAABench는 AI 코딩 에이전트에게 실제 Unreal Engine 5 에디터, 높은 난이도의 과제, 수시간의 비감독 시간을 제공하고, 인간의 도움 없이 믿을 만한 세계를 설계하고 구축하며 스스로를 수정할 수 있는지 측정하는 벤치마크입니다.

Altaheri/EEG-ATCNet

뇌-컴퓨터 인터페이스를 향상시키기 위해 운동 상상 EEG 신호를 분류하기 위한 Attention Temporal Convolutional Network (ATCNet)의 TensorFlow 구현.

tinystruct/smalltalk

ChatGPT와 RAG 기능을 통합한 즉시 메시징 애플리케이션으로, 사용자는 AI와 대화하고 업로드한 문서를 질의할 수 있습니다.

Sompote/DINOV3-YOLOV12

YOLOv12와 DINOv3를 결합한 하이브리드 객체 탐지 프레임워크로, 특히 소규모 또는 복잡한 데이터셋에서 뛰어난 정확도와 빠른 수렴을 제공합니다.

luoguoxiong/aipack

모듈식 런타임, 지속 가능한 하이브리드 메모리, 다단계 컨텍스트 압축을 갖춘 스케일 가능한 AI 에이전트를 구축하기 위한 경량 개인용 AI 어시스턴트 프레임워크입니다.

polyaxon/haupt

Haupt는 실행의 출처 정보, 아티팩트/메트릭 스트리밍, 인터랙티브 사전 세션(SSH/tmux), 로컬 뷰어 API, 호스팅된 노트북 공간을 제공하는 Polyaxon 서비스입니다. 이러한 도구들은 기계학습 실험의 관리, 모니터링, 재현을 돕습니다.

tonywu71/colpali-cookbooks

시각 기반 문서 검색을 위한 ColPali 및 ColQwen2 모델의 구현, 파인튜닝, 해석을 위한 노트북 모음.