half-potato/radiance_meshes

이미지로부터 3D 장면의 볼륨 재구성을 가능하게 하며, 모바일 웹 환경에서의 모델 최적화 옵션을 제공하는 Radiance Meshes용 학습 프레임워크입니다.

TornLux/UnrealBridge

AI 에이전트가 Unreal Engine 5.3+를 실시간으로 제어하고 편집할 수 있도록 지원하는 브릿징 레이어로, 환각을 방지하기 위한 AST 기반 검증과 블루프린트, VFX 및 리깅과의 심층적인 통합을 특징으로 합니다.

EleutherAI/gpt-neox

GPT‑NeoX는 다중 GPU 클러스터에서 수십억 매개변수 언어 모델을 훈련하기 위한 Megatron 기반의 오픈 소스 라이브러리입니다. DeepSpeed 스타일의 최적화를 추가하고, 많은 런처(Slurm, MPI 등)를 지원하며, NVIDIA 및 AMD GPU에서 작동하고, Flash Attention, Mixture‑of‑Experts 및 선호 학습 미세 조정과 같은 최신 기능을 포함합니다. 대규모 컴퓨팅 예산을 가진 연구실에 이상적입니다. 추론 전용 사용에는 Hugging Face `transformers`를 권장합니다.

tensorflow/graphics

TensorFlow를 위한 미분 가능한 그래픽 및 기하학 레이어 라이브러리로, '분석을 통한 합성' 방식을 통해 3D 비전 모델의 자기 지도 학습을 가능하게 합니다.

a312863063/generators-with-stylegan2

영화, 광고, 게임 분야에서 사용할 수 있는 고충실도, 독특한 가상 인간의 얼굴을 생성하는 StyleGAN2 기반의 얼굴 생성기 모음입니다.

netease-youdao/BCEmbedding

RAG에 최적화된 이중 언어 및 교차 언어 임베딩 및 재순위 지정 프레임워크로, 중국어와 영어 간의 고성능 검색에 특화되어 있습니다.

tensorly/tensorly

PyTorch, TensorFlow, JAX 등 여러 백엔드를 시ーム리스하게 지원하는 텐서 분해 및 텐서 학습을 위한 Python 라이브러리입니다.

mbzuai-oryx/Video-ChatGPT

LLM과 시공간 시각 인코더를 결합하여 동영상 콘텐츠에 대해 세부적이고 자연스러운 언어 대화를 가능하게 하는 동영상 대화 모델입니다.

ModelTC/LightX2V-Qwen-Image-Lightning

Qwen‑Image 텍스트-이미지 모델의 증류된 더 빠른 버전(4 또는 8단계 확산)으로 fp32/bf16/fp8 체크포인트, LoRA 어댑터, 바로 사용할 수 있는 ComfyUI 워크플로우를 제공합니다. 약간의 품질 손실로 12–25배 속도 향상을 제공하며 Diffusers, ComfyUI, Nunchaku, Cache‑dit와 통합됩니다.

mbzuai-oryx/groundingLMM

GLaMM은 자연어 응답과 객체 분할 마스크를 통합하여 정확한 시각적 그라운딩을 제공하는 픽셀 그라운딩 대형 멀티모달 모델입니다.

EasyJailbreak/EasyJailbreak

EasyJailbreak은 LLM의 jailbreak 공격을 모듈화한 오픈소스 Python 프레임워크입니다. ReNeLLM, GPTFuzz, AutoDAN 등 사전에 준비된 레시피를 제공하며, 사용자가 커스텀 선택기, 변형기, 제약, 평가자를 추가해 타겟 언어 모델에 대한 악성 프롬프트를 생성, 실행, 점수화할 수 있습니다. `pip install easyjailbreak` 또는 소스에서 설치 후, `PAIR` 레시피와 같은 고수준 API를 사용하거나, 자체 공격 파이프라인을 구축할 수 있습니다. 프로젝트에는 문서, 논문, 데이터셋, 실험 결과 다운로드가 포함되어 있습니다.

hako-mikan/sd-webui-supermerger

AUTOMATIC1111의 Stable Diffusion WebUI용 모델 병합 확장 프로그램으로, 메모리 내에서 모델을 병합하고 디스크에 저장하지 않고 블록 단위 가중치 조정을 수행할 수 있습니다.

ankane/torch.rb

Torch.rb는 PyTorch C++ 라이브러리(LibTorch)를 래핑한 Ruby gem으로, Ruby 개발자에게 기능이 풍부한 딥러닝 API를 제공합니다. 텐서, autograd, 신경망 모듈, 옵티마이저, 그리고 GPU(CUDA/MPS) 가속을 지원하며, PyTorch Python API를 Ruby 스타일의 메서드 이름으로 반영합니다. 설치를 위해서는 적합한 LibTorch 빌드가 필요하며, 설치 후에는 Ruby에서 직접 모델(예: CNN, GANs)을 작성하고 실행할 수 있습니다.

mbzuai-oryx/LLaVA-pp

LLaVA++는 LLaMA-3와 Phi-3 LLM을 통합하여 LLaVA 1.5의 시각적 지시 수행 능력을 향과 학술적 작업 성능을 향상시킵니다.

voyag-commits/Open-Source-Astra-Alternative

Codex/DeepSeek 기반의 일회용 워커 모델을 사용해 소프트웨어 개발 사이클을 자동화하는 WSL2 아플라이언스. Strata SCTL 라이브 사이클 허브를 실행 가능.

HasnainRaz/Fast-SRGAN

SR-GAN 기반의 실시간 슈퍼레졸루션 구현으로, 피크셀 셔플을 사용해 저해상도 동영상을 고해상도로 효율적으로 확대합니다.

NVlabs/OmniVinci

OmniVinci는 시각, 오디오, 텍스트를 공동으로 이해하기 위해 특화된 시간적 및 정렬(alignment) 아키텍처를 사용하여 크로스 모달 추론 능력을 향상시킨 오픈소스 멀티모달 LLM입니다.

levyflux/AViD

AViD는 LoRA와 EMA를 사용하여 Grounding DINO를 미세 조정하는 프레임워크로, 오픈-보리ュ움 객체 탐지기를 사용자 정의 데이터셋에 효율적으로 적응시킬 수 있게 합니다.

lartpang/SAMs-CDConcepts-Eval

이미지 및 비디오 전반에서 의료 병변 및 산업 결함과 같은 문맥 의존적 개념을 분할하는 SAM 및 SAM 2의 능력을 테스트하기 위한 종합적인 평가 프레임워크입니다.

stepfun-ai/SteptronOss

SFT, RLVR 및 평가의 모듈식 구성과 빠른 반복을 위한 대규모 언어 모델용 경량 트레이닝 프레임워크입니다.

FlashLabs-AI-Corp/FlashLabs-Chroma

실시간 음성 대화를 위한 엔드투엔드 다중 모달 모델로, 직접 음성 이해 및 개인화된 음성 클론을 지원합니다.

blendi-remade/falcraft

텍스트 프롬프트에서 fal.ai를 사용해 3D 구조물과 게임 세계 내 실시간 AI 영상 방송을 생성하는 마인크래프트 Fabric 모드입니다.

browser-use/browser-harness-js

제한적인 헬퍼 함수 없이 AI 에이전트가 모든 Chrome DevTools Protocol 메서드에 직접 접근할 수 있도록 하는 최소한의 타입 지정 JavaScript 브릿지입니다.

VinF/deer

DDPG 및 더블 Q-학습과 같은 알고리즘의 구현을 제공하는 모듈식 Python 라이브러리입니다.

lucidrains/autoregressive-diffusion-pytorch

확산(diffusion) 기반 접근 방식을 사용하여 벡터 양자화(vector quantization)의 필요성을 제거한 PyTorch 기반의 자기회귀 이미지 생성 구현체입니다.

Leavesfly/TinyAI

Java로만 구축된 풀스택 AI 프레임워크로, 저수준 텐서 연산부터 LLM, AI 에이전트, 그리고 Embodied Intelligence(구체화된 지능)까지 완전한 파이프라인을 제공합니다.

HITSZ-NRSL/Dynamic-VINS

움직이는 물체를 제거함으로써 자원 제약이 있는 로봇이 동적 환경에서도 정확한 위치 추정을 유지할 수 있도록 설계된 실시간 RGB-D 관성 오도메트리 시스템입니다.

wb04307201/spring-ai-loom-agent

RAG, MCP 도구 통합, 스킬 마켓, 엔터프라이즈급 에이전트 배포를 위한 관리 콘솔을 특징으로 하는 완전한 AI 에이전트 프레임워크를 제공하는 Spring Boot starter입니다.

InditexTech/mcp-server-simulator-ios-idb

자연어 명령을 통해 LLM이 iOS 시뮬레이터를 제어하여 앱 관리 및 UI 테스트를 수행할 수 있도록 하는 MCP 서버입니다.

roboserg/RoboLeague

차량 제어, 호버링, 공중 볼 핸들링을 위한 강화 학습 에이전트 훈련을 위한 Unity ML-Agents 실험 모음입니다.

Luo-Yihao/FaithC

SDF와 Marching Cubes를 대체하여 날카로운 에지와 내부 구조를 보존하는 거의 손실 없는 3D 복셀 표현 시스템. Faithful Contour Tokens (FCTs)를 사용하여 구현.

jolibrain/colette

Colette는 PDF를 이미지로 인덱싱하여 표, 그림, 레이아웃을 보존하는 자체 호스팅형 RAG 플랫폼입니다. 비전 임베딩, BM25 어휘 검색, 선택적 HyDE 프롬프팅을 결합하며 Docker를 통해 고성능 GPU에서 실행됩니다. 기밀 기술 문서에 적합합니다.

google-ar/arcore-ios-sdk

Google의 크로스플랫폼 ARCore 기능(클라우드 앵커 및 지오스페이셜 API 등)을 iOS 애플리케이션에 제공하는 소프트웨어 개발 키트입니다.

arthurflor23/handwritten-text-recognition

TensorFlow 기반의 프레임워크로, 광범위한 데이터 증강과 여러 표준 HTR 데이터셋을 지원하는 손글씨 텍스트 인식 및 합성 기능을 제공합니다.

TetreesEX/TetreesAgent_EX

Tetrees Agent EX는 공개 MCP 계약을 통해 Tetrees EX 마켓플레이스의 AI 팩을 검색, 견적, 실행, 확장, 게시할 수 있는 Node.js SDK/CLI입니다. 구매자, 빌더, 판매자 흐름용 예제 스크립트를 제공하며, 모든 자격 정보를 로컬에 보관합니다.

nahrek/polyledger

Polymarket 시장 메타데이터와 온체인 거래 데이터를 쿼리 가능한 DuckDB 데이터베이스에 집계하는 재개 가능한 인덱서입니다.

alexandre01/deepsvg

딥러닝과 미분 가능한 텐서를 사용하여 벡터 그래픽스(SVG)의 생성 및 애니메이션을 위한 계층적 생성 네트워크 및 라이브러리.

caiyuanhao1998/Open-OmniVCus

OmniVCus는 깊이 및 마스크와 같은 다중 모달 제어 조건 하에서 특정 주제를 포함하는 동영상을 생성하는 피드포워드 주제 중심의 동영상 커스터마이징 프레임워크로, 확산 트랜스포머를 사용합니다.

qdrant/quaterion

세마틱 검색, 추천, 이상 탐지에 특화된 사전 학습 모델을 빠르게 파인튜닝할 수 있는 프레임워크입니다.

candle-org/MindAct

로봇 데스크탑 조작을 위한 모방 학습 정책의 재현 가능한 훈련 및 평가를 위한 PyTorch 및 Hugging Face 네이티브 툴킷입니다.

openMVG/openMVG

이미지(사진측량)에서의 3D 재구성용 C++ 프레임워크로, 구조-운동 문제를 해결하기 위한 라이브러리와 파이프라인을 제공합니다.

JavisVerse/JavisDiT

텍스트 프롬프트에서 음성과 영상의 의미적 및 시간적 일치를 보장하는, 음성-영상 동시 생성을 위한 통합 Diffusion Transformer 프레임워크입니다.

caiyuanhao1998/Open-DiffusionGS

확산 노이즈 제거기에 가우시안 스플래터링을 통합한 단일 단계 이미지에서 3D 생성 및 재구성 프레임워크로, 빠르고 확장 가능한 3D 생성을 가능하게 합니다.

Firepal/stammer

다른 오디오 또는 비디오 소스에서 가장 스펙트럼적으로 유사한 프레임을 사용하여 하나의 오디오 소스를 재구성하는 파이썬 유틸리티입니다.

paulknysh/blackbox

고비용 블랙박스 함수의 병렬 최적화를 위한 파이썬 모듈로, 신경망 하이퍼파라미터 튜닝과 같은 작업에서 전역 최소값을 찾는 데 적합합니다.

SURGroup/UQpy

UQpy는 물리적 및 수학적 시스템에서 불확실성을 모델링하고 정량화하기 위한 일반 목적의 Python 도구상자입니다.

pymanopt/pymanopt

비유클리드 기하 최적화를 위한 자동 미분을 지원하는 리만 다양체 위에서의 최적화를 위한 Python 도구상자입니다.

pdpipe/pdpipe

pandas DataFrames를 위한 간편하고 체인 가능한 전처리 파이프라인을 생성하기 위한 라이브러리로, 데이터 정제 및 특징 공학을 간소화합니다.