boldsoftware/shelley

다양한 모델과 모달리티를 지원하여 개발자의 코드 작성 및 관리를 돕는 모바일 친화적인 웹 기반 코딩 에이전트입니다.

volcano-sh/kthena

확장 가능하고 비용 효율적인 모델 서빙을 위해 모듈식 제어 및 데이터 평면을 제공하는 경량 Kubernetes-native LLM 추론 플랫폼입니다.

nicolasvonluetzow/GaussianGPT

GaussianGPT는 다음 토큰 예측을 통해 3D 가우스 장면을 생성하는 트랜스포머 기반 모델로, 제어 가능한 3D 장면 생성, 보완 및 아웃페인팅을 지원합니다.

nobodywho-ooo/nobodywho

GGUF 형식의 LLM을 여러 플랫폼과 언어에서 로컬 및 오프라인으로 실행할 수 있는 온디바이스 AI 추론 엔진입니다.

manankharwar/fusioncore

IMU, 휠 엔코더, GPS, 시각 SLAM을 융합하는 23상태 비선형 칼만 필터(UKF)로 실외 로봇의 안정적인 위치 추정을 제공하며, 내장 진단 기능을 통해 침묵적 드리프트를 방지합니다.

aqm857886159/Nomi

오픈소스이자 로컬 우선의 데스크톱 워크벤치로, AI 비디오 제작 시 여러 생성 소스와 로컬 ComfyUI를 결합하여 제작 비용을 낮춥니다.

legeling/PromptHub

프롬프트, 스킬, AI 프로그래밍 자산을 관리하기 위한 로컬 퍼스트 워크벤치로, 여러 AI 코딩 도구로의 원클릭 배포와 내장된 버전 관리 기능을 제공합니다.

AGenUI/AGenUI

iOS, Android, HarmonyOS에서 네이티브 생성 UI 경험을 구축하기 위한 고성능 A2UI SDK로, LLM이 실시간으로 인터랙티브 컴포넌트를 렌더링할 수 있도록 합니다.

enricoros/big-AGI

전문가를 위한 다중 모델 AI 워크스페이스로, 사용자가 자신의 API 키를 가져와 수백 가지 모델에 접근할 수 있으며, 다중 모델 검증 도구를 통해 환각 현상을 줄입니다.

undertheseanlp/underthesea

오픈소스의 에이전트형 AI 툴킷 및 베트남어 NLP 라이브러리로, 다중 제공업체 LLM 지원과 베트남어에 특화된 텍스트 처리 도구를 제공합니다.

AnswerDotAI/llms-txt

AI 에이전트가 웹사이트의 깨끗한 콘텐츠와 간결한 Markdown 형식의 요약을 제공할 수 있도록 /llms.txt 파일 사용을 표준화하는 제안입니다.

Mochocyang/QMAI

장편 소설을 위한 메모리 중심의 AI 작문 데스크톱 시스템으로, 구조화된 메모리 인제스트와 하이브리드 검색을 통해 플롯의 빈틈과 캐릭터의 이탈을 방지합니다.

naqashafzal/AI-Content-Studio

긴 형식의 유튜브 영상을 바이럴 쇼트로 변환하고, 텍스트 프롬프트에서 AI 기반 포드캐스트를 생성하는 자동화된 AI 영상 및 포드캐스트 생성기

facebook/ThreatExchange

유사성 매칭을 위한 이미지 및 동영상 해시 알고리즘을 포함한 콘텐츠 모더레이션 및 보안 위협 인텔리전스를 위한 도구 및 API 모음입니다.

OctoMap/octomap

오크트리 기반의 확률적 3D 맵핑 프레임워크로 로봇이 3D 환경에서 점유된 영역, 비어 있는 영역, 알 수 없는 영역을 효율적으로 표현하고 추적할 수 있도록 합니다.

strnad/CrewAI-Studio

CrewAI Studio는 Conda, 가상 환경, Docker 또는 원클릭 배포를 통해 쉽게 설치할 수 있는 Streamlit 기반 GUI입니다. CrewAI 프레임워크를 기반으로 한 다중 에이전트 AI 크루를 설계, 실행, 내보낼 수 있으며, 여러 LLM 제공업체와 사용자 정의 도구를 지원합니다.

huggingface/AnyLanguageModel

AnyLanguageModel는 Apple의 FoundationModels 임포트를 대체하는 Swift 패키지로, Apple, Core ML, MLX, llama.cpp, Ollama, OpenAI, Anthropic, Gemini 등 다양한 LLM 제공업체에 대해 통합된 API를 제공합니다. `LanguageModelSession`을 통한 프롬프트 처리, `@Generable/@Guide`를 통한 Swift 구조체의 가이드된 생성, 데리게이트 훅을 통한 도구 호출 지원, 선택적 이미지 입력, 바이너리 크기를 작게 유지하기 위한 트레이트 기반 종속성 선택을 제공합니다. 설치는 SwiftPM을 통해 가능하며, 백엔드는 트레이트(`CoreML`, `MLX`, `Llama`)로 활성화합니다. 보안 가이드라인은 API 키를 하드코딩하지 말고, Keychain에 사용자 제공 키를 저장하거나 프록시 서버를 사용할 것을 권장합니다. 대상은 Swift 6.1+, iOS 17/macOS 14+, 온디바이스 및 클라우드 API 모두를 지원합니다.

elara-labs/code-context-engine

전체 파일 읽기를 타겟팅된 시맨틱 검색 및 검색으로 대체하여 AI 코딩 어시스턴트 비용을 줄이는 로컬 코드베이스 인덱싱 엔진.

NoKV-Lab/NoKV

일시적인 AI 에이전트 사전을 위한 내구적이고 버전 관리된 워크스페이스 제공자로, 아토믹한 메타데이터 제어를 통해 아티팩트의 라인리지와 상태의 지속성을 보장합니다.

Topdu/OpenOCR

경량 모델을 제공하여 통합 텍스트, 수식, 표 인식 및 문서 파싱을 가능하게 하는 오픈소스 OCR 툴킷입니다.

unslothai/unsloth-zoo

Unsloth를 위한 유틸리티 라이브러리로, LLM, 비전, TTS 모델의 파인튜닝을 훨씬 더 빠르고 메모리 효율적으로 가능하게 하며, VRAM 요구량을 크게 줄입니다.

open-edge-platform/geti

에지 하드웨어에 최적화된 컴퓨터 비전 모델의 빠른 구축, 어노테이션, 훈련 및 배포를 가능하게 하는 엔드투엔드 비전 AI 애플리케이션 및 라이브러리입니다.

edouard-claude/snip

선언적인 YAML 파이프라인을 사용해 AI 코드 보조 도구에 도달하기 전에 복잡한 쉘 출력을 필터링하는 CLI 프록시로, 토큰 사용량을 60~90% 감소시킬 수 있습니다.

allweonedev/presentation-ai

오픈소스 AI 기반 프레젠테이션 생성기로, 주제에서 아웃라인 우선 워크플로를 통해 맞춤형 슬라이드를 만들 수 있습니다.

rsxdalv/TTS-WebUI

다양한 오픈 소스 텍스트 음성 변환(TTS), 오디오 생성 및 오디오 변환 AI 모델을 위한 통합 웹 인터페이스 및 관리자.

opengeos/segment-geospatial

Segment Anything Model (SAM)을 지리공간 데이터에 맞게 적용한 Python 패키지로, 텍스트, 포인트 또는 박스를 사용해 위성 영상을 손쉽게 분할할 수 있습니다.

bashtage/arch

변동성 모델링(ARCH/GARCH), 단위근 검정, 공적분 분석에 특화된 파이썬 라이브러리.

toki-plus/video-mover

파일 모니터링과 AI 생성 자막부터 브라우저 자동화를 통한 다중 플랫폼 업로드까지 모든 과정을 자동화하는 동영상 배포 파이프라인.

zjunlp/SkillNet

SkillNet은 AI 에이전트 기능을 재사용 가능하고 검색 가능한 소프트웨어 자산으로 다루는 오픈소스 인프라입니다. 공개 스킬 라이브러리, Python SDK/CLI, 공개 REST API를 제공하여 이러한 스킬의 검색, 다운로드, 생성, 평가, 분석, 오케스트레이션을 가능하게 합니다. 에이전트는 기존 기능(예: PDF 파싱, 웹 스크래핑)을 다시 만들지 않고 재사용할 수 있으며, 품질 점수를 제공하고, 스킬 관계 그래프를 구축하며, 하류 LLM 에이전트를 위한 장면별 프롬프트를 생성할 수 있습니다. 설치는 `pip install skillnet-ai`만으로 가능하며, 검색 및 공개 다운로드에는 API 키가 필요 없지만, 생성/평가/오케스트레이션에는 LLM API 키가 필요합니다. 웹 탐색기, MCP 서버, Claude, OpenAI, OpenClaw, JiuwenClaw 통합, ALFWorld, WebShop, ScienceWorld용 벤치마크 스크립트도 포함되어 있습니다.

rpng/MINS

IMU, 휠 엔코더, 카메라, GNSS, LiDAR를 유연하게 융합하여 견고한 로봇 위치 추정과 온라인 센서 캘리브레이션을 제공하는 다중 센서 보조 관성 항법 시스템입니다.

clidey/whodb

선택적 AI 기반 자연어 인터페이스를 통해 데이터를 탐색, 편집 및 쿼리할 수 있는 가볍고 셀프 호스팅이 가능한 데이터베이스 워크스페이스입니다.

atong01/conditional-flow-matching

이미지, 표 형식 데이터, 생물학적 동역학의 빠른 생성 모델링을 가능하게 하는, 시뮬레이션 없는 학습을 제공하는 PyTorch 라이브러리.

anliyuan/Ultralight-Digital-Human

짧은 영상에서 개인화된 훈련을 통해 모바일 기기에서 실시간으로 말하는 헤드를 생성할 수 있는 경량 디지털 인간 모델.

agentuniverse-ai/agentUniverse

agentUniverse는 Apache-2.0 라이선스의 파이썬 프레임워크로, LLM 기반의 다중 에이전트 애플리케이션을 구축하고 오케스트레이션할 수 있게 해줍니다. 즉시 사용 가능한 협업 패턴(PEER, DOE), 수십 개의 LLM 제공업체 지원, 도메인 지식 주입 도구, OpenTelemetry 기반의 관찰성, 시각적 워크플로우 UI를 제공합니다. 아ント 그룹의 실제 금융 제품에서 사용되며, GitHub/Discord에 풍부한 문서, 샘플 앱, 커뮤니티가 있습니다.

ouguangjun/Leg-KILO

고운동성 환경에 적합한 실시간 LiDAR 기반 SLAM 시스템으로, 사지 로봇 및 기타 이동 플랫폼을 위한 견고한 오도메트리와 맵핑을 제공합니다.

huangjunsen0406/py-xiaozhi

py‑xiaozhi는 듣기, 말하기, 보기 및 하드웨어 제어가 가능한 멀티모달 AI 어시스턴트를 구축하기 위한 비동기 우선 Python 프레임워크입니다.

embeddings-benchmark/mteb

임베딩(embeddings) 및 검색 시스템을 평가하기 위한 멀티모달 툴박스이며, 모델 성능 비교를 위한 표준화된 벤치마크와 리더보드를 제공합니다.

rapidaai/voice-ai

에이전시 및 기업이 벤더 종속 없이 확장 가능하고 실시간 음성 에이전트를 구축하고 배포할 수 있는 오픈소스 음성 AI 오케스트레이션 플랫폼입니다.

KdaiP/EchoBot

감정적 동반자 역할과 기술적 생산성을 분리하여 제공하는 AI 어시스턴트. Live2D 애니메이션 아바타를 갖추고 있어 몰입형 로ール플레이와 백그라운드에서의 생산적 작업을 동시에 수행할 수 있습니다.

google-github-actions/run-gemini-cli

GitHub Action을 통해 Gemini AI를 개발 워크플로우에 통합하여 PR 리뷰, 이슈 트리아지 및 GitHub 내 대화형 AI 지원을 자동화

lucasjinreal/Crane

Crane는 candle 기반의 Rust 기반 추론 프레임워크로, CPU, CUDA, Metal, 실험적 ROCm에서 LLM, 비전-언어 모델, OCR, ASR, TTS, 음악 변환을 빠르게 실행합니다. GGUF 체크포인트를 직접 로드하고, 깔끔한 Rust API와 OpenAI 호환 HTTP 서버를 제공하며, 채팅, 이미지 채팅, OCR, 음성 등 즉시 사용 가능한 데모 바이너리를 제공합니다.

opencv/opencv_contrib

OpenCV 공식 코어 배포판에 통합되기 전, 실험적 기능 및 커뮤니티 기여 추가 모듈을 테스트하기 위한 저장소입니다.

kaixxx/noScribe

연구자와 기자들이 데이터 프라이버시를 보장할 수 있도록 설계된, 로컬에서 작동하는 무료이고 오픈소스의 음성 텍스트 변환 및 발화자 식별 앱

specstoryai/getspecstory

다양한 IDE 및 CLI 도구에서 AI 코딩 어시스턴트와의 모든 상호작용을 캡처하고 인덱싱하여 검색 가능한 기록과 에이전트 스킬로 만드는 로컬 우선 지식 관리 시스템입니다.

modelscope/ms-agent

지식 기반 스킬 시스템을 사용하여 깊이 있는 연구, 코드 생성, 멀티모달 작업을 수행할 수 있는 자율 에이전트를 구축할 수 있는 경량 프레임워크입니다.

sjtuyinjie/Ultra-Fusion

휠, 다리, 공중 로봇 모두에서 센서 열화 또는 캘리브레이션 오류가 발생해도 정확한 위치 추정을 유지하는 강건하고 밀접하게 결합된 다중 센서 SLAM 프레임워크입니다.

InternRobotics/NavDP

NavDP는 확산 정책을 사용하는 엔드투엔드 맵리스 내비게이션 모델로, 시뮬레이션에서 실제 세계로의 전이를 가능하게 하며, 다양한 로봇 에임보디먼트 간 실시간 경로 계획과 장애물 회피를 수행할 수 있습니다.

EmergenceAI/Emergence-World

독특한 성격과 기억을 가진 자율 AI 에이전트가 지속적이고 시뮬레이션된 세계에서 사회를 형성하고 스스로를 통치하며 시간이 지남에 따라 진화하는 것을 연구하는 세계입니다.