alesha-pro/tools
Tools, ComfyUI workflows and benchmark configs from a 4x RTX 3090 local-inference rig
해결하는 문제
이 저장소는 로컬 하드웨어에서 AI 모델을 실행하기 위한 전문 도구 모음을 제공하며, 특히 비디오 생성 최적화와 에이전트 기반 애니메이션 생성을 중점적으로 다룹니다.
작동 방식
프로젝트는 각각 자체 설치 프로세스가 있는 독립적 섹션으로 구성되어 있습니다:
- minimax-h3:MiniMax H3 모델에 대한 ComfyUI 워크플로우를 구헌하며, 동기화된 비디오와 오디오를 한 번에 생헌합니다. 단일 24 GB GPU와 멀티 GPU 설정 모두에 대한 최적화가 포험되어 있으며, 4카드 구헌에서 상당한 속도 향상을 달성합니다.
- skills:Blender나 비디오 생헌 모델 없이 연필, 잉크, 리소그라프 등 헌드 그린 캔버스 애니메이션을 만드는 JavaScrip트와 Canvas 2D 도구와 같는 독립 에이전트 스킬이 포험되어 있습니다.
대상 사용자
자신의 하드웨어에서 로컬 AI 추론을 실헹하는 사용자(특히 NVIDIA RTX 3090 또는 유사한 멀티 GPU 설정을 보유한 사용자)로, 고품질 비디오와 오디오를 생성하거나 AI 에이전트를 위한 특정 애니메이션 스킬을 구현하려는 사람들.
주요 특징
- 멀티 GPU 최적화:4x RTX 3090 설정에 특별히 튜닝되어, 15초 샷의 샘플링 시간을 19분에서 7분 미만으로 줄입니다.
- 동기화 생성:MiniMax H3를 사용하여 프레임과 오디오를 동시에 생헌합니다.
- 에이전트 스킬:Canvas 2D를 사용하여 표현력 있는 스트로크와 설계된 포즈를 위한 전문 애니메이션 도구가 포함되어 있습니다.
- 바로 사용 가능:사용자 정의 노드, turbo LoRA에 필요한 패치, 간소화된 설치 프로그램이 포함되어 있습니다.
관련
- 프로젝트
Alos21750/UAV-DownloaderUAV Downloader는 JableTV, MissAV, SupJav, Hanime1에 대한 Windows 중심의 비디오 다운로더로, 로컬 음성 인식(ReazonSpeech K2 v2 또는 Whisper) 및 번역 모델(FuguMT, OPUS-MT)을 사용해 일본어, 영어, 번체 중국어 자막을 자동 생성할 수 있습니다. 인터랙티브 GUI(UAV Browser), 비대면 스케줄러(UAV Watcher), 헤드리스 Docker/CLI 버전의 세 가지 운영 모드를 제공하며, 프록시 지원, 병렬 다운로드, 선택적 LLM 기반 번역 기능을 갖추고 있습니다. 프로젝트는 Apache 2.0 라이선스로 배포되며 기본적으로 오프라인에서 작동합니다.
- 프로젝트
- 프로젝트
AlexGladkov/claude-in-mobile`mcp-devices` (또는 `claude‑in‑mobile`)는 모듈식 Node/Rust 서버로, Claude 스타일 AI 에이전트가 안드로이드, iOS, 웹, 데스크톱, Aurora, HarmonyOS 장치를 제어할 수 있게 해줍니다. 기본 패키지(`npm i -g mcp-devices`)를 설치하고, 플랫폼 플러그인(예: `@mcp-devices/plugin-android`)을 추가해 활성화한 후, MCP 호환 클라이언트를 서버에 연결합니다. 스크린샷, 탭, UI 검사, 실시간 디버깅, 테스트 등의 기능을 제공하여 AI 기반 장치 자동화와 몸체화 에이전트 연구를 가능하게 합니다.
- 프로젝트
11273/mooc-work-answer크로스플랫폼 Python 도구로 중국 MOOC 서비스(지혜직교, AI 우커, 자원庫)에서 학습 진도 추적, 디스커션 게시, AI 지원 과제 힌트를 자동화합니다. 공식 API와 통신하며, 선택적으로 DeepSeek을 호출해 참조 답변(60–100% 관련성)을 생성합니다. 사전 빌드된 실행 파일 또는 소스 코드에서 실행 가능하며, 인간의 사용을 모방하기 위한 안전한 지연 시간을 포함합니다.