NVIDIA/GenerativeAIExamples
Generative AI reference workflows optimized for accelerated infrastructure and microservice architecture.
What it solves
NVIDIA 소프트웨어 생태계를 생성 AI 시스템에 통합하기 위한 포괄적인 시작점과 레퍼런스 구현을 제공합니다. 특히 프로덕션 수준의 RAG 파이프라인, 에이전트 워크플로 및 모델 파인튜닝 프로세스를 구축하는 복잡성을 해결합니다.
How it works
이 저장소는 Jupyter Notebook, 샘플 코드 및 레퍼런스 애플리케이션의 카탈로그 역할을 합니다. NVIDIA NIM(NeMo Inference Microservices)과 NeMo 마이크로서비스 플랫폼을 활용하여 추론, 평가 및 가드레일을 위한 모듈형 인프라를 제공합니다. LangChain, LlamaIndex, Haystack 등 인기 프레임워크와 통합하고, 지식 그래프 생성 및 비전 기반 워크플로와 같은 작업을 위한 GPU 가속 파이프라인을 제공합니다.
Who it’s for
NVIDIA 하드웨어와 소프트웨어를 사용해 생성 AI 애플리케이션을 구축하고자 하는 개발자 및 AI 엔지니어, 특히 NVIDIA 생태계 내에서 RAG, 에이전트 AI 또는 파인튜닝된 LLM을 구현하려는 사람들을 위한 것입니다.
Highlights
- RAG Implementations: 기본 및 고급 RAG 예시(멀티턴, 멀티모달, 구조화 데이터)와 평가 및 관측성 도구를 포함합니다.
- Agentic Workflows: 에이전트 RAG 파이프라인 구축 및 LLM 도구 호출 기능 구현을 위한 튜토리얼.
- Data Flywheel: NeMo 마이크로서비스를 통한 파인튜닝, 추론 및 평가를 통한 지속적인 모델 개선 워크플로.
- Vision NIM Workflows: VLM 기반 비디오 모니터링, NV-CLIP을 활용한 멀티모달 검색 및 텍스트 추출 파이프라인에 대한 레퍼런스 애플리케이션.
- Safety and Auditing: NeMo Auditor 및 NeMo Guardrails와 같은 도구를 사용해 취약점을 식별하고 안전한 AI 동작을 보장합니다.