NVIDIA/GenerativeAIExamples
Generative AI reference workflows optimized for accelerated infrastructure and microservice architecture.
What it solves
NVIDIA のソフトウェアエコシステムを生成 AI システムに統合するための包括的な出発点とリファレンス実装を提供します。特に、プロダクションレベルの RAG パイプライン、エージェントワークフロー、モデルのファインチューニングプロセスを構築する際の複雑さに対処します。
How it works
このリポジトリは Jupyter Notebook、サンプルコード、リファレンスアプリケーションのカタログとして機能します。NVIDIA NIM(NeMo Inference Microservices)と NeMo マイクロサービスプラットフォームを活用し、推論、評価、ガードレイルのためのモジュラーインフラを提供します。LangChain、LlamaIndex、Haystack などの人気フレームワークと統合し、ナレッジグラフ作成やビジョンベースのワークフローなどのタスク向けに GPU 加速パイプラインを提供します。
Who it’s for
NVIDIA ハードウェアとソフトウェアを使用して生成 AI アプリケーションを構築したい開発者や AI エンジニア、特に NVIDIA エコシステム内で RAG、エージェント AI、またはファインチューニングされた LLM を実装したい方を対象としています。
Highlights
- RAG Implementations:基本的および高度な RAG 例(マルチターン、マルチモーダル、構造化データ)と評価・可観測性ツールを含みます。
- Agentic Workflows:エージェント RAG パイプラインの構築と LLM のツール呼び出し機能実装のためのチュートリアル。
- Data Flywheel:NeMo マイクロサービスを使用したファインチューニング、推論、評価を通じた継続的なモデル改善ワークフロー。
- Vision NIM Workflows:VLM ベースのビデオモニタリング、NV-CLIP を用いたマルチモーダル検索、テキスト抽出パイプラインのリファレンスアプリケーション。
- Safety and Auditing:NeMo Auditor や NeMo Guardrails などのツールで脆弱性を特定し、安全な AI 挙動を保証します。