NVIDIA DGX Spark 與 Ollama 整合

Ollama 與 NVIDIA 合作,確保 NVIDIA DGX Spark 可以快速且高效地原生運行本地語言模型。此整合提供了一個高性能環境,讓使用者能使用 Ollama 架構來原型設計與執行本地 LLM。

NVIDIA DGX Spark 的硬體規格

NVIDIA DGX Spark 由 NVIDIA GB10 Grace Blackwell Superchip 驅動,提供 1 petaFLOP 的運算效能,用於本地模型執行。系統配備 128GB 記憶體,支援來自阿里巴巴(Qwen)、DeepSeek、Meta(Llama)、Mistral、Google(Gemma)以及 OpenAI(Gpt-oss)等供應商的大規模模型。

模型相容性與自訂功能

Ollama 讓使用者能運行其廣泛模型庫中的模型,或將自訂與微調過的模型上傳至 NVIDIA DGX Spark。硬體的記憶體容量支援 Ollama 庫中多種先進模型的運行。

性能優化與使用案例

Ollama 目前正與 NVIDIA 合作,針對多個關鍵 AI 工作流程進行性能優化。這些優化專注於以下使用案例:

  • 聊天: 標準對話式 AI 界面。
  • 文件處理: 包含檢索、OCR 與修改。
  • 文件處理: 包含檢索、OCR 與修改。
  • 程式碼任務: 程式設計與軟體開發協助。
  • 多模態工作流程: 涉及多種資料輸入的任務。

Sources

相關