mistralai/mistral-common

Official inference library for pre-processing of Mistral models

What it solves

它提供了一種標準化的方式來與 Mistral AI 模型進行互動,確保文本、圖像和工具調用(tool calls)能按照模型預期的精確方式進行處理。它消除了分詞(tokenization)和請求驗證中的猜測,這對於從這些模型中獲得最佳性能至關重要。

How it works

此函式庫提供基於 Pydantic 構建的開源分詞器和驗證邏輯。它支援多種模態(文本、圖像和音訊),並提供版本化的分詞器以維持不同模型版本之間的向後相容性。

Who it’s for

正在使用 Mistral AI 模型構建應用程式的開發者,或是正在開發自己的模型、並希望使用與 Mistral AI 相同的分詞和驗證標準的人員。

Highlights

  • Multi-modal tokenization: 支援文本、圖像和音訊。
  • Pydantic-based validation: 確保請求、訊息和工具調用得到正規化與驗證。
  • Versioned tokenizers: 保證已發布模型的向後相容性。
  • Flexible installation: 為特定需求提供可選依賴項,例如 Hugging Face Hub 集成或伺服器模式。

相關

  • 專案
  • 專案
  • 專案
  • Dispatch
  • 專案