Ollama Windows Preview Release

Ollamaは現在、Windows向けにプレビュー版が提供されており、ネイティブなWindows体験を通じて、大規模言語モデル(LLM)のプル、実行、および作成が可能になりました。このリリースにより、組み込みのGPU加速を利用したローカルでのモデル実行、およびOllamaモデルライブラリとAPIへの完全なアクセスが可能になります。

Native Hardware Acceleration

Windows版Ollamaは、仮想化や手動設定を必要とせずにモデルのパフォーマンスを最適化するためのハードウェア加速を提供します。このソフトウェアは、NVIDIA GPUを使用し、利用可能な場合は特にAVXおよびAVX2といった最新のCPU命令セットを使用して、モデルの実行を加速させます。

Model Library and Vision Capabilities

Windowsユーザーは、ビジョンモデルを含むOllamaモデルライブラリに完全にアクセスできます。LLaVA 1.6のようなビジョン対応モデルの場合、ユーザーはollama runコマンドに画像を直接ドラッグ&ドロップすることで、メッセージに画像を追加できます。

Background API and OpenAI Compatibility

OllamaのAPIはhttp://localhost:11434でバックグラウンドで自動的に実行されるため、追加の設定なしで外部ツールやアプリケーションを接続できます。

主なAPI機能は以下の通りです:

  • OpenAI Compatibility: Windowsプレビュー版は、他のOllamaプラットフォームと同じOpenAI互換性をサポートしており、既存のOpenAIベースのツールをローカルモデルで使用することを可能にします。
  • PowerShell Integration: APIは、PowerShellからInvoke-WebRequestを使用してローカルエンドポイントにPOSTリクエストを送信することで、直接呼び出すことができます。

Installation and Setup

Windowsプレビュー版の使用を開始するには、ユーザーはOllamaSetup.exeインストーラーをダウンロードできます。インストール後、モデルはターミナルからollama run llama2コマンドを使用して実行できます。新しいリリースが利用可能になると、アプリケーションがユーザーにアップデートを促します。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • プロジェクト