Ollama Windows 预览版发布
Ollama 现已在 Windows 上以预览版形式发布,允许用户通过原生 Windows 体验拉取、运行和创建大型语言模型(LLMs)。此版本支持本地模型执行,具备内置 GPU 加速功能,并可完全访问 Ollama 模型库和 API。
原生硬件加速
Ollama for Windows 提供硬件加速功能,以优化模型性能,无需虚拟化或手动配置。当可用时,软件会利用 NVIDIA GPU 和现代 CPU 指令集(特别是 AVX 和 AVX2)来加速模型执行。
模型库与视觉功能
Windows 用户可完全访问 Ollama 模型库,包括视觉模型。对于支持视觉功能的模型(如 LLaVA 1.6),用户可通过直接将图像拖放到 ollama run 命令中,将其添加到消息中。
后台 API 与 OpenAI 兼容性
Ollama 的 API 会在后台自动运行于 http://localhost:11434,允许外部工具和应用程序无需额外设置即可连接。
关键 API 功能包括:
- OpenAI 兼容性:Windows 预览版支持与其他 Ollama 平台相同的 OpenAI 兼容性,使现有基于 OpenAI 的工具可与本地模型配合使用。
- PowerShell 集成:可通过 PowerShell 直接调用 API,使用
Invoke-WebRequest向本地端点发送 POST 请求。
安装与设置
要开始使用 Windows 预览版,用户可下载 OllamaSetup.exe 安装程序。安装完成后,可通过终端使用命令 ollama run llama2 执行模型。当有新版本发布时,应用程序会提示用户更新。
Sources
- OriginalWindows preview
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- 项目