封存 · 11 個實驗室 · 58 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

01

Ollama 推出 Pro、Max 與 Team 計畫的透明逐 Token 計費模式

Ollama 宣布為其 Pro、Max 與 Team 計畫推出逐 Token 計費模式並提供每月使用額度,簡化了開源模型存取的成本預測。

02

Claude Desktop 與 Ollama 的整合實現了本地與雲端模型的切換

Ollama 現在讓 Claude Desktop 扮演第三方閘道器,因此使用者可以在 Ollama 中運行 Claude 以及任何本地或雲端模型,而不會將數據傳送到 Anthropic。

03

NVIDIA Nemotron 3.5 Lightning 發佈

NVIDIA Nemotron 3.5 Lightning 是一款 30B 參數的開源模型,每個 token 的啟動參數為 3B,專為本地代理工作流和多步驟任務設計,並具備 1M token 的上下文窗口。

04

Muse Glimmer 發佈:Meta Superintelligence Labs 的 30B Agentic Multimodal Model

Meta Superintelligence Labs 已發佈 Muse Glimmer,這是一款針對本地 Agent 工作負載優化的 30B 多模態模型,具備 128K+ 上下文長度,現已可透過 Ollama 使用。

05

Ollama 融資與開放模型平台擴張

Ollama 已籌集 8,800 萬美元以擴展其執行與擴展開放 AI 模型的平台,服務於 890 萬開發者及 85% 的財富 500 強企業。

06

Ollama 0.31: 透過多標記預測提升 Gemma 4 效能

Ollama 0.31 在 Apple Silicon 上為 Gemma 4 引入了多標記預測,在不改變模型輸出的情況下,將程式碼代理基準測試中的標記生成速度提升了近 90%。

07

Ollama Apple Silicon MLX 引擎更新

Ollama 已更新其 MLX 引擎,透過 NVFP4 支援、Kernel Fusion 以及針對 Agentic 工作流的新型狀態快照系統,提升了在 Apple Silicon 上的效能。

08

Ollama 0.30 版本發佈,新增 GGUF 模型支援並提升 NVIDIA 效能高達 20%

Ollama 0.30 透過 llama.cpp 引入了 GGUF 模型相容性,並在 NVIDIA GPU 上提供高達 20% 的吞吐量提升,同時透過預設的 Vulkan 加速擴展了硬體支援。

09

NVIDIA Nemotron 3 Ultra 發布

NVIDIA Nemotron 3 Ultra 是一款 5500 億參數的開源模型,專為長時間運行的代理工作流程優化,具備 100 萬 token 上下文視窗與 NVFP4 量化技術,實現高效率。

10

OpenJarvis 1.0 發佈:透過 Ollama 實現本地優先的個人 AI

OpenJarvis 1.0 是一個用於構建本地優先個人 AI 代理的開源框架,它與 Ollama 整合,以便在個人硬體上運行模型。

11

Ollama 0.19 Preview: MLX Integration for Apple Silicon Acceleration

Ollama 0.19 引入了與 Apple MLX 框架的預覽整合,透過統一記憶體優化和 NVFP4 支援,顯著提升了在 Apple Silicon 裝置上的效能。

12

Ollama 0.17: OpenClaw AI Assistant 簡化設置指南

Ollama 0.17 引入了 OpenClaw 的單指令安裝流程,這是一款能夠在本地硬體上管理電子郵件、行事曆和通訊軟體的個人 AI 助手。

13

Ollama 為 Claude Code 增加了子代理 (Subagents) 與網頁搜尋功能

Ollama 現在支援 Claude Code 中的子代理與網頁搜尋,允許模型執行並行任務並存取即時資訊,而無需 MCP 伺服器或 API 金鑰。

14

Ollama 發布 OpenClaw 個人 AI 編碼助手

Ollama 發布了 OpenClaw,這是一款在本地運行的個人 AI 助手,透過一個中央閘道器將 WhatsApp、Telegram、Slack、Discord、iMessage 和其他通訊平台連接到 AI 編碼代理,實現了私密且跨平台的程式碼協助。

15

Ollama launch command 發布

Ollama 在 0.15+ 版本中推出了 'ollama launch' 指令,讓使用者無需手動設定環境變數或設定檔,即可設定並運行 Claude Code 和 OpenCode 等開發工具。

16

Ollama 新增 Z-Image Turbo 與 FLUX.2 Klein 實驗性圖像生成功能

Ollama 宣布在 macOS 上推出實驗性圖像生成功能,使用 6B 參數的 Z-Image Turbo 模型與 Black Forest Labs 的 FLUX.2 Klein 模型,這標誌著 Ollama 生態系中首次具備原生文字轉圖像能力。

17

Ollama v0.14.0: Anthropic API 相容性與 Claude Code 支援

Ollama v0.14.0 引入了對 Anthropic Messages API 的相容性,使得 Claude Code 與其他 Anthropic SDK 應用程式能夠使用本地與雲端開源模型。

18

OpenAI Codex 與 Ollama 集成

Ollama 現在允許 OpenAI Codex CLI 使用開源權重模型,實現了使用 gpt-oss:20b 和 gpt-oss:120b 等模型進行本地代碼執行和修改的功能。

19

OpenAI gpt-oss-safeguard 模型透過 Ollama 發佈

OpenAI 與 Ollama 發佈了採用 Apache 2.0 授權的開源 gpt-oss-safeguard 安全推理模型(20B 與 120B),讓組織能夠透過透明的推理過程來執行政策驅動的內容分類。

20

MiniMax M2 在 Ollama Cloud 上發布

MiniMax M2 是一款針對程式碼編寫與代理型工作流優化的高效能模型,現已在 Ollama 的雲端平台上線。

21

NVIDIA DGX Spark 使用 Ollama 的效能表現

Ollama 已發佈 NVIDIA DGX Spark 的效能基準測試,展示了使用韌體版本 580.95.05 執行 gpt-oss 與 gemma3 等各種模型的吞吐量。

22

Ollama 編碼模型與整合更新

Ollama 推出了 GLM-4.6 與 Qwen3-Coder-480B 的雲端存取功能,同時更新了 Qwen3-Coder-30B 並擴展了對 VS Code、Zed 與 Droid 的整合。

23

Qwen3-VL 發佈說明

Ollama 已發佈 Qwen3-VL,這是一款功能強大的視覺語言模型,具備先進的空間感知能力、擴展至 32 種語言的 OCR 支持,以及用於長影片理解的原生 256K 上下文窗口。

24

NVIDIA DGX Spark 與 Ollama 整合

Ollama 與 NVIDIA 合作,針對搭載 GB10 Grace Blackwell Superchip 的 NVIDIA DGX Spark 進行優化,使其能以 1 petaFLOP 的運算效能與 128GB 記憶體高效執行本地語言模型。

25

Ollama Web Search and Web Fetch API 發佈

Ollama 已發佈全新的網頁搜尋與網頁擷取 API,旨在透過 REST 與函式庫整合,減少幻覺並為 LLMs 提供即時的網頁數據。

26

Ollama 新模型調度更新

Ollama 推出了一套全新的模型調度系統,將記憶體估算替換為精確的記憶體測量,以減少崩潰並提高 GPU 利用率。

27

Ollama Cloud Models Preview

Ollama 推出了 Cloud 模型的預覽版,讓使用者能在資料中心級硬體上執行大規模模型,同時維持相同的本地工具集和 API 整合。

28

OpenAI gpt-oss 在 Ollama 上發佈

Ollama 與 OpenAI 合作整合了 gpt-oss 開放權重模型,提供 20B 與 120B 參數版本,並透過 MXFP4 量化格式針對本地執行進行了優化。

29

Ollama App Release for macOS and Windows

Ollama 已針對 macOS 和 Windows 推出全新應用程式,提供圖形使用者介面以進行本地 AI 模型下載與對話,並支援檔案上傳與多模態功能。

30

Secure Minions 協定實現加密的 Ollama 與前沿模型協作

Ollama 與史丹佛大學 Hazy Research 實驗室宣布推出 Secure Minions,這是一種端到端加密協定,讓本地 Ollama 模型能與前沿雲端模型協作,同時保持所有數據的機密性。

31

Ollama Thinking Feature Release

Ollama 已推出啟用或停用模型思考過程的功能,讓使用者可以針對 DeepSeek R1 和 Qwen 3 等模型將內部推理與最終輸出分開。

32

Ollama 新增串流工具呼叫支援

Ollama 現在支援串流回應與工具呼叫,讓聊天應用程式能夠接收部分模型輸出並即時呼叫函數。

33

Ollama 多模態引擎發佈

Ollama 推出了全新的多模態引擎,以提升視覺模型的本地推論可靠性與準確性,並支援 Llama 4、Gemma 3、Qwen 2.5 VL 以及 Mistral Small 3.1。

34

Ollama Minions: 本地與雲端 LLM 混合協作

Ollama 推出了 Minions,這是一個由 Stanford Hazy Research 開發的框架,透過將工作負載委派給 Llama 3.2 等本地模型,在維持高效率的同時降低了雲端 LLM 成本。

35

Ollama 結構化輸出發佈

Ollama 現在支援結構化輸出,允許使用者將模型回應限制在由 JSON schema 定義的特定格式中,以提高可靠性與一致性。

36

Ollama Python Library 0.4 Release Notes

Ollama Python library 0.4 引入了直接將 Python 函數作為工具傳遞的能力,並透過 Pydantic 和 docstring parsing 自動化 JSON schema 的生成。

37

Llama 3.2 Vision 現已可在 Ollama 中使用

Ollama 已發布對 Llama 3.2 Vision (11B 與 90B 參數規模) 的支援,實現了包括 OCR 與圖像分析在內的多模態能力的本地執行。

38

Ollama 上的 IBM Granite 3.0 模型

IBM Granite 3.0 模型(包括 Dense 與 Mixture of Experts (MoE) 版本)現在已在 Ollama 上以 Apache 2.0 授權提供。

39

Ollama 中的 Llama 3.2 支援

Ollama 現在支援 Meta 的 Llama 3.2,推出了適用於邊緣裝置的輕量級 1B 和 3B 僅限文本模型,以及即將推出的 11B 和 90B 視覺能力模型。

40

Bespoke-Minicheck: 透過落地事實查核減少 LLM 幻覺

Ollama 已整合 Bespoke-Minicheck,這是一款由 Bespoke Labs 開發的落地事實查核模型,透過將聲明與來源文件進行比對來偵測幻覺。

41

Ollama 工具支援發佈

Ollama 已為 Llama 3.1 等模型引入了工具呼叫支援,讓本地 LLM 能夠與外部 API、函數和程式碼解釋器進行互動。

42

Google Gemma 2 在 Ollama 上發布

Google Gemma 2 提供 2B、9B 與 27B 參數變體,於 Ollama 上發布,採用全新的架構,提供同級領先的性能與效率,表現優於規模更大的開源模型。

43

Ollama and Continue: 設定開源 AI 程式碼助手

Ollama 與 Continue 讓開發者能夠在 VS Code 和 JetBrains 中使用 Codestral、Llama 3 和 DeepSeek Coder 等模型,建立一個完全開源、本地運行的 AI 程式碼助手。

44

Firebase Genkit 支援 Ollama

Google 已發布 Firebase Genkit,這是一個用於構建 AI 驅動應用程式的開源框架,其特色是原生支援 Ollama,可在本地運行 Google 的 Gemma 模型。

45

Llama 3 拒絕率與審查比較

Llama 3 的錯誤拒絕率顯著低於 Llama 2,在減少對良性提示詞過度拒絕的同時,仍能提供技術協助。

46

Llama 3 在 Ollama 上可用

Ollama 已發布對 Llama 3 的支援,提供 8B 和 70B 參數模型的存取,與 Llama 2 相比,在訓練數據、上下文長度和 token 效率方面都有顯著改進。

47

Ollama 嵌入模型支援

Ollama 現在支援嵌入模型,透過將文本轉換為向量嵌入,實現了建立本地檢索增強生成(RAG)應用程式的能力。

48

Ollama AMD 顯示卡支援預覽版

Ollama 在 Windows 與 Linux 上推出了 AMD 顯示卡預覽支援,為廣泛的 Radeon, Radeon PRO, 與 Instinct 系列顯卡提供硬eardware acceleration (硬體加速) 功能,使能所有 Ollama 功能在這些顯卡上運行。

49

Ollama Windows 預覽版本

Ollama 已推出 Windows 預覽版本,讓使用者能以原生 GPU 加速與 API 存取,在本地執行、拉取和建立大型語言模型。

50

Ollama OpenAI 相容性更新

Ollama 引入了與 OpenAI Chat Completions API 的內建相容性,讓使用者能夠使用現有的 OpenAI 相容工具與函式庫來運行本地模型。