✷ アーカイブ · ラボ 11 拠点 · ディスパッチ 58 件
ラボ
毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。
Ollama、Pro、Max、およびTeamプラン向けに透明性の高いトークン単位の料金体系を導入
Ollamaは、Pro、Max、およびTeamプラン向けに、月ごとの使用クレジットを含むトークン単位の料金体系を発表しました。これにより、オープンモデルへのアクセスのためのコスト予測が簡素化されます。
Claude DesktopとOllamaの統合により、ローカルおよびクラウドモデルの切り替えが可能に
Ollamaにより、Claude Desktopがサードパーティのゲートウェイとして機能できるようになり、ユーザーはデータをAnthropicに送信することなく、Ollama内の任意のローカルまたはクラウドモデルをClaudeと併用して実行できるようになります。
NVIDIA Nemotron 3.5 Lightning リリース
NVIDIA Nemotron 3.5 Lightning は、100万トークンのコンテキストウィンドウを備え、ローカルの自律型エージェント・ワークフローおよびマルチステップ・タスク向けに設計された、トークンあたり 30億のアクティブ・パラメータを持つ 300億パラメータのオープンモデルです。
Muse Glimmer リリース: Meta Superintelligence Labs による 30B エージェンティック・マルチモーダル・モデル
Meta Superintelligence Labs は、128K+ のコンテキスト長を備え、ローカルのエージェント・ワークロード向けに最適化された 30B マルチモーダル・モデルである Muse Glimmer をリリースしました。現在、Ollama を介して利用可能です。
Ollamaの資金調達とオープンモデルプラットフォームの拡大
Ollamaは、890万人の開発者とFortune 500企業の85%にサービスを提供しており、オープンAIモデルを実行およびスケーリングするためのプラットフォームを拡大するために8,800万ドルを調達しました。
Ollama 0.31: マルチトークン予測によるGemma 4のパフォーマンス向上
Ollama 0.31は、Apple Silicon上のGemma 4に対してマルチトークン予測を導入し、モデルの出力を変更することなく、コーディングエージェントのベンチマークにおいてトークン生成速度を約90%向上させました。
Apple Silicon向けOllama MLXエンジン・アップデート
Ollamaは、NVFP4サポート、カーネル・フュージョン、およびエージェント・ワークフロー用の新しいステート・スナップショット・システムを通じて、Apple Silicon上でのパフォーマンスを向上させるためにMLXエンジンをアップデートしました。
Ollama 0.30 リリース:GGUF モデルのサポート追加と NVIDIA パフォーマンスの最大 20% 向上
Ollama 0.30 は llama.cpp を介して GGUF モデルの互換性を導入し、NVIDIA GPU 上でのスループットを最大 20% 高速化させ、デフォルトの Vulkan 加速を通じてハードウェアサポートを拡大しました。
NVIDIA Nemotron 3 Ultra リリース
NVIDIA Nemotron 3 Ultraは、1MトークンのコンテキストウィンドウとNVFP4量子化を備え、高い効率性を実現する、長期間実行されるエージェント型ワークフロー向けに最適化された550Bパラメータのオープンモデルです。
OpenJarvis 1.0 リリース: Ollama を介したローカルファーストなパーソナル AI
OpenJarvis 1.0 は、Ollama と統合して個人のハードウェア上でモデルを実行する、ローカルファーストなパーソナル AI エージェントを構築するためのオープンソースフレームワークです。
Ollama 0.19 Preview: MLX Integration for Apple Silicon Acceleration
Ollama 0.19は、AppleのMLXフレームワークとのプレビュー統合を導入し、ユニファイドメモリの最適化とNVFP4サポートを通じて、Apple Siliconデバイス上でのパフォーマンスを大幅に加速させます。
Ollama 0.17: OpenClaw AI アシスタントの簡素化されたセットアップ
Ollama 0.17 では、ローカルハードウェア上でメール、カレンダー、メッセージングアプリを管理できるパーソナル AI アシスタント OpenClaw の、単一コマンドによるインストールプロセスが導入されました。
OllamaがClaude CodeにSubagentsとWeb Searchを追加
Ollamaは現在、Claude Code内でsubagentsとweb searchをサポートしており、MCPサーバーやAPIキーを必要とせずに、モデルが並列タスクを実行し、リアルタイム情報にアクセスすることを可能にします。
Ollamaによる個人用AIコーディングアシスタントOpenClawのリリース
Ollamaは、WhatsApp、Telegram、Slack、Discord、iMessage、その他のメッセージングプラットフォームを、中央集約型のゲートウェイを介してAIコーディングエージェントに接続する、ローカル実行型の個人用AIアシスタントOpenClawを発表しました。これにより、プライベートでクロスプラットフォームなコード支援が可能になります。
Ollama launch コマンドのリリース
Ollamaはバージョン0.15+において、'ollama launch' コマンドを導入しました。これにより、ユーザーは手動の環境変数や設定ファイルなしで、Claude CodeやOpenCodeなどのコーディングツールをセットアップして実行できるようになります。
OllamaがZ-Image TurboとFLUX.2 Kleinによる実験的な画像生成機能を追加
Ollamaは、6BパラメータのZ-Image TurboモデルとBlack Forest LabsのFLUX.2 Kleinモデルを使用した、macOS向けの実験的な画像生成機能の発表を行いました。これはOllamaエコシステムにおける初のネイティブなtext-to-image機能となります。
Ollama v0.14.0: Anthropic API 互換性と Claude Code サポート
Ollama v0.14.0 は、Anthropic Messages API との互換性を導入し、Claude Code やその他の Anthropic SDK アプリケーションを、ローカルおよびクラウドのオープンソースモデルで使用できるようにします。
OpenAI Codex with Ollama Integration
Ollamaは、OpenAI Codex CLIがオープンウェイトモデルを使用できるようにし、`gpt-oss:20b`や`gpt-oss:120b`などのモデルを使用して、ローカルでのコード実行と修正を可能にします。
OpenAI gpt-oss-safeguard モデルが Ollama 経由でリリースされました
OpenAI と Ollama は、Apache 2.0 ライセンスの下で、オープンソースの gpt-oss-safeguard 安全性推論モデル(20B および 120B)をリリースしました。これにより、組織は透明な推論を伴うポリシー駆動型のコンテンツ分類を実行できるようになります。
MiniMax M2 Ollama Cloudでのリリース
MiniMax M2は、コーディングとエージェント的ワークフローに最適化された高性能モデルであり、現在Ollamaのクラウドプラットフォームで利用可能です。
Ollamaを使用したNVIDIA DGX Sparkのパフォーマンス
Ollamaは、NVIDIA DGX Sparkのパフォーマンスベンチマークを公開しました。これには、ファームウェアバージョン580.95.05を使用し、gpt-ossやgemma3を含む様々なモデルのスループットが示されています。
Ollama コーディングモデルと統合のアップデート
Ollama は、GLM-4.6 および Qwen3-Coder-480B へのクラウドアクセスを導入し、Qwen3-Coder-30B のアップデートと、VS Code、Zed、Droid の統合拡大を行いました。
Qwen3-VL リリースノート
Ollamaは、高度な空間知覚、32言語に対応する拡張されたOCRサポート、および長時間のビデオ理解のためのネイティブ256Kコンテキストを備えた強力なビジョン言語モデル、Qwen3-VLをリリースしました。
NVIDIA DGX Spark と Ollama の統合
Ollama は NVIDIA と協力し、GB10 Grace Blackwell Superchip を搭載した NVIDIA DGX Spark を、1 ペタFLOP の性能と 128GB のメモリを備えてローカル言語モデルの実行に最適化しました。
Ollama Web Search and Web Fetch API リリース
Ollamaは、ハルシネーションを減らし、RESTおよびライブラリ統合を介してLLMにリアルタイムのウェブデータを提供するために、新しいウェブ検索およびウェブフェッチAPIをリリースしました。
Ollama 新しいモデルスケジューリングのアップデート
Ollama は、クラッシュを減らし GPU 利用率を高めるために、メモリ推定を正確なメモリ測定に置き換える新しいモデルスケジューリングシステムを導入しました。
Ollama Cloud Models Preview
OllamaはCloudモデルのプレビューを開始し、ユーザーが同じローカルツールセットとAPI統合を維持しながら、データセンター級のハードウェア上で大規模なモデルを実行できるようにしました。
OpenAI gpt-oss Ollamaでのリリース
OllamaはOpenAIと提携し、gpt-ossオープンウェイトモデルを統合しました。MXFP4量子化フォーマットにより最適化された20Bおよび120Bパラメータのバージョンを提供し、ローカル実行を可能にします。
Ollama App Release for macOS and Windows
Ollamaは、macOSおよびWindows向けに、ローカルAIモデルのダウンロードとチャットのためのグラフィカルユーザーインターフェースを提供する新しいアプリケーションをリリースしました。これには、ファイルのアップロードやマルチモーダル機能のサポートが含まれます。
Secure Minions プロトコルにより、暗号化された Ollama とフロンティアモデルの連携が可能に
Ollama と Stanford の Hazy Research ラボは、すべてのデータを機密に保ちながら、ローカルの Ollama モデルがフロンティア・クラウドモデルと連携できるようにするエンドツーエンド暗号化プロトコル、Secure Minions を発表しました。
Ollama Thinking Feature Release
Ollamaは、モデルのthinkingプロセスを有効または無効にする機能を紹介しました。これにより、DeepSeek R1やQwen 3などのモデルにおいて、内部的な推論を最終的な出力から分離することが可能になります。
Ollama がストリーミングツール呼び出しのサポートを追加
Ollama は now ストリーミング応答とツール呼び出しをサポートし、チャットアプリが部分的なモデル出力を受信し、リアルタイムで関数を呼び出せるようにしました。
Ollama マルチモーダルエンジンのリリース
Ollama は、ビジョンモデルのローカル推論の信頼性と正確性を向上させる新しいマルチモーダルエンジンをリリースしました。Llama 4、Gemma 3、Qwen 2.5 VL、Mistral Small 3.1 をサポートしています。
Ollama Minions: ハイブリッドなローカルおよびクラウドLLMのコラボレーション
Ollamaは、Stanford Hazy Researchが開発したMinionsを導入しました。これは、Llama 3.2のようなローカルモデルにワークロードを委譲することで、高いパフォーマンスを維持しながらクラウドLLMのコストを削減するフレームワークです。
Ollama 構造化出力のリリース
Ollama は構造化出力をサポートし、ユーザーが JSON schema で定義された特定の形式にモデルの応答を制約できるようにすることで、信頼性と一貫性を向上させることができます。
Ollama Python Library 0.4 リリースノート
Ollama Python library 0.4 では、Python 関数をツールとして直接渡す機能が導入され、Pydantic と docstring parsing を介して JSON スキーマの生成が自動化されます。
OllamaでLlama 3.2 Visionが利用可能に
Ollamaは、11Bおよび90BのパラメータサイズのLlama 3.2 Visionのサポートをリリースし、OCRや画像分析を含むマルチモーダル機能のローカル実行を可能にしました。
Ollama上のIBM Granite 3.0モデル
Apache 2.0ライセンスの下で、DenseモデルおよびMixture of Experts (MoE)バリアントを含むIBM Granite 3.0モデルが、現在Ollamaで利用可能になりました。
OllamaにおけるLlama 3.2のサポート
OllamaはMetaのLlama 3.2をサポートし、エッジデバイス向けの軽量な1Bおよび3Bテキストのみのモデル、ならびに近日登場予定のビジョン対応の11Bおよび90Bモデルを導入しました。
Bespoke-Minicheck: Grounded Factuality Checking via LLM Hallucination Reduction
Ollamaは、主張をソースドキュメントと照合してハルシネーションを検出する、Bespoke Labsの根拠に基づいた事実性検証モデルであるBespoke-Minicheckを統合しました。
Ollama ツールサポートのリリース
Ollama は、Llama 3.1 のようなモデルに対してツール呼び出しのサポートを導入しました。これにより、ローカル LLM が外部 API、関数、およびコードインタープリターとやり取りできるようになります。
Ollama での Google Gemma 2 リリース
2B, 9B, 27B パラメータのバリエーションで提供される Google Gemma 2 が、クラス最高のパフォーマンスと効率性を実現する新しいアーキテクチャとともに Ollama でリリースされました。より大きなオープンモデルを凌駕します。
Ollama と Continue: オープンソース AI コードアシスタントのセットアップ
Ollama と Continue を使用することで、開発者は Codestral、Llama 3、DeepSeek Coder などのモデルを用いて、VS Code や JetBrains 内で完全にオープンソースかつローカルな AI コーディングアシスタントを構築できます。
Ollamaサポートを備えたFirebase Genkit
Googleは、AI搭載アプリを構築するためのオープンソースフレームワークであるFirebase Genkitをリリースしました。これには、GoogleのGemmaモデルをローカルで実行するためのOllamaのネイティブサポートが含まれています。
Llama 3 拒否率と検閲の比較
Llama 3 は Llama 2 よりも誤った拒否率が大幅に低く、技術的な支援を提供しつつ、無害なプロンプトに対する過剰な拒否を減少させています。
OllamaでのLlama 3の利用可能性
OllamaはLlama 3のサポートをリリースし、Llama 2と比較してトレーニングデータ、コンテキスト長、およびトークン効率において大幅な改善された8Bおよび70Bパラメータのモデルへのアクセスを提供します。
Ollama 埋め込みモデルのサポート
Ollamaは現在、埋め込みモデルをサポートしており、テキストをベクトル埋め込みに変換することで、ローカルな検索拡張生成(RAG)アプリケーションの作成を可能にします。
Ollama AMD グラフィックスカード サポート プレビュー
Ollama は、Windows および Linux において AMD グラフィックスカードのプレビューサポートを導入しました。これにより、幅広い Radeon、Radeon PRO、および Instinct シリーズのカードを通じて、すべての Ollama 機能でハードウェアアクセラレーションが可能になります。
Ollama Windows Preview Release
OllamaはWindows向けにプレビュー版をリリースし、ネイティブなGPU加速とAPIアクセスにより、ユーザーが大規模言語モデル(LLM)をローカルで実行、プル、および作成できるようにしました。
Ollama OpenAI 互換性アップデート
Ollama は、OpenAI Chat Completions API との組み込みの互換性を備えるようになりました。これにより、ユーザーは既存の OpenAI 互換のツールやライブラリを使用して、ローカルモデルを実行できるようになります。