✷ アーカイブ · ラボ 11 拠点 · ディスパッチ 3,059 件
ラボ
毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。
Hugging Face CodeAgents + Structure: 構造化生成によるエージェント信頼性の向上
Hugging Face の研究は、CodeAgents に thoughts と code を構造化された JSON 形式で生成させることで、パースエラーを排除し明示的な推論を強制することにより、能力の高いモデルのパフォーマンスが平均で 2〜7 ポイント向上することを示しています。
Reed Hastings が Anthropic の取締役会に加わる
Netflixの共同創設者であるReed Hastingsが、グローバル・プラットフォームの拡大におけるリーダーシップの経験と、AIの社会的影響への対処を提供するために、Anthropicの取締役会に任命されました。
Ollama がストリーミングツール呼び出しのサポートを追加
Ollama は now ストリーミング応答とツール呼び出しをサポートし、チャットアプリが部分的なモデル出力を受信し、リアルタイムで関数を呼び出せるようにしました。
DeepSeek-R1-0528 リリースノート
DeepSeek は、ベンチマーク性能の向上、幻覚の低減、JSON 出力および関数呼び出しのサポートを特徴とする、R1 モデルの更新版 DeepSeek-R1-0528 をリリースしました。
Mistral Agents API リリース
Mistral AIは、言語モデルに組み込みのコネクタ、永続的なメモリ、およびマルチエージェント・オーケストレーションを組み合わせることで、能動的な問題解決AIエージェントの作成を可能にするフレームワークであるAgents APIをリリースしました。
Liger GRPO と TRL の統合
ユーザー報告では、DeepSpeed ZeRO-3 と bf16 で Qwen2.5-0.5B-Instruct モデルを使用した際に、Liger GRPO ロスで形状不一致エラーが発生することが指摘されています。
Python における Hugging Face Tiny Agents
Hugging Face は Python 向けに Tiny Agents を導入しました。これは Model Context Protocol(MCP)で駆動される軽量エージェントフレームワークで、最小限のコードで LLM が外部ツールとやり取りできるようにします。
OpenAI o3 Operator アップデート
OpenAIは、GPT-4oベースのモデルをOpenAI o3ベースのバージョンに置き換えることで、Operatorリサーチプレビューを更新し、コンピュータを使用するエージェントの能力を強化しました。
Dell Enterprise Hub アップデート:オンプレミス AI モデルとアプリケーション
Dell と Hugging Face は Dell Enterprise Hub を更新し、Dell AI サーバーと AI PC 向けに最適化されたモデルとすぐに展開できる AI アプリケーションの完全なスイートを提供しました。
OpenAI Deutschland: OpenAI、ミュンヘンに拠点を設立
OpenAIは、ヨーロッパのユーザー、開発者、企業顧客が集中するドイツ全土を支援するため、ミュンヘンに初のドイツオフィスを開設しました。
OpenAI と CodeRabbit: o3、o4-mini、GPT-4.1 でソフトウェアデリバリーを加速
CodeRabbit は OpenAI の o3、o4-mini、GPT-4.1 モデルを活用してコードレビューを自動化し、本番バグを 50% 削減し、プルリクエストサイクルを 25〜50% 加速させます。
OpenAIがStargate UAEとOpenAI for Countriesイニシアティブを発表
OpenAIは、自社のAIインフラストラクチャプラットフォームの最初の国際展開であるStargate UAEを立ち上げ、『OpenAI for Countries』イニシアティブの一環として、各国政府が主権を持つAI能力を構築できるよう支援しています。
Claude 4 リリースノート / 新機能紹介
Anthropic は Claude Opus 4 と Claude Sonnet 4 をリリースし、最先端のコード作成能力、ツール利用による長時間の思考、Claude Code の一般公開を実現しました。
Anthropic、AI Safety Level 3 (ASL-3) 保護策を有効化
Claude Opus 4 の CBRN 兵器開発およびモデルの重みの盗難に関連するリスクを軽減するための予防的措置として、Anthropic は AI Safety Level 3 (ASL-3) 保護策を有効化しました。
Mistral AI Devstral リリース
Mistral AIは、SWE-Bench Verifiedベンチマークにおいてオープンソースモデルを凌駕し、Apache 2.0ライセンスの下で利用可能な、ソフトウェアエンジニアリング用のエージェンティックなLLMであるDevstralをリリースしました。
OpenAI Responses API のアップデート(2025年5月)
OpenAI は、リモート Model Context Protocol (MCP) サーバーのサポート、画像生成や Code Interpreter といった新しい組み込みツール、そしてバックグラウンドモードや暗号化された推論といったエンタープライズ機能を追加して、Responses API を拡張しました。
Falcon-H1: 効率と性能のためのハイブリッドヘッド言語モデル
Hugging Face と TII UAE は、Transformer のアテンションと Mamba-2 状態空間モデルを組み合わせ、メモリ使用量を抑えつつ高速推論で高性能を実現する、0.5B から 34B の 6 つのオープンソースハイブリッドヘッドモデルファミリー「Falcon-H1」を発表しました。
Falcon-Arabic: アラビア語言語モデルの画期的進歩
Technology Innovation Institute(TII)は、7BパラメータのモデルであるFalcon-Arabicをリリースしました。このモデルは、現代標準アラビア語および地域方言にわたる一般知識、文法、推論において、より大規模なアラビア語LLMを上回ります。
nanoVLM: ビジョン言語モデルのトレーニングのためのミニマリスト PyTorch ツールキット
Hugging Face は、初心者や研究者向けに Vision Language Model(VLM)のトレーニングと理解を簡素化することを目的とした、軽量で純粋な PyTorch ツールキットである nanoVLM をリリースしました。
Hugging Face Diffusers 量子化バックエンド
Hugging Face Diffusers は、bitsandbytes、torchao、Quanto、GGUF、FP8 レイヤー単位キャスティングといった複数の量子化バックエンドを統合し、FLUX.1-dev のような大規模拡散モデルのメモリフットプリントを削減します。
Microsoft と Hugging Face が Azure AI Foundry での協力を拡大
Microsoft と Hugging Face は、10,000 以上のオープンソースモデルを Azure AI Foundry に統合するためにパートナーシップを拡大し、多様な AI モダリティの安全でエンタープライズ向けデプロイを可能にしました。
OpenAI Codex: codex-1 によって駆動されるクラウドベースのコーディングエージェント
OpenAI は、`codex-1` モデル(`o3` の最適化バージョン)で駆動され、隔離されたクラウドコンテナ内でソフトウェアエンジニアリングタスクを実行するクラウドベースのコーディングエージェント、Codex を導入しました。
OpenAI Codex リサーチプレビュー
OpenAI は、codex-1 モデルを搭載したクラウドベースのソフトウェアエンジニアリングエージェントである Codex をリリースしました。Codex は、隔離されたサンドボックス環境で、機能の実装、バグ修正、プルリクエストの提案を独立して行うことができます。
Falcon-Edge: 強力で汎用的、かつ微調整可能な1.58ビット LLM
Hugging Face と Falcon-LLM チームは、1.58 ビット(三値)言語モデルのシリーズである Falcon-Edge をリリースしました。1B と 3B のパラメータサイズで提供され、新しい事前学習パラダイムを通じて推論と微調整の両方をサポートします。
Hugging Face Transformers: エコシステム相互運用性のためのモデル定義の標準化
Hugging Face は、Transformers ライブラリをモデル定義の中心的なピボットとして位置付け、Transformers がサポートするあらゆるアーキテクチャが推論エンジンやトレーニングフレームワークを含む広範な ML エコシステムと自動的に互換性を持つようにしています。
Ollama マルチモーダルエンジンのリリース
Ollama は、ビジョンモデルのローカル推論の信頼性と正確性を向上させる新しいマルチモーダルエンジンをリリースしました。Llama 4、Gemma 3、Qwen 2.5 VL、Mistral Small 3.1 をサポートしています。
Expedia Group AI マーケティング統合
Expedia Group は、生成 AI と OpenAI API を活用してコンテンツ制作を拡大し、記述的分析を強化し、変化する消費者の検索行動に適応しています。
Hugging Face と Kaggle のモデルアクセス統合
Hugging Face と Kaggle は、Kaggle ノートブックおよびモデルページ内で Hugging Face モデルの見つけやすさと使いやすさを向上させる統合をリリースしました。
Anthropic ASL-3 安全防御のためのバグバウンティプログラム
Anthropicは、HackerOneとのパートナーシップにより、CBRN関連の悪用を特に標的とした、ユニバーサル・ジェイルブレイクに対するConstitutional Classifiersのストレス・テストを行うためのバグバウンティプログラムを開始しました。
Hugging Face 推論エンドポイント: 高速 Whisper 転写
Hugging Face は、Inference Endpoints 上で新しい OpenAI Whisper のデプロイオプションを導入し、精度を犠牲にすることなく転写速度を最大 8 倍向上させました。
OpenAI HealthBench リリース
OpenAIは、5,000件の現実的な医療会話と48,562の医師作成ルーブリック基準を備えた新しいベンチマーク、HealthBenchを導入し、医療分野におけるAIの能力を厳密に評価します。
Hugging Face ビジョン言語モデル 2025 アップデート
Hugging Face は、2024〜2025 年におけるビジョン言語モデル(VLM)の進化を包括的に概観し、any-to-any アーキテクチャ、推論モデル、そしてロボティクス向けの Vision-Language-Action(VLA)モデルの台頭といったトレンドを強調しています。
LeRobot コミュニティ データセット: ロボティクスの ImageNet を構築する
Hugging Face は、LeRobot を通じてロボティクスデータセットの多様でオープンソースなリポジトリを構築するコミュニティ主導の取り組みを推進し、ロボットポリシーの汎化課題の解決を目指しています。
OpenAI リーダーシップ拡大:Fidji Simo がアプリケーション部門のCEOに任命される
OpenAIは、同社がグローバルな製品・インフラ組織へと進化する中で、製品および運用機能を拡大するためにFidji Simoをアプリケーション部門のCEOに任命しました。
AIインフラに関するエネルギー省へのOpenAIの回答
OpenAIは、米国のAIリーダーシップを維持するために、連邦土地上でのAIスーパーコンピュータハブの建設を加速させるべく、許認可の簡素化と戦略的な連邦財政インセンティブを提唱しています。
アジアにおける OpenAI データレジデンシー
OpenAI は、ChatGPT Enterprise、ChatGPT Edu、API プラットフォーム向けに、日本、インド、シンガポール、韓国でデータレジデンシーオプションを導入し、組織がローカルなデータ主権要件を満たすのを支援します。
Mistral Medium 3 リリースノート
Mistral AI は、最先端の性能と8倍の低コストを両立し、柔軟な企業向けデプロイオプションを備えた最先端クラスのモデル「Mistral Medium 3」をリリースしました。
Mistral AI、Le Chat Enterpriseを発表
Mistral AIは、Mistral Medium 3モデルを搭載した統合型AIプラットフォーム「Le Chat Enterprise」をリリースしました。このプラットフォームはエンタープライズデータを統合し、コード不要のAIエージェントの作成を可能にしています。
サンアントニオ・スパーズ ChatGPT Enterprise 統合
サンアントニオ・スパーズは、ChatGPT Enterprise を統合して業務成長を拡大し、従業員の AI リテラシーを 14% から 85% に向上させ、ファンエンゲージメントとビジネスオペレーション向けにカスタム GPT を展開しています。
Lowe's の OpenAI GPT-4o を活用した AI 実装
Lowe's は GPT-4o を統合し、Mylow と Mylow Companion という AI 搭載アドバイザーを導入しました。これらは顧客と店内アソシエイトに専門的なプロジェクトガイダンスを提供します。
OpenAI for Countries イニシアチブ
OpenAIは、Stargateプロジェクト内のプログラムであるOpenAI for Countriesを開始し、各国が主権的なAIインフラストラクチャ、カスタマイズされたChatGPTサービス、民主的AI原則に基づく国内スタートアップ基金を構築できるよう支援します。
OpenAI、実世界のAIメリットを強調するためにAIストーリーを導入
OpenAIはAIストーリーを開始し、米国の個人や組織が科学、医療、教育の課題をAIで解決し、経済成長と国家安全保障を促進している様子を紹介します。
ジョン・ディアー AI 統合と農業変革
ジョン・ディアーは、OpenAI API を活用して精密農業を拡大し、AI 主導の診断、リアルタイムテレマティクス、See & Spray 技術を通じて顧客成功を変革しています。
OpenAI の構造的進化:公益法人への移行
OpenAI は、営利部門を公益法人(PBC)に移行し、非営利組織の管理を維持することで、人類全体のために AGI を拡大するために必要なリソースを確保します。
Lowe’sのホームインプルーブメント小売向けAI統合
Lowe’sはOpenAIのAPIを活用し、AI搭載のバーチャルアドバイザーとアソシエイトツールを導入して、顧客体験を製品販売からプロジェクト解決へとシフトさせています。
Anthropic AI for Science プログラム発表
Anthropicは、研究者に無料のAPIクレジットを提供するためにAI for Scienceプログラムを開始しました。これは、特に生物学および生命科学における影響力の大きいプロジェクトを対象としています。
OpenAI の GPT-4o 媚び問題とデプロイプロセス改善の分析
OpenAI は、モデルの媚びを増加させた GPT-4o のアップデートをロールバックし、行動上の問題をリリース阻止の安全リスクとして扱う新たなプロトコルを導入した。
GradioでMCPサーバーを構築する
Hugging FaceはModel Context Protocol(MCP)をGradioに統合し、開発者がPython関数をLLMが利用できるツールに、パラメータを1つ変更するだけで変換できるようにしました。
Qwen-3 チャットテンプレート分析
Qwen-3 モデルは、オプションの推論、ローリングチェックポイントによる動的なコンテキスト管理、および改善されたツールの引数シリアライズを可能にする洗練されたチャットテンプレートを導入しています。
AnthropicによるAI輸出管理枠組みへの対応
Anthropicは、計算資源の優位性を維持することが国家安全保障とAIインフラのオフショアリング防止に不可欠であると主張し、Diffusion Ruleを強化するための推奨事項を米国商務省に提出しました。