✷ アーカイブ · ラボ 11 拠点 · ディスパッチ 3,049 件
ラボ
毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。
STADLER AI導入と生産性向上
230年の歴史を持つ産業リサイクル企業STADLERは、OpenAIのChatGPTを全社的な生産性レイヤーとして組み込むことで、知識業務の時間を30〜40%削減し、ドラフト作成速度を2.5倍に向上させました。
Hugging Face OpenClaw 移行ガイド
Hugging Face は、Inference Providers とローカル llama.cpp 設定の 2 つの方法を提供し、制限された Claude モデルからオープンソースの代替モデルへ OpenClaw エージェントを移行します。
Gemini 3.1 Flash Live リリースノート / 新機能
Google DeepMind は、精度の向上、レイテンシの低減、そしてグローバル展開の拡大を実現した、自然なリアルタイム対話向けの高品質オーディオ・音声モデルである Gemini 3.1 Flash Live をリリースしました。
Google DeepMind の AI 有害操作に関する研究
Google DeepMind は、新しい研究論文と、AI が人間の思考や行動に対する有害な操作に利用されるリスクを測定・軽減するための実証的に検証されたツールキットを発表しました。
Lyria 3 Pro リリース:Google 製品全体での長時間・構造認識音楽生成
DeepMind は、構造認識を備えた最大3分のトラックを生成できる音楽生成モデル Lyria 3 Pro を発表し、現在 Vertex AI、AI Studio、Google Vids、Gemini、ProducerAI などの Google 製品に統合されています。
OpenAI Model Spec: 明示的なモデル動作のためのフレームワーク
OpenAIはModel Specを導入しました。これは、意図されたAIモデルの動作を明示的かつ読みやすく、ユーザー、開発者、研究者が改訂可能な形にすることを目的とした、正式な公開フレームワークです。
OpenAI セーフティ バグバウンティ プログラム開始
OpenAIは、従来のセキュリティ脆弱性に該当しないAIの悪用や安全リスクを特定するための公開Safety Bug Bountyプログラムを開始しました。対象はエージェント型リスク、機密情報漏洩、プラットフォームの完全性です。
Claude Code Auto Mode: 自律的コード作成のためのモデルベースの権限ガードレール
Anthropic は Claude Code auto mode を導入しました。これはモデルベースの分類器を使って行動を承認する中間的な権限システムであり、承認の疲労を軽減しながら、危険な過剰な積極的行動を防止します。
OpenAI ティーン安全ポリシーパック と gpt-oss-safeguard
OpenAI は、プロンプトベースの安全ポリシーとオープンウェイトの gpt-oss-safeguard モデルをリリースし、開発者が AI アプリケーションでティーンエイジャー向けの年齢適切な保護を実装できるよう支援します。
OpenAI、Agentic Commerce Protocolを通じてChatGPTのプロダクト発見を拡張
OpenAIは、拡張されたAgentic Commerce Protocol(ACP)により、ChatGPTでの視覚的なショッピングとプロダクト発見機能を強化し、ユーザーが商品を見つけ比較するプロセスを効率化しました。
OpenAI財団の最新情報
OpenAIは、次の1年間で生命科学、経済への影響、AIレジリエンス、コミュニティプログラムにわたって少なくとも10億ドルを投資し、AGIが人類に利益をもたらすことを確実にすることを発表しました。
EVA エンドツーエンド評価フレームワーク(音声エージェント向け)
EVA は、音声エージェントを正確性と会話体験の両面で同時に評価する新しいエンドツーエンドフレームワークであり、タスク成功とユーザー満足度の間に一貫したトレードオフがあることを明らかにします。
vLLM Model Runner V2 リリースノート / 新機能
vLLM は Model Runner V2(MRV2)を導入しました。これはモデルランナーをゼロから再実装したもので、GPU ネイティブかつ非同期優先、モジュラーなアーキテクチャによりスループットを向上させ、レイテンシを低減します。
Anthropic Economic Index 2026年3月レポート:学習曲線
Anthropicの2026年3月経済指標レポートでは、Claudeの利用が多様化し、低賃金タスクが増加し、利用期間の長いユーザーがより高い成功確率を達成していることが示された。これは、実践を通じた学習(学習曲線)と、スキルに偏った影響の可能性を示している。
長時間実行アプリ開発のためのAnthropicハーネス設計
Anthropicは、プランナー、ジェネレーター、評価者という3エージェントからなるハーネスを導入し、Claudeが複数時間にわたるセッションを通じて高品質なフロントエンド設計やフルスタックアプリケーションを自律的に生成できるようにした。これにより、コンテキストの制限や自己評価バイアスを克服した。
Mistral AI Voxtral TTS リリース
Mistral AIは、エンタープライズ向け音声エージェント向けに、高い自然度を持つ音声生成と低遅延ストリーミングを提供する、4Bパラメータの多言語テキスト読み上げ(TTS)モデル、Voxtral TTSをリリースしました。
OpenAI Sora 2 安全フレームワーク
OpenAI は、Sora 2 の安全アーキテクチャを詳細に示し、出所シグナル、同意ベースの類似性管理、そして音声と動画に対する厳格なコンテンツフィルタリングに焦点を当てています。
Vibe Physics: Claude Opus 4.5を理論物理学のAI大学院生として活用する
マシュー・シュワルツ教授は、Claude Opus 4.5が専門家の監督下で、1年かかる計算を2週間に短縮し、最先端の理論物理学研究を実行できることを実証しました。
科学計算のための長時間稼働Claude
Claude Opus 4.6を使用した数日間にわたるエージェントによるコーディングワークフローにより、微分可能な宇宙論的Boltzmannソルバーの実装のような複雑な科学計算タスクを自動化し、研究者の数ヶ月分の労力をわずか数日間に圧縮できることをAnthropicが実証しました。
Anthropic、AI駆動の発見を加速するためのサイエンスブログをリリース
Anthropicは、AI研究、実用的な科学的ワークフロー、および協働の共有を目的とした新しいサイエンスブログをリリースしました。
NVIDIA Nemotronによるドメイン固有埋め込みのファインチューニング – 1日以内
NVIDIA と Hugging Face は、単一 GPU で 1 日以内に完了するパイプラインを公開し、合成ドメインデータ上で Llama‑Nemotron‑Embed‑1B‑v2 モデルをファインチューニングし、検索精度を 10% 超向上させ、実際のエンタープライズデータセットでは最大 26% の改善を実現しました。
OpenAI内部コーディングエージェント監視システム
OpenAIは、内部コーディングエージェントにおけるミスアラインメントとセキュリティ違反を検出するために、GPT-5.4 Thinking搭載の監視システムを導入し、複雑でツールが豊富に使用されるワークフローでのみ顕在化する行動を特定しています。
OpenAIがAstralを取得
OpenAIはAstralを取得し、uv、Ruff、tyを含むオープンソースPythonツールをCodexエコシステムに統合することで、AIエージェントがソフトウェア開発ライフサイクル全体に参加できるようにします。
Qwen3.5-Max-Preview の LMSys Arena でのリリース
Qwen は、フルリリースが2週間以内に予定されていることを受け、コミュニティ評価のために Qwen3.5-Max-Preview を LMSys Arena に展開しました。
Hugging Faceのオープンソースの現状:2026年春
Hugging Faceは2025年にオープンソースAIエコシステムが大幅に拡大したと報告しています。その特徴は、中国が米国をモデルダウンロード数で上回り、ロボティクスが最大のデータセットカテゴリとして急速に台頭したことです。
Google DeepMind AGIへの進捗測定: 認知フレームワーク
Google DeepMindは、人工汎用知能(AGI)に向けたAIの進捗を実証的に測定するための認知分類体系と3段階評価プロトコルを導入しました。
Mistral AI Forge: カスタム最先端モデル向けエンタープライズシステム
Mistral AIは、企業が独自の組織的知識に基づいた最先端のAIモデルを構築し、継続的に改善できるシステム、Forgeを導入しました。
Holotron-12B 高スループットコンピュータ使用エージェント
H Companyは、NVIDIA Nemotron-Nano-2 VLをベースとしたマルチモーダルコンピュータ使用モデルHolotron-12Bをリリースしました。このモデルはハイブリッドSSM-Attentionアーキテクチャを使用し、エージェントワークロードに対して高い推論スループットを実現します。
OpenAI GPT-5.4 mini と nano のリリースノート
OpenAI は、GPT-5.4 mini と nano をリリースしました。これらの高効率な小型モデルは、GPT-5.4 の機能を高ボリュームのワークロードに提供し、遅延とコストを大幅に削減します。
OpenAI Japan ティーン安全設計図
OpenAI Japanは、便利さやプライバシーよりもティーンエイジャーの安全を優先し、若年ユーザーをAI関連リスクから保護することを目的とした「Japan Teen Safety Blueprint」を導入しました。
OpenAIリサーチ:労働者がChatGPTを活用して報酬インサイトを得る方法
OpenAIの研究によると、米国の労働者は1日あたり約300万件ものメッセージをChatGPTに送信し、給与ベンチマークや報酬に関する指針を求めていることが分かりました。特にスキルが高く、透明性の低い職種で顕著です。
Mistral Small 4 リリースノート / 新機能
Mistral AIは、推論、マルチモーダル、およびエージェント的コーディング機能を単一の多用途アーキテクチャに統合した、Apache 2.0 ライセンスの統合オープンソースモデルである Mistral Small 4 をリリースしました。
Mistral AIとNVIDIAのパートナーシップ:NVIDIA Nemotron Coalition
Mistral AIは、NVIDIAの計算リソースとMistral AIのモデルアーキテクチャを使用して、オープンソースのフロンティアAIモデルを共同開発するため、NVIDIA Nemotron Coalitionの創設メンバーとして参加しました。
Mistral AI Leanstral リリース
Mistral AIは、形式的に検証されたコードと数学的証明を可能にするため、Lean 4向けに設計された6Bのアクティブパラメータを持つオープンソースのコードエージェント、Leanstralをリリースしました。
OpenAI Codex Security: システムがSASTレポートのシーディングを回避する理由
OpenAIのCodex Securityは、Static Application Security Testing(SAST)レポートから開始することを避け、分析の早期狭窄を防ぎ、変換チェーンを通じてセキュリティ不変条件が実際に維持されているかを検証することに重点を置いています。
BAIRがスケーラブルなLLMインタラクション発見のためにSPEXとProxySPEXを紹介
BAIRはSPEXとProxySPEXを導入しました。これらのアルゴリズムは信号処理と符号理論を用いて、スケール上で特徴、訓練データ、モデルコンポーネント間の影響力のある相互作用を特定します。
P-EAGLE: vLLM における並列投機的デコード
vLLM は、すべてのドラフトトークンを単一のフォワードパスで生成する並列投機的デコード手法 P-EAGLE を導入し、NVIDIA B200 GPU 上で従来の EAGLE-3 に比べて最大 1.69 倍の速度向上を実現します。
Anthropic Dedicated Feature Crosscoder (DFC) for Cross-Architecture Model Diffing
Anthropicの研究者たちは、独自の機能を分離することで、異なるアーキテクチャを持つAIモデル間の行動の違いを特定するツールであるDedicated Feature Crosscoder (DFC) を開発しました。これにより、「未知の未知」のリスクを検出することが可能になります。
Anthropic Claude パートナーネットワークの立ち上げ
Anthropicは、企業によるClaudeの導入を支援する組織に対し、トレーニング、技術サポート、および共同投資を提供するため、初期投資1億ドルを伴うClaude Partner Networkを開始しました。
Mistral AI Rails Testing Agent
Mistral AIは、Vibeを使用してRuby on Railsモノリス向けのRSpecテストを自動的に生成および改善する自律型エージェントを開発しました。275ファイルの実験において、100%の行カバレッジと0件のRuboCop違反を達成しました。
OpenAIがプロンプトインジェクションに抵抗するAIエージェントを設計
OpenAIはプロンプトインジェクションをソーシャルエンジニアリング問題として扱い、防御戦略をシフトしています。入力フィルタリングだけに頼るのではなく、成功した操作の影響を制限することに重点を置いています。
OpenAI Responses API コンピュータ環境の更新
OpenAIはResponses APIにシェルツールとホストされたコンテナワークスペースを装備し、モデルがコマンドラインインターフェースと永続的なランタイムコンテキストを通じて実世界のタスクを実行できるようにしました。
vLLM における NVIDIA Nemotron 3 Super のサポート
vLLM は、マルチエージェント AI 向けに最適化された 1200 億パラメータのハイブリッド MoE モデルである NVIDIA Nemotron 3 Super をサポートし、100 万トークンのコンテキストウィンドウと高い推論効率を実現します。
楽天における OpenAI Codex のエンジニアリング効率向上統合
楽天は OpenAI Codex をエンジニアリングスタックに統合し、平均復旧時間(MTTR)を 50% 短縮し、四半期単位の開発プロジェクトを数週間に圧縮しました。
Wayfair OpenAI 統合 ケーススタディ
Wayfair は OpenAI モデルを社内システムに統合し、3,000 万点の商品のカタログタグ付けを自動化し、AI 搭載ツール Wilma によってサプライヤーサポートを効率化しました。
Anthropic Institute の紹介
Anthropic は、Jack Clark が率いる学際的な研究の取り組みである The Anthropic Institute を立ち上げました。これは、加速するフロンティア AI 開発がもたらす社会的、経済的、および法的な課題を研究し、伝えることを目的としています。
OpenAI の指示階層の改善と GPT-5 Mini-R
OpenAI は新しい強化学習データセット IH‑Challenge を導入し、モデルが信頼できる指示を信頼できない指示よりも優先できるように訓練しました。その結果、GPT‑5 Mini‑R が安全性のステアラビリティとプロンプトインジェクション耐性の向上を実現しています。
ChatGPT の数学・科学向けインタラクティブビジュアル
OpenAI は、ChatGPT において 70 以上の主要な数学・科学概念向けに動的なビジュアル説明を導入し、ユーザーが変数と式の関係をリアルタイムで理解できるようにしました。
vLLM Semantic Router v0.2 Athena リリースノート / 新機能
vLLM Semantic Router v0.2 Athena は、モデルスタックを全面的に再構築し、実験的な ClawOS オーケストレーションレイヤーと高度なモデル選択プリミティブを導入することで、セマンティックルーティングをマルチエージェント展開向けの戦略的システムブレインへと変換します。
Hugging Face Storage Buckets リリース
Hugging Face は、チェックポイントや加工済みデータなどの中間 ML アーティファクトを効率的に扱うために、Xet をバックエンドとした可変型の S3 ライクなオブジェクトストレージシステム「Storage Buckets」を導入しました。