✷ アーカイブ · ラボ 11 拠点 · ディスパッチ 3,049 件
ラボ
毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。
Anthropic Responsible Scaling Policy Version 3.0
Anthropicは、単独の企業コミットメントと業界全体の安全性に関する推奨事項を分離するために枠組みを再構成し、フロンティア・セーフティ・ロードマップと定期的なリスクレポートを導入した、Responsible Scaling Policy (RSP) のバージョン3.0をリリースしました。
OpenAI、SWE-bench Verified の評価を中止
OpenAI は、テストケースの欠陥と学習データの汚染により、ベンチマークが最先端モデルのコーディング能力を信頼できる指標とならないため、SWE-bench Verified のスコアの報告を停止しました。
OpenAI フロンティア アライアンス パートナー発表
OpenAIはフロンティア アライアンスを立ち上げ、McKinsey、BCG、BCG X、Accenture、Capgeminiと提携し、企業がフロンティア プラットフォームを活用して AI 同僚を導入・スケールできるよう支援します。
Anthropic 教育レポート:AI Fluency Index
Anthropicは、ユーザーがどのようにAIとコラボレーションするかを測定するAI Fluency Indexを導入しました。反復的な改善が、高度なAI fluency(AIの流暢さ)の最も強力な予測因子であることが判明しました。
Anthropic パーソナ選択モデル
Anthropicは、パーソナ選択モデルを提唱しており、AIアシスタントが人間のように振る舞うのは、事前学習中に学習された人間らしいパーソナをシミュレートしているためであり、後続学習によってそのパーソナが精錬されていると説明しています。
Ollama 0.17: OpenClaw AI アシスタントの簡素化されたセットアップ
Ollama 0.17 では、ローカルハードウェア上でメール、カレンダー、メッセージングアプリを管理できるパーソナル AI アシスタント OpenClaw の、単一コマンドによるインストールプロセスが導入されました。
蒸留攻撃の検知と防止に関するAnthropicのレポート
Anthropicは、DeepSeek、Moonshot、MiniMaxが24,000件以上の不正アカウントを使用してClaudeの能力を不正に抽出するために行った、産業規模の蒸留攻撃を特定し、詳細を明らかにしました。
OpenAI 初回証明提出
OpenAIはFirst Proofという研究レベルの数学チャレンジに対して証明試みを提出し、内部モデルが10問中少なくとも5問を解く可能性があるとしています。
Unsloth と Hugging Face Jobs で AI モデルをトレーニングする
Hugging Face は Unsloth と Hugging Face Jobs を統合し、迅速かつ低コストの LLM ファインチューニングを実現しました。特に LiquidAI/LFM2.5-1.2B-Instruct のような小型モデルに最適化されています。
GGML と llama.cpp が Hugging Face に参加
GGML(llama.cpp の開発者)は、ローカル AI 推論のための持続可能なリソースを提供し、Transformers ライブラリとローカルモデル展開の統合を円滑にするために Hugging Face に参加しました。
Anthropic、Claude Code Securityのリサーチプレビューを発表
Anthropicは、複雑な脆弱性をスキャンしてパッチを提案するAI駆動型の静的解析ツールであるClaude Code Securityをリリースしました。現在、エンタープライズおよびオープンソースチーム向けに、限定的なリサーチプレビューとして提供されています。
Gemini 3.1 Pro リリースノート
Google DeepMind は Gemini 3.1 Pro を発表しました。この新しいモデルは複雑なタスクに対する推論能力が劇的に向上しており、現在 Gemini API、Vertex AI、Gemini アプリ、Notebook LM を通じてプレビューで利用可能です。
OpenAI助成金:The Alignment Project
OpenAIは、独立したAIアラインメントと安全性の研究を拡大することを目的とした、英国AIセキュリティ研究所(UK AISI)の基金であるThe Alignment Projectに、750万ドルの助成金を発表しました。
OpenAI for India イニシアチブ
OpenAI は「OpenAI for India」を開始し、Tata Group や他の機関と提携して主権 AI インフラを構築し、エンタープライズの導入を加速し、国内全体で AI スキルアップを拡大する全国規模のイニシアチブです。
IBM と UC Berkeley が IT-Bench と MAST を用いてエンタープライズエージェントの失敗を診断
IBM Research と UC Berkeley は、エンタープライズ IT エージェントが失敗する原因を診断するために MAST(マルチエージェントシステム失敗分類法)を導入し、最先端モデルは検証エラーが孤立しているのに対し、オープンモデルはシステム的な崩壊が連鎖的に起こることを明らかにした。
Lyria 3 を使用した Gemini の音楽生成
Google DeepMind は Lyria 3 生成音楽モデルを Gemini アプリに統合し、ユーザーがテキストプロンプトまたは画像・動画のアップロードから 30 秒の AI 生成トラックを作成できるようにしました。
Gradio 6 gr.HTML: ワンショット Web アプリ開発
Gradio 6 はカスタムテンプレート、スコープド CSS、JavaScript インタラクティブ性をサポートする強化された gr.HTML を導入し、単一の Python ファイル内で複雑な Web コンポーネントの作成を可能にします。
OpenAI が EVMbench を紹介
OpenAI と Paradigm は、AI エージェントが高深刻度のスマートコントラクト脆弱性を検出、修正、悪用する能力を評価するために設計されたベンチマーク、EVMbench をリリースしました。
Anthropicが実践におけるAIエージェントの自律性を測定 – 主な発見とその意味
Anthropicの2026年2月の調査では、Claude Codeエージェントの自律実行時間が延び、経験豊富なユーザーは自動承認率を高める一方で中断頻度も増加し、エージェントは人間よりも頻繁に確認を求めるようになっている。また、リスクの高い分野での利用は限定的だが、顕著な成長傾向が見られる。
Google DeepMind National Partnerships for AI: インドでの拡大
Google DeepMindは、インド政府機関や各機関と新たなパートナーシップを構築し、科学、教育、農業、エネルギー安全保障のためにフロンティアAIモデルへのアクセスを拡大しています。
Anthropicとルワンダ政府によるAI統合のためのMOU
Anthropicとルワンダ政府は、ルワンダの保健、教育、および公共部門のシステムにAIを統合するための3年間の覚書(MOU)を締結しました。
AnthropicとInfosysによるエンタープライズAIエージェントのための提携
AnthropicとInfosysは、ClaudeモデルとClaude CodeをInfosys Topazと統合し、通信、金融サービス、製造などの規制の厳しい業界向けにエージェンティックAIソリューションを構築するために提携しました。
Anthropic Economic Index: India Country Brief
インドはClaude.aiの総利用量において世界第2位ですが、ITセクターへの高い集中と一人当たりの採用率における大きな差が見られます。一方で、複雑なタスクにおいて15倍の生産性向上を実現しています。
OllamaがClaude CodeにSubagentsとWeb Searchを追加
Ollamaは現在、Claude Code内でsubagentsとweb searchをサポートしており、MCPサーバーやAPIキーを必要とせずに、モデルが並列タスクを実行し、リアルタイム情報にアクセスすることを可能にします。
Anthropic、バンガロールオフィスの開設と戦略的パートナーシップを通じてインドでの展開を拡大
Anthropicはバンガロールに新オフィスをオープンし、企業、教育、農業分野でパートナーシップを展開し、責任あるAIの拡大とインディック言語の能力向上を図っています。
Qwen 3.5‑397B‑A17B リリース:ハイブリッド線形注意 MoE モデル、1M トークン コンテキストと最先端のマルチモーダル性能
Qwen 3.5‑397B‑A17B は、3970 億パラメータのマルチモーダルモデルで、トークンごとにわずか 170 億パラメータのみをアクティベートし、言語、コーディング、推論、視覚タスクにおいて最先端の性能を発揮しながら、前世代と比較して最大 19× 高速です。
GPT-5.2 が理論物理学で新たな結果を導出
OpenAI は、GPT-5.2 Pro とスキャフォールド版 GPT-5.2 を用いて、ハーフ・コリニアレジームにおける非ゼロのグルオン木振幅に関する新しい理論物理学的結果を導出したことを発表しました。
ChatGPT ロックダウンモードとリスク上昇ラベル
OpenAI は、プロンプトインジェクション攻撃を緩和し、データ流出リスクに対するユーザーの制御を強化するために、ロックダウンモードとリスク上昇ラベルを導入しました。
OpenAI、ハイブリッドクレジットシステムを通じてCodexとSoraへのアクセスを拡張
OpenAIは、CodexとSoraのユーザーが作業を中断することなく、レート制限と購入可能なクレジットシステムを組み合わせたリアルタイムアクセスエンジンを実装しました。
OpenAI GABRIEL: GPT を活用した社会科学研究のスケーリング
OpenAI は、GPT を利用して非構造化テキストや画像を社会科学研究のための定量的測定に変換する、オープンソースの Python ツールキット GABRIEL をリリースしました。
Hugging Face CUDA カーネル エージェント スキル
Hugging Face は、Claude や Codex などのコーディングエージェントが、transformers と diffusers ライブラリ向けの本番環境対応 CUDA カーネルを作成、ベンチマーク、統合できるようにするエージェントスキルを導入しました。
Anthropicがクリス・リデルを取締役会に任命
Anthropicは、マイクロソフトおよびジーニアス・モーターズの元最高財務責任者であり、元副ホワイトハウス長官のクリス・リデルを取締役会に任命し、AIの社会的影響に対するガバナンスと監視を強化しました。
AnthropicとCodePathの提携:AI統合型コンピュータサイエンス教育に向けて
Anthropicは、CodePathと提携してClaudeとClaude Codeをカリキュラムに統合し、米国の最大の大学コンピュータサイエンスプログラムにおいて、コミュニティカレッジ、州立大学、HBCUの2万人以上の学生に最先端のAIツールへのアクセスを提供します。
Gemini 3 Deep Think アップデート
Google DeepMind は、数学、物理学、化学のオリンピックで金メダルレベルの性能を達成する専門的な推論モードである Gemini 3 Deep Think を更新し、選択されたユーザー向けに Gemini API を通じて利用できるようにしました。
GPT-5.3-Codex-Spark リリースノート
OpenAIは、リアルタイムコーディングコラボレーション向けに最適化された小型・低レイテンシモデルGPT-5.3-Codex-Sparkをリリースしました。Cerebrasハードウェア上で1秒あたり1,000トークン以上を提供します。
OpenEnv: 現実世界環境におけるツール使用エージェントの評価
Hugging Face と Meta が OpenEnv を発表しました。これは AI エージェントを実際のシステムや Calendar Gym のような本番環境で評価するオープンソースフレームワークで、研究と本番の信頼性ギャップを埋めることを目的としています。
AnthropicがAIガバナンスのためのPublic First Actionに2000万ドルを寄付
Anthropicは、AIの安全対策、公共教育、米国のAI政策リーダーシップを推進することを目的とした両党的501(c)(4)団体であるPublic First Actionに2000万ドルを寄付しました。
Anthropic Series G Funding and Enterprise Growth
Anthropicは、フロンティア研究、製品開発、およびインフラ拡張のために、3800億ドルのポストマネー評価額でシリーズG資金調達により300億ドルを調達しました。
OpenAI ハーネスエンジニアリング:Codex を活用した手動コードゼロ開発
OpenAI は Codex を使用して、手動で書かれたコードを一行も含まない内部ソフトウェア製品を開発し、手動コーディングから環境設計とエージェントのオーケストレーションへのシフトにより、開発時間を約10倍短縮しました。
Anthropic Commitments to Cover Data Center Electricity Price Increases
Anthropicは、米国の料金支払者を保護するため、自社のデータセンター運営に起因するグリッドのアップグレード費用および需要による電気料金の値上げ分を負担することを約束しました。
Qwen-Image-2.0 リリース:プロフェッショナルなインフォグラフィックとフォトリアリズム
Qwen-Image-2.0 は、プロフェッショナルなインフォグラフィック向けに 1k トークンの指示をサポートし、ハイファイフォトリアリズムのためにネイティブ 2K 解像度を備えた統合画像生成・編集モデルです。
Gemini Deep Think は数学、物理学、コンピュータサイエンスにまたがる自律的研究を可能にする
Gemini Deep Think は、自律的かつ協調的エージェントに研究レベルの数学、物理、コンピュータサイエンスの問題を解かせ、出版可能な成果を生み出し、未解決の予想を解決します。
OpenAI、戦争省向けGenAI.milにChatGPTを統合
OpenAIはカスタム版ChatGPTをGenAI.milに展開し、3百万人の戦争省職員に対し、管理・運用支援向けの安全な非機密生成AI機能を提供しています。
Transformers.js v4 リリースノート / 新機能
Hugging Face は Transformers.js v4 をリリースし、ブラウザとサーバーサイドランタイム向けのハードウェアアクセラレーションを実現する新しい C++ で書き直された WebGPU ランタイムと、スタンドアロンの tokenizers ライブラリを導入しました。
OpenAI ローカリゼーションアプローチと OpenAI for Countries イニシアチブ
OpenAI は OpenAI for Countries イニシアチブを通じてローカライズされた AI システムのフレームワークを導入し、各国が最先端モデルを現地の言語、法制度、文化規範に適応させつつ、グローバルな安全性のレッドラインを遵守できるようにしました。
SyGra 2.0.0 Studio リリース
SyGra 2.0.0 は Studio を導入し、YAML ファイルを手動で編集することなく、合成データ生成ワークフローを設計・実行できるビジュアルなインタラクティブ環境を提供します。
GPT-5 がセルフリータンパク質合成のコストを削減
OpenAI と Ginkgo Bioworks は、閉ループの自律ラボシステムで GPT-5 を使用し、セルフリータンパク質合成のコストを 40% 削減し、試薬コストを 57% 削減しました。
OpenAI のサイバー向け Trusted Access
OpenAI は、サイバー向け Trusted Access を開始しました。これは、身元ベースのフレームワークで、セキュリティ専門家に GPT-5.3-Codex への優先アクセスを提供し、サイバー防御と脆弱性修正を加速させることを目的としています。
OpenAI Frontier プラットフォームリリース
OpenAIは、共有ビジネスコンテキスト、安全な実行環境、統合されたガバナンスを備えたAIエージェントの構築、デプロイ、管理を支援するエンドツーエンドプラットフォーム「Frontier」を導入しました。
GPT-5.3-Codex システムカード
OpenAIは、GPT-5.2-Codexの性能とGPT-5.2の推論を統合し、複雑で長時間にわたる技術タスクを処理できるエージェント型コーディングモデル、GPT-5.3-Codexをリリースしました。