101

OpenAI Signals: グローバルなChatGPT導入動向の分析

OpenAI Signalsのデータは、ChatGPTの使用が世界的に深まりかつ拡大していることを示しており、ユーザーはサインアップから6か月後に1日あたりのメッセージ量を50%増やし、実行するタスクの種類を2倍にしています。

102

OpenAI コアダンプ疫学: 18 年前の libunwind バグを修正

OpenAI は、Rockset データインフラストラクチャにおける 2 つの異なるクラッシュ集団を特定し、解決しました。これには、サイレントなハードウェア障害と、GNU libunwind におけるまれな 18 年前のレース条件が含まれます。

103

Inside Genebench-Pro: ゲノムAIベンチマークにおけるケーススタディ

OpenAIのGenebench-Proは、複雑なゲノミックタスクにおけるAIモデルを評価するための専門的なベンチマークを提供し、体性腫瘍学、機能ゲノミクス、および集団遺伝学にわたる十の詳細なケーススタディを特徴としています。

104

OpenAI は計算生物学の推論のために GeneBench-Pro を発表

OpenAI は、計算生物学における AI エージェントの高レベルの科学的判断と反復分析能力を評価するために設計された研究レベルのベンチマークである GeneBench-Pro をリリースしました。

105

DiScoFormer: 分布にわたる密度とスコアのための単一トランスフォーマー

DiScoFormerは、データ点のセットから分布の密度とスコアを単一のフォワードパスで推定し、新しい分布に対して再トレーニングを必要としない新しいトランスフォーマーベースのモデルです。

106

OpenAI マッピング ヨーロッパの AI ワークフォース機会 レポート 2026

OpenAI の 2026 年レポートは、AI Jobs Transition Framework を EU に拡張し、EU 雇用の約 12% が AI とともに成長する可能性があり、14% が比較的近い将来の自動化ポテンシャルが高い、27% が再編成される可能性があり、残りの 47% が即時的な変化が少ないことを示しています。

107

vLLM Semantic Router: マイクロエージェント協調によるモデル性能の向上

vLLMは、Semantic Routerというサービングレイヤーのプリミティブを導入し、単一のモデルAPIコールをマイクロエージェントの有界な協調に変換し、複雑なベンチマークにおいてフロンティアモデルを上回る性能を達成します。

108

HP Inc. と OpenAI の戦略的パートナーシップ

HP Inc. は、OpenAI Frontier プラットフォームを使用して OpenAI との戦略的パートナーシップを拡大し、カスタマーサポート、セキュリティ、およびソフトウェア開発全体に AI エージェントとワークフローを導入しています。

109

GPT-5.6 Sol プレビュー: 機能、セーフガード、および可用性

OpenAIは、フラッグシップ次世代モデルであるGPT-5.6 Solを、TerraおよびLunaとともにプレビューし、強化されたセーフガードと信頼できるパートナーへの限定リリースとともに、コーディング、生物学、サイバーセキュリティにおけるより強力な機能を強調しました。

110

Hugging Face Jobs: 1コマンドで vLLM サーバーをデプロイ

Hugging Face は、HF Jobs を介した 1 コマンドで、プライベートで OpenAI 互換の vLLM エンドポイントをそのインフラストラクチャ上にデプロイできるようになり、テスト、評価、バッチ生成のための従量課金(1秒単位)の代替手段を提供します。

111

OpenAI Codex エージェンティック AI 導入と影響

OpenAI は、Codex を介して知識作業を短いチャットボットのやり取りから長時間帯のエージェンティックタスクへシフトしていると報告しており、8 月 2025 以降、非開発者の導入が最大 189 倍に増加しています。

112

Gemini 3.5 Flash コンピュータ使用統合

Google DeepMind は、Gemini 3.5 Flash にコンピュータ使用をネイティブツールとして統合し、エージェントがブラウザ、モバイル、デスクトップ環境で見る、推論し、行動することを可能にしました。

113

NVIDIA NeMo AutoModel が Mixture-of-Experts モデルのファインチューニングを加速

NVIDIA NeMo AutoModel は、Expert Parallelism、DeepEP、TransformerEngine カーネルを活用し、Hugging Face Transformers v5 上に構築することで、Mixture-of-Experts モデルのファインチューニングにおいて 3.4‑3.7 倍のトレーニングスループットと 29‑32% の GPU メモリ使用量削減を実現します。インポートを 1 行変更するだけで利用可能です。

114

OpenAIとBroadcomがJalapeño LLM推論チップを発表

OpenAIとBroadcomは、LLM推論に特化して最適化されたカスタム設計のAIアクセラレータであるJalapeñoを発表し、ワットあたりの性能を向上させ、コンピューティングコストを削減しました。

115

Hugging Face FFASR リーダーボード: ファーフィールド ASR のベンチマーク

Hugging Face と Treble Technologies は、現実的な音響環境におけるニアフィールドとファーフィールドの Automatic Speech Recognition (ASR) のパフォーマンスギャップを定量化する、最初のオープンコミュニティ主導のベンチマークである FFASR リーダーボードを発表しました。

116

免疫学におけるGPT-5 Pro:T細胞特化の謎を解く

免疫学者のDerya Unutmazは、デオキシグルコースがT細胞の特化にどのように影響するかという3年前の謎を解くためにGPT-5 Proを使用し、新規の生物学的洞察を生成し、未公開の実験結果を予測するモデルの能力を示しました。

117

OpenAI と Appia Foundation: 先進的 AI のための共有標準の確立

OpenAI は、国際的な AI 標準を実務的な評価基準に変換し、組織や管轄を超えた相互運用性を確保するオープンでモジュラーな仕様を開発するために Appia Foundation の設立に協力しました。

118

Qwen-AgentWorld リリース:7つのドメイン向け言語ワールドモデルと汎用エージェントへの影響

Qwen は、7つのエージェント環境をシミュレートする言語ワールドモデル Qwen‑AgentWorld をリリースし、制御可能なシミュレーションと統合された次状態予測により汎用エージェントを改善します。

119

Omio 会話型旅行とAIネイティブ運用

OmioはOpenAIモデルを活用し、検索ベースの旅行計画から会話型コマースへの移行を図り、製品開発時間を以前のレベルの約20%に削減しています。

120

Hugging Face huggingface_hub リリース自動化

Hugging Faceは、オープンソースツールとオープンウェイトモデルを使用した、AI駆動のヒューマン・イン・ザ・ループ(人間が介在する)CI/CDパイプラインを実装することにより、huggingface_hubのリリースサイクルを4〜6週間から週次へと移行しました。

121

Cross-Origin Storage API を使った Transformers.js の実験

Hugging Face は、Transformers.js が実験的な Cross-Origin Storage API を使用してハッシュによってモデルと Wasm リソースをキャッシュし、オリジン間での重複ダウンロードをなくす方法を示しています。

122

vLLM-Omni TTS 推論エンジニアリング

vLLM-Omni は、Qwen3-TTS、VoxCPM2、Higgs Audio V3、Fish Speech S2 Pro などのモデルに対して、レイテンシーとスループットのボトルネックを分離するモデル固有の最適化を適用することで TTS 推論をエンジニアリングし、オーディオスループットを大幅に向上させ、エンドツーエンドレイテンシーを削減しました。

123

PP-OCRv6 リリース:1.5M から 34.5M パラメータの 50 言語 OCR

PaddlePaddle は、パラメータ数が 1.5M から 34.5M の範囲で、50 言語に対応するスケーラブルな OCR モデルファミリー PP-OCRv6 をリリースしました。

124

OpenAI パッチ・ザ・プラネット イニシアチブ

OpenAI は Trail of Bits と提携し、AI 支援型セキュリティ調査と人的レビューを組み合わせて重要なオープンソースソフトウェアの脆弱性を特定・修正する Daybreak イニシアチブ「Patch the Planet」を開始しました。

125

Daybreak: 世界中のあらゆる組織を保護するためのツール

OpenAIは、防御者がマシンスピードで脆弱性を発見、検証、および修正できるようにするための、Daybreakの拡張、更新されたCodex Securityプラグイン、GPT‑5.5‑Cyberのフルバージョン、サイバーパートナープログラム、およびPatch the Planetイニシアチブを発表しました。

126

Hugging Face のローカルモデルによる OpenClaw PR トリアージ

Hugging Face は、Gemma 4 や Qwen 3.6 といったローカルモデルをエージェント型ハーネスにデプロイすることで、OpenClaw リポジトリの GitHub Issue と Pull Request をリアルタイムかつコストゼロでトリアージできることを実証しました。

127

OpenAI Codex-maxxing(長期作業向け)

OpenAIは、Codexを永続的なワークスペースとして活用し、複雑なマルチプロンプトワークフローと長期プロジェクトを管理するための戦略を詳述したホワイトペーパーを公開しました。

128

サムスン電子のChatGPT EnterpriseおよびCodexの導入

サムスン電子は、韓国の全従業員および世界中のDevice eXperience (DX)部門の全従業員にChatGPT EnterpriseとCodexを導入し、R&D、製造、企業機能全般の生産性向上を図っています。

129

MosaicLeaks: 深層リサーチエージェントにおけるプライバシー漏洩への対策

Hugging Face は、研究エージェントが外部ウェブクエリを通じてプライベートな企業データを漏洩するのを防止するためのベンチマーク **MosaicLeaks** と、プライバシー対応深層リサーチ (PA-DR) 訓練手法を導入しました。

130

ChatGPT Enterprise 使用分析と支出コントロールの更新

OpenAI は、ChatGPT Enterprise 向けにクレジット使用分析と更新された支出コントロールを導入し、組織がクレジット消費を追跡し、スケールで AI コストを管理できるようにしました。

131

ChatGPTにおける健康インテリジェンスの向上

OpenAIはChatGPTをGPT-5.5 Instantで更新し、最先端のThinkingモデルに匹敵する健康インテリジェンスを実現し、本番の健康トラフィックにおける事実性問題を71%削減しました。

132

OpenAI o3 Deep Research を用いた希少遺伝性疾患の診断

研究者はOpenAI o3 Deep Researchを使用し、AI支援の研究ワークフローを通じて、376件の未解決の希少小児遺伝性疾患症例において追加の診断収率4.8%を達成しました。

133

Hugging Face PEFT:LoRA の代替手段の評価

要約: Hugging Face の PEFT ライブラリに対するベンチマークは、LoRA が広く普及している一方で、OFT や Lily といった他のパラメータ効率の高いファインチューニング手法が、タスクに応じてメモリ効率とテスト精度の両面で LoRA を上回ることがあることを示しています。

134

Hugging Face のエージェントツールにおけるオープンモデルのベンチマーク

Hugging Face は、新しいベンチマークハーネスを導入し、異なるモデルサイズとライブラリの改訂が、ソフトウェアツールを使用するコーディングエージェントの効率と成功率にどのように影響するかを評価します。

135

Strands Robots と LeRobot の統合: Hugging Face Hub データセットから実機ロボット展開まで

Hugging Face は Strands Robots SDK と LeRobot の統合を発表し、ユーザーがロボットデモを記録し Hub にプッシュ、シミュレーションでポリシーを実行、引数を一つ変えるだけで同じコードを実機 SO‑101 ロボットにデプロイでき、さらに Zenoh ベースのメッシュで複数ロボットを協調させることが可能になりました。

136

OpenAI AI Chemist: GPT-5.4でChan‑Lamカップリングを改善

OpenAI と Molecule.one は GPT-5.4 と Maria AI エージェントを用いて、一次スルホンアミドの Chan‑Lam カップリング反応の収率を TEMPO を使用して改善する方法を自律的に特定・検証しました。

137

GLM-5.2: 長期タスク向けに構築

Z.AIによってHugging FaceでリリースされたGLM-5.2は、堅実な1Mトークンのコンテキスト、IndexShareとMTPの強化による改善されたアーキテクチャ、努力レベルの制御、および長期コーディングベンチマークにおける強力なオープンソースパフォーマンスを導入します。

138

エージェントリソースディスカバリー(ARD)仕様と Hugging Face 実装

Hugging Face は、AI エージェントが実行時にツール、スキル、他のエージェントを動的に検索し統合できるオープン標準であるエージェントリソースディスカバリー(ARD)仕様のリファレンス実装を開始しました。

139

OpenAI、ライフサイエンスにおけるエージェントAI評価のためのLifeSciBenchを発表

OpenAIはLifeSciBenchをリリースしました。これは750の専門家作成タスクからなるベンチマークで、単なる事実記憶ではなく、複雑で実世界のライフサイエンス研究ワークフローをAIシステムがどの程度処理できるかを測定することを目的としています。

140

Google DeepMind AI加速型プランニング(英国住宅建設向け)

Google DeepMindは、英国政府と提携し、Geminiを活用したAIプランニングプロトタイプを開発しています。このプロトタイプは住宅所有者の計画申請の処理時間を半減させることを目的としています。

141

DeepMind AI コントロールロードマップ 発表

DeepMindはAIコントロールロードマップを発表しました。これは内部AIエージェントを内部脅威とみなし、モニタリング、監督、応答層を追加する防御層を重ねたフレームワークで、能力が向上するエージェントを安全に保護します。

142

Qwen Robot Suite:ナビゲーション、マニピュレーション、そして世界モデリングのための統一基盤モデル

QwenはQwen‑Robot Suiteを発表しました――ナビゲーション、マニピュレーション、世界予測のアクションに言語を変換する3つの基盤モデル(RobotNav、RobotManip、RobotWorld)で、数十のロボット具現化にわたる統一されたエージェントロボティクスを実現します。

143

vLLM Semantic Router Fusion プリミティブがプログラム可能なマルチモデルサービングを実現

vLLM は Semantic Router 用に Fusion プリミティブを導入し、プログラム可能なマルチモデルパネル、評価、合成を第一級のサービングパターンとして実現しました。

144

OpenAI デプロイメントシミュレーション:実世界会話リプレイを用いたリリース前リスク予測

OpenAIはDeployment Simulationを導入しました。この手法はリリース前に実際のユーザー会話を候補モデルで再生し、望ましくない行動率を予測し、安全性評価を改善します。

145

Qwen-RobotWorld: 具現化エージェントのための無限の世界

Qwen-RobotWorld は、自然言語を汎用的なアクションインターフェースとして使用し、20 以上のロボットエンボディメントにわたるシナリオ横断的な物理的汎化を可能にする統合世界モデルです。

146

Qwen-RobotManip: アラインメントがロボット操作基盤モデルのスケールを解放する

Qwen-RobotManip は、統一アラインメントフレームワークとヒューマン‑トゥ‑ロボットデータ合成パイプラインを活用し、さまざまなロボット形態とアウト・オブ・ディストリビューションタスクにおいて最先端の汎化性能を実現した Vision‑Language‑Action (VLA) 基盤モデルです。

147

Qwen-RobotNav: エージェントシステム向けのスケーラブルなナビゲーションモデル

Qwen-RobotNav は、Qwen3-VL をベースにした統合ナビゲーションモデルで、視覚コンテキストを制御可能な推論時インターフェースとして扱うことで、5 つのナビゲーションドメインすべてで最先端の性能を実現します。

148

OpenAI パートナーネットワークのお知らせ

OpenAI は、企業がユースケースを特定し、ワークフローを再設計し、AI ソリューションを大規模に導入できるよう支援するため、1億5,000万ドルの投資で支えるグローバルエコシステム **OpenAI Partner Network** を開始しました。

149

職場でのAI導入のためのOpenAI Academyコース

OpenAIは、AI Foundations、Applied AI Foundations、Agents and Workflowsという3つの新コースを開始し、組織がAIリテラシーを高め、個別タスクの改善から構造化されたエージェント支援ワークフローへの移行を支援します。

150

Preply と OpenAI:AIで言語学習をパーソナライズ

Preply は OpenAI API を統合し、Lesson Insights を作成しました。このツールは 1:1 の人間チュータリングセッションを自動フィードバックとターゲット練習を通じてパーソナライズされた学習旅程に変換します。