151

MiniMax M3 vLLM サポート:1M トークンマルチモーダル推論の Day-0 サービング

vLLM は MiniMax M3 モデルファミリーに対する Day-0 サポートをリリースし、MiniMax Sparse Attention (MSA) を使用した 1M トークンコンテキストとネイティブなマルチモーダル推論の効率的なサービングを可能にしました。

152

PyTorch におけるプロファイリング(パート 2):nn.Linear から融合 MLP へ

Hugging Face は、GPU カーネルの融合、torch.compile の影響、そして kernels ライブラリを用いた手動チューニングカーネルの使用を分析することで、PyTorch におけるマルチレイヤーパセプトロン(MLP)の最適化方法を解説しています。

153

OpenAI、Onaを買収しCodex向けの永続的クラウド実行を実現

OpenAIはOnaを買収し、セキュアなクラウド実行とオーケストレーション技術をCodexに統合することで、AIエージェントがユーザーのアクティブなセッションに依存せずに、複雑で長時間にわたるタスクを実行できるようにします。

154

OpenAI、EUのAI生成コンテンツの透明性に関する行動規範への支援

OpenAIは、EU AI法を施行し、デジタル出所を改善するため、欧州委員会のAI生成コンテンツの透明性に関する行動規範への支援を発表しました。

155

OpenAI Codexを使用してブラックホールのプラズマシミュレーションを加速させる

天体物理学者の Chi-kwan Chan は、OpenAI Codex を使用して、ブラックホールの周囲の粒子運動のシミュレーションにおける計算負荷を軽減する新しい数値アルゴリズムを導出し、テストしています。

156

BBVAとOpenAIのAIネイティブバンキング向け戦略的コラボレーション

BBVAはOpenAIと戦略的同盟を結び、グローバルな業務全体に人工知能を統合し、ChatGPT Enterpriseを10万人の従業員に拡張し、『The Eight』と呼ばれる包括的なAI変革ロードマップを実装しました。

157

OpenAIとOracle Cloud Infrastructure インテグレーション

OpenAIとOracleは提携し、Oracle Cloud Infrastructure(OCI)のお客様が適用可能なOracle Universal CreditsをOpenAIフロンティアモデルおよびCodexの利用に適用できるようにしています。

158

DiffusionGemma: テキスト拡散による4倍高速テキスト生成

Google DeepMindは、テキスト拡散を使用してテキストブロックを同時に生成する実験的な26B MoEモデルであるDiffusionGemmaをリリースしました。これにより、自己回帰モデルと比較して専用GPUでの推論が最大4倍高速になります。

159

OpenAIは米国のAI議論を標的とする PRC リンクの影響工作を阻止

OpenAIは、中国に関連付けられた2つのChatGPTアカウントクラスターを禁止しました。これらのアカウントはAIを使用して、AIインフラストラクチャおよびテクノロジーポリシーに関する米国の公開議論を秘密裏に操作しようとしました。

160

Google DeepMind マルチエージェント AI 安全性研究 ファンディングコール

Google DeepMind とパートナーは、$10M のファンディングコールを発表し、相互作用する独立したエージェントから生じる発生的リスクを軽減するため、大規模マルチエージェント AI システムの安全性と安定性を研究する。

161

LSEG Scales Trusted AI with OpenAI Integration

ロンドン証券取引グループ(LSEG)は、ChatGPT EnterpriseとOpenAI APIを統合し、製品リリースサイクルを月単位から週単位に加速し、グローバルな従業員の生産性を向上させました。

162

DiffusionGemma: vLLMでネイティブにサポートされた初のDiffusion LLM

vLLMは26Bパラメータの離散拡散言語モデルであるDiffusionGemmaを統合しました。これにより、逐次的な自己回帰デコーディングの代わりにトークンブロックを反復的にデノイズすることで、高スループットかつ低レイテンシな生成が可能になります。

163

Gemini 3.5 Live Translate リリースノート

Google DeepMindは、話し手のイントネーションとピッチを保持しながら、70以上の言語に対してニアリアルタイムの音声対音声翻訳を提供するオーディオモデル、Gemini 3.5 Live Translateをリリースしました。

164

Gemma 4 12B リリースノート / 新機能

Google DeepMindは、16GBのRAMを搭載したラップトップでのローカル実行向けに設計されたエンコーダーフリーのマルチモーダルモデルであるGemma 4 12Bをリリースしました。ネイティブなオーディオおよびビジョン処理を特徴としています。

165

Google DeepMind アクセラレータ: ロボティクス プログラム ローンチ

Google DeepMind はヨーロッパでロボティクス アクセラレータを立ち上げ、15社の早期段階のスタートアップを選定し、3か月間の技術サポートと Gemini ロボティクス モデルへのアクセスを提供します。

166

Nextdoor エンジニアリングにおける OpenAI Codex の統合

Nextdoor は OpenAI Codex と GPT-5.5 を活用し、個々のエンジニアによるエンドツーエンド製品所有を可能にし、エンジニアリングのボトルネックを実装から戦略的計画へとシフトさせています。

167

Hugging Face Spaces agents.md が自動3Dマルチメディアパイプラインを可能にする

コーディングエージェントが、既存の2つのSpace(画像生成用と単一画像3D再構成用)を連鎖させることで、パリの記念碑を3D Gaussian splatとして紹介する静的なHugging Face Spaceを自動的に構築しました。これは、`agents.md`がいかにしてあらゆるSpaceをマルチメディアパイプラインのための構成可能なビルディングブロックに変えるかを示しています。

168

NotionにおけるOpenAI Codexの統合

NotionはOpenAI Codexを使用して機能開発を自動化し、エンジニアとマネージャーが数週間ではなく数時間で本番環境対応のコードをリリースできるようにしています。

169

TITLE: OpenAI インテリジェンス時代の産業政策

SUMMARY: OpenAIは、スーパーインテリジェンスの利益が広く共有されるように、「人第一」の産業政策アイデアのセットを提案し、関連する研究を支援する助成金プログラムを立ち上げました。

170

GitHub CI を Hugging Face Jobs に移行する

Hugging Face は、サーバーレスの Hugging Face Jobs インフラストラクチャで GitHub Actions を実行する方法を導入し、GPU アクセラレーションされた CI を可能にし、CPU ジョブのランタイムを最大 30% 削減します。

171

vime RL フレームワーク リリース

vLLMは、MegatronトレーニングとvLLM推論を統合し、LLM強化学習のための安定かつ効率的なパイプラインを提供するオープンソースのRLポストトレーニングフレームワークであるvimeを発表しました。

172

OpenAI 機密 S-1 提出

OpenAIはSECに機密のドラフト S-1を提出し、特定の目的を達成するために非公開のまま公開会社になるオプションを提供しています。

173

Google DeepMind ガイドラーニング AI トライアル シエラレオネ

シエラレオネでの事前に登録されたトライアルは、AI を活用したガイドラーニングが教師主導の拡張ツールとして使用される場合、8 週間で通常の学習の最大 2.5 年分に相当する数学の進歩を加速できることを示している。

174

OpenAIのAGIの分配と開発のための戦略計画

OpenAIは、自動化されたAI研究、経済の加速、そして地球上のすべての人にパーソナルAGIを提供することに焦点を当てることで、AGIが人類全体に利益をもたらすことを確保する戦略計画を発表しました。

175

OpenEnv: オープンソースAIのためのエージェンティックRL環境の標準化

Hugging FaceはOpenEnvをコミュニティ調整プロジェクトに移行し、エージェンティック強化学習環境の相互運用性レイヤーとして機能させました。

176

OpenAI経済研究交流の立ち上げ

OpenAIは、外部研究者がOpenAIのツールとデータセットにアクセスし、AIの経済的影響に関する独立した実証的証拠を生み出すことができるように、Economic Research Exchangeを立ち上げました。

177

vLLM Semantic Router v0.3 Themis リリースノート

vLLM Semantic Router v0.3 Themisは、Session-Aware Agentic Routing (SAAR)、標準的な設定コントラクト、およびAMD ROCmとIntel OpenVINOへの拡張されたハードウェアサポートを特徴とする、ステートフルなプロダクション・ルーティングを導入します。

178

NVIDIA Nemotron 3.5 Content Safety リリース

NVIDIAは、企業向けAI向けに、カスタムポリシーの適用とオプションの推論トレースを備えた、4Bパラメータのマルチモーダル・多言語安全性モデルである Nemotron 3.5 Content Safety をリリースしました。

179

Endava AI 統合: OpenAI エージェントでソフトウェアデリバリーを再設計

Endava は、11,000 人規模の workforce 全体に OpenAI テクノロジーを統合し、ソフトウェアデリバリーとオペレーションワークフローを再設計し、AI を生産性ツールからコアオペレーションモデルへシフトさせました。

180

ChatGPT Dreaming Memory Update

OpenAIは、ChatGPTがユーザーのコンテキスト、好み、および時間経過とともに変化する情報を合成、更新、想起する方法を改善するため、'dreaming'に基づいた、より高性能で計算効率の高いメモリ・アーキテクチャをリリースしました。

181

タイトル: OpenAI インテリジェンス時代のバイオディフェンス アクションプラン

サマリー: OpenAIは、責任ある防御者に先進的AI能力を備えさせることでバイオレジリエンスを向上させるバイオディフェンスアクションプランを立ち上げました。具体的にはGPT-Rosalindモデルを利用しています。

182

Hugging Face hf CLI のエージェント最適化設計により、トークン使用量を削減し成功率を向上

Hugging Face は、hf CLI のエージェント向け再設計を発表しました。これにより、Claude Code や Codex のようなコーディングエージェントにおいて、トークン使用量を最大 6 分の 1 に削減し、成功率を向上させることが可能になります。

183

NVIDIA Nemotron 3 Ultra Support on vLLM

vLLM は、ハイブリッド Transformer-Mamba MoE アーキテクチャを通じて長時間実行される自律エージェント ワークフローに最適化された 550B パラメータ モデルである NVIDIA Nemotron 3 Ultra の Day-0 サポートを発表しました。

184

GPT-Rosalind アップデート:ライフサイエンス機能と研究ツールの強化

OpenAI は GPT-Rosalind をアップデートし、エンタープライズ規模のライフサイエンス研究に向けて、GPT-5.5 のエージェント機能と創薬化学、ゲノミクス、ウェットラボのトラブルシューティングにおける専門的なインテリジェンスを統合しました。

185

チャットボットを超える直接的好み最適化

提供されたソース資料は、Hugging Faceの429レートリミットエラーページであり、Direct Preference Optimizationに関する技術的内容は含まれていません。

186

# WasmerがCodexを使ってエッジ向けNode.jsランタイムを構築した方法

WasmerはOpenAIのCodexを利用して、WebAssemblyサンドボックス内でNode.jsワークロードを実行できるJavaScriptランタイムEdge.jsを開発し、開発期間を推定1年から2週間に短縮しました。

187

OpenAI フロンティア AI の民主的ガバナンスのためのブループリント

OpenAI は、国家標準化、CAISI の強化、および政府全体のレジリエンス計画を通じて、ますます能力の高い AI システムを統治するための三部構成の連邦枠組みを提案するブループリントをリリースしました。

188

OpenAI 公共政策アジェンダ

2026年6月3日、OpenAIは、安全性、ユースの保護、教育、労働力の移行、ディープフェイク、およびAIインフラにわたるミッション、原則、および政策の優先事項を概説した公共政策アジェンダを公開しました。

189

Hugging Face レートリミットにより 'Adding MCP Tools to Reachy Mini' 投稿へのアクセスがブロックされました

Hugging Face のリンク 'Adding MCP Tools to Reachy Mini' のブログ投稿は 429 レートリミット エラーを返すため、要約できるコンテンツはありません。

190

高速かつ効率的 LLM 推論 with vLLM コース ローンチ

vLLMはDeepLearning.AIおよびRed Hatと協力し、無料の中級コース「Fast & Efficient LLM 推論 with vLLM」を立ち上げ、AIデプロイメントのフルライフサイクルを教える。

191

TITLE: Holo3.1: 高速かつローカルなコンピュータ使用エージェント

SUMMARY: Holo3.1 の提供されたソース素材は、429 レートリミットエラーにより利用できず、技術的な詳細は提供されませんでした。

192

TravelersはOpenAIを使ってAI搭載型請求アシスタントを導入

Travelersは、OpenAIのRealtime APIを活用した全国規模のAI請求アシスタントを導入し、自動車財産損害請求の最初の通知を自動化しました。これにより、ユーザーの85-90%が自律的に請求手続きを完了できるようになります。

193

ChatGPT Sites: Codex を使用した内部ページと軽量アプリの作成

OpenAI は ChatGPT Sites を導入しました。これは、Codex デスクトップ アプリから直接内部ウェブサイトと軽量インタラクティブ アプリを作成、デプロイ、共有できる機能です。

194

Codexはすべての役割、ツール、ワークフロー向け

OpenAIは、役割固有のプラグイン、インタラクティブなSites、およびインプレースアノテーションをCodexに発表し、開発者を超えてアナリスト、マーケター、セールス、投資家、バンカーにも利用を広げました。

195

OpenAI ユース AI 安全提案とグローバル リーダーシップ イニシアティブ

OpenAI は、国際的なユース AI 安全研究所の設立と、G7 首脳会議で議論される年齢に適した AI 保護のための 9 ポイント フレームワークを提案しました。

196

OpenAI Codex のナレッジワークへの拡張

OpenAI は、Codex が週アクティブユーザー 500 万人に達したと報告しています。知識労働者は現在ユーザーベースの 20% を占めており、開発者の 3 倍の速度で成長しています。

197

vLLM セッション認識エージェントルーティング (SAAR) リリース

vLLM は、ツールループやプロバイダー状態遷移中の安全でないモデル切り替えを防ぐことで、長時間範囲の LLM エージェントのセッション継続性を保ち、コストを削減するモデル選択ポリシーである Session-Aware Agentic Routing (SAAR) を導入します。

198

vLLM-Omni が AutoRound 量子化で推論を加速

vLLM-Omni は Intel の AutoRound 事後学習量子化を統合し、モデルサイズを最大 62% 短縮しつつ精度を維持し、Intel XPU と NVIDIA GPU での性能向上を実現する W4A16 量子化を可能にしました。

199

OpenAI ポリシーと政治的アドボカシーの立場

OpenAIは、政治活動委員会(PLAINTEXT: OpenAIは、政治活動委員会(PAC)や候補者への資金提供を行っていないことを明確にし、AI政策は単一の組織ではなく、幅広いステークホルダーの連合によって形成されるべきだと主張しています。

200

JetBrains Mellum2 リリース

JetBrainsは12B Mixture-of-Experts (MoE) モデルであるMellum2のリリースを発表しましたが、提供されたソース資料はエラーページであり、技術的な詳細は含まれていません。