OpenAI Stargate Community プログラム発表
OpenAIはStargate Communityプログラムを発表し、エネルギーを自社で資金調達し、水使用を最小限に抑え、地域の雇用を創出することを約束し、2029年までに10 GWの目標に向けてAIインフラを拡大していきます。
DeepSeek Moment から 1 年: 中国のオープンソース AI エコシステムの台頭
Hugging Face は、DeepSeek R1 のリリースが中国におけるオープンソース AI への大きな転換を促し、現在グローバルなダウンロード指標を支配する高性能オープン モデルの急増をもたらしたと分析しています。
ServiceNow と OpenAI の実用的エンタープライズ AI パートナーシップ
ServiceNow は OpenAI と提携し、GPT-5.2 とマルチモーダル機能を AI プラットフォームに統合しました。これにより、エンタープライズは IT、財務、HR の複雑なワークフローを自動化できるようになります。
Differential Transformer V2 ソース利用不可
Hugging Face のウェブサイトからの 429 Too Many Requests エラーにより、Differential Transformer V2 のソースコンテンツが利用できません。
ChatGPT 用 OpenAI 年齢予測
OpenAI は、ChatGPT コンシューマープランに年齢予測モデルを導入し、18 歳未満である可能性が高いユーザーに自動的にティーン向け安全対策を適用しています。
Waypoint-1: Overworld のリアルタイムインタラクティブ動画拡散
Overworld は Waypoint-1 をリリースしました。これは 10,000 時間のゲーム映像で学習されたリアルタイムインタラクティブ動画拡散モデルで、テキスト、マウス、キーボードによるゼロレイテンシの世界操作を可能にします。
OpenAIのビジネスモデルとコンピュートスケーリング戦略
OpenAIは、インテリジェンスの価値に比例してスケールするビジネスモデルを実装し、2023年から2025年にかけて多様化されたコンピュートポートフォリオとマルチティアの収益化により、収益を10倍に増加させました。
D4RT: 動的4D再構成とトラッキング
Google DeepMindは、従来の方法に比べて最大300倍効率的な4Dシーン再構成およびトラッキングのための統合AIモデルであるD4RTを発表しました。
ChatGPT Go グローバルリリース
OpenAIは、米国で月額8ドルの低価格サブスクリプションプランであるChatGPT Goを、すべての利用可能な市場に拡大し、GPT-5.2 Instantへのグローバルアクセスを向上させました。
OpenAI広告戦略とChatGPT Goの拡張
OpenAIは、月額8ドルのChatGPT Goプランを米国およびすべての利用可能な市場に拡張し、無料およびGoプランで広告のテストを開始し、AIのアクセシビリティを向上させます。
OpenAIのMerge Labsへの投資
OpenAIは、種ラウンドでMerge Labsに参加しています。Merge Labsは、生体知能と人工知能を橋渡しする高帯域脳-コンピュータインターフェース(BCI)を開発する研究ラボです。
OpenAI、国内製造を通じて米国のAIサプライチェーンを強化するイニシアティブ
OpenAIは、データセンターハードウェア、コンシューマーエレクトロニクス、ロボティクスを含む重要なAIインフラストラクチャコンポーネントの米国ベースの製造を特定し、可能にするため、提案募集(RFP)を開始しました。
Hugging Face Open Responses 推論標準
Hugging Face は、エージェント型 AI ワークフロー向けに Chat Completion 形式に代わることを目的とした、Responses API に基づくオープンな推論標準である Open Responses を導入しました。
OpenAI と Cerebras の低レイテンシ推論におけるパートナーシップ
OpenAI は、AI モデルの応答を高速化し、リアルタイムの AI インタラクションを可能にするため、目的別に構築された AI システムを推論スタックに統合するために Cerebras と提携しています。
Veo 3.1 リリースノート:強化された Ingredients to Video と 4K アップスケーリング
Google DeepMind は Veo 3.1 をリリースし、画像から動画への生成におけるアイデンティティとオブジェクトの一貫性の向上、ネイティブな縦動画サポート、1080p および 4K 解像度へのアップスケーリングを導入しました。
Zenken ケーススタディ:ChatGPT Enterpriseで販売とオペレーションを拡大
ZenkenはChatGPT Enterpriseを導入して知識業務を自動化し、年間アウトソーシングコストを5,000万円削減し、最終提案承認率を30%向上させました。
情報駆動型イメージングシステム設計
BAIR の研究者は、相互情報量を用いてイメージングシステムを評価・最適化するフレームワークを開発し、タスク固有のデコーダを必要とせずに高性能なハードウェア設計を可能にしました。
OpenAI とソフトバンクグループの SB Energy とのパートナーシップ
OpenAI とソフトバンクグループはそれぞれ 5 億ドルを SB Energy に投資し、AI データセンターキャンパスとエネルギーインフラの開発を加速させます。その中にはテキサス州ミラム郡の 1.2 GW サイトも含まれます。
Datadog、システムレベルのコードレビューにOpenAI Codexを統合
DatadogはOpenAI Codexを1,000人以上のエンジニアに展開し、コードレビューにおけるシステム的リスクやサービス間依存関係を特定し、人間のレビュアーが見逃した過去のインシデントの22%を検出することに成功しました。
OpenAI for Healthcare リリース
OpenAIは、ChatGPT for Healthcare と OpenAI API を含む HIPAA 準拠ツールのスイート「OpenAI for Healthcare」を開始し、臨床医の管理業務負担を軽減し、ケアの一貫性を向上させます。
Netomiによるエージェンティック・システムのエンタープライズ展開 – OpenAIからの教訓
Netomiは、低レイテンシのツール利用のためのGPT‑4.1と、深いマルチステップの計画のためのGPT‑5.2を組み合わせた、プロダクショングレードのエージェンティック・プラットフォームを発表しました。3秒未満のレスポンス、98%の意図精度、およびエンタープライズ規模での組み込みガバナンスを実現しています。
Qwen3-VL-Embedding と Qwen3-VL-Reranker のリリース
Qwen は、テキスト、画像、スクリーンショット、動画を横断した高精度なクロスモーダル検索を実現するマルチモーダルモデルシリーズである Qwen3-VL-Embedding と Qwen3-VL-Reranker をリリースしました。
GPT-5.1を使ったTolanのVoice-First AIの構築方法
TolanはGPT-5.1とカスタムリアルタイムコンテキスト管理システムを使用して、低遅延で声優先のAIコンパニオンを作り出し、持続的なメモリと一貫したパーソナリティを実現しています。
ChatGPT Health リリースノート
OpenAI は、個人の医療記録やウェルネスアプリデータを統合し、臨床ケアに代わるものではなく、健康情報のナビゲーションを支援する安全な専用エクスペリエンス「ChatGPT Health」を導入しました。
NVIDIA Cosmos Reason 2 リリースノート / 新機能
NVIDIAは、物理AI向けに設計されたオープンリasoningビジョン・ランゲージモデルであるCosmos Reason 2をリリースしました。このモデルはPhysical AI BenchおよびPhysical Reasoningのリーダーボードでトップに位置しています。
Falcon-H1-Arabic リリースノート
Hugging Faceは、Falcon-H1-Arabicを発表しました。この3つのハイブリッド Mamba-Transformer モデル(3B、7B、34B)は、コンテキストウィンドウを最大256Kトークンに拡張し、アラビア語NLPの新たな最先端ベンチマークを樹立します。
NVIDIA DGX Spark と Reachy Mini 統合ガイド
NVIDIAは、オープンな推論およびビジョンモデルを使用し、DGX Spark ハードウェア、Reachy Mini ロボット、および NeMo Agent Toolkit を組み合わせることで、現実世界の AI エージェントを作成するためのフレームワークを発表しました。
OpenAI Grove 第2コホート発表
OpenAIは、AI駆動型企業の構築を支援するプレアイデアの技術者向けに設計されたプログラムであるOpenAI Groveの第2コホートの応募受付を開始しました。
Qwen-Image-2512 リリースノート / 新機能
Qwen-Image-2512 は、Qwen-Image テキストから画像へのモデルに対する 12 月のアップデートであり、人間のリアリズム、自然なディテールの描写、そして複雑なテキストレイアウトの精度を大幅に向上させます。
Google DeepMind 2025 Year-in-Review: Gemini 3, Gemma, AI Products, Science, and Safety Breakthroughs
Google DeepMindは、Gemini 3モデル、オープンソースのGemma、AI駆動型製品、生成メディア、科学的AI、量子コンピューティング、安全性フレームワーク、およびグローバルなコラボレーションにわたる2025年の画期的な成果を発表し、AIがツールからユーティリティへと移行していることを示しました。
AprielGuard: 現代LLMシステムにおける安全性と敵対的ロバスト性のためのガードレール
Hugging Face と ServiceNow AI は AprielGuard を発表しました。これは 8B パラメータのセーフガードモデルで、単独プロンプト、マルチターン会話、エージェントワークフロー全体にわたり、16 種類の安全リスクと幅広い敵対的攻撃を検出するよう設計されています。
Qwen-Image-Edit-2511 リリースノート
Qwen-Image-Edit-2511 は、キャラクターの一貫性を向上させ、コミュニティ LoRA を統合し、幾何学的推論と工業デザイン機能を強化した更新された画像編集モデルです。
Qwen3-TTS-VD-Flash と Qwen3-TTS-VC-Flash のリリース:制御可能な音声デザインと高速多言語音声クローン
Qwen は自然言語による音声デザイン用の Qwen3‑TTS‑VD‑Flash と、3 秒で多言語音声クローンを実現する Qwen3‑TTS‑VC‑Flash をリリースし、どちらも制御性と精度において主要な TTS システムを上回っています。
ChatGPT Atlas: プロンプトインジェクションに対するブラウザーエージェントのハードニング
OpenAIは、RL訓練された自動攻撃者を使用して、野外で悪用される前にChatGPT Atlasのプロンプトインジェクションの脆弱性を発見および緩和するためのプロアクティブな高速応答ループを実装しました。
OpenAI の顧客成長と企業導入
OpenAI は 100 万社以上のビジネス顧客を超え、ユーザーの 75% が以前は不可能だったタスクを完了できるようになったと報告しています。
Qwen-Image-Layered: 本質的な編集可能性のための階層的分解
Qwen-Image-Layered は、画像を複数の RGBA レイヤーに分解し、他のコンテンツに影響を与えることなく画像コンポーネントを個別に操作できる新しいモデルです。
OpenAI の思考連鎖モニタビリティ評価
OpenAI は、モデルの内部推論から行動を予測する能力である「モニタビリティ」を測定するためのフレームワークと13の評価を導入し、思考連鎖をモニタリングすることが出力だけをモニタリングするよりもはるかに効果的であることを発見しました。
OpenAI Model Spec アップデート: 18歳未満 (U18) 原則
OpenAIは、Model SpecにUnder-18 (U18) 原則を含めるよう更新し、13歳から17歳のユーザーに対してティーンセーフティと実際の世界でのサポートを優先するChatGPT向けの年齢に適した行動ガイドラインを確立しました。
OpenAI AIリテラシー リソース ティーンズと保護者向け
OpenAIは、家族向けガイドと保護者特化のヒントを含むAIリテラシー リソースのセットをリリースし、家族がChatGPTを安全かつ責任を持って利用できるよう支援します。
OpenAIと米国エネルギー省がAIコラボレーションを拡大
OpenAIと米国エネルギー省は、フロンティアAIモデルを科学研究に統合するため、覚書(MOU)に署名しました。具体的には、ジェネシスミッションおよび国立研究所のイニシアティブを支援します。
Transformers v5 トークナイゼーション更新
Hugging Face は Transformers v5 のトークナイゼーションを再設計し、トークナイザのアーキテクチャと学習済み語彙を分離しました。これにより、検査やカスタマイズ、スクラッチからのトレーニングが容易になります。
GPT-5.2-Codex リリースノート
OpenAIは、複雑なソフトウェアエンジニアリング、長期タスク、そして高度なサイバーセキュリティ研究に最適化されたエージェント型コーディングモデル、GPT-5.2-Codexをリリースしました。
OpenAI GPT-5.2-Codex システムカード付録
OpenAIは、複雑なソフトウェアエンジニアリング、プロジェクト規模のリファクタリング、サイバーセキュリティタスクに最適化されたエージェント型コーディングモデルであるGPT-5.2-Codexをリリースしました。
NVIDIA Nemotron 3 Nano のオープン評価レシピ(NeMo Evaluator)
NVIDIA は 300 億パラメータの Nemotron 3 Nano モデルを、NeMo Evaluator 上に構築された完全にオープンな評価レシピと共にリリースしました。これにより、誰でもベンチマークスコアを再現し、評価パイプライン全体を監査できるようになります。
Gemini 3 Flash リリースノート / 新機能
Google DeepMindは、開発者と消費者に低レイテンシとコスト削減を提供しながら、フロンティアレベルの推論とマルチモーダルインテリジェンスを組み合わせたモデルであるGemini 3 Flashをリリースしました。
OpenAI ニュース機関向けアカデミー ローンチ
OpenAIは、ジャーナリストにトレーニング、プレイブック、そしてAIの責任ある導入に関するガイダンスを提供し、報道およびビジネスオペレーションを強化するため、OpenAI Academy for News Organizationsを立ち上げました。
OpenAI、ChatGPT向けアプリ提出とディレクトリを導入
OpenAIはアプリディレクトリとベータ版Apps SDKを開始し、開発者がChatGPT内でチャットネイティブな体験を構築、提出、収益化できるようにしました。
エンタープライズ AI 2025 年の状況 レポート
OpenAI の 2025 年レポートは、エンタープライズ AI の導入が急速に拡大していることを明らかにしており、ChatGPT のメッセージ量は年比で 8 倍、API の推論トークン消費量は年比で 320 倍増加しています。
Gemma Scope 2 リリース – Gemma 3 言語モデルを解釈するためのオープンツール
Gemma Scope 2 は、Gemma 3 モデル(270M‑27B パラメータ)向けのオープンソースの解釈可能性ツールスイートで、研究者が内部計算を追跡し、安全に関わる重要な挙動をデバッグできるようにします。
OpenAI FrontierScience ベンチマーク リリース
OpenAIは、物理、化学、生物学の分野における複雑な科学的推論および実際の研究タスクを実行するAIの能力を測定するために設計された、新しいエキスパートレベルのベンチマークであるFrontierScienceを発表しました。