SandboxAQ SAIR データセットリリース
SandboxAQは、実験的に測定されたIC50ラベルとペアになった共折りたたみ3Dタンパク質‑リガンド構造の最大規模データセットであるSAIRをリリースしました。5百万以上のAI生成構造を提供し、AI駆動の創薬を加速します。
OpenAI、Statsigを買収し、Vijaye RajiをApplications部門のCTOに任命
OpenAIは実験プラットフォームのStatsigを買収し、創業者兼CEOのVijaye RajiをApplications部門のCTOに任命し、ChatGPTとCodexのプロダクトエンジニアリングを統括します。
OpenAI、ChatGPTの安全性とウェルビーイングに関する取り組みを更新
OpenAIは、医療専門家ネットワークの指導のもと、ChatGPTのメンタルヘルス危機への対応を改善し、ティーンエイジャー向けのペアレンタルコントロールを導入するための120日間の取り組みを実施しています。
Hugging Face ZeroGPU 事前コンパイルガイド
Hugging Face は ZeroGPU Spaces 向けに事前コンパイル(AoT)を導入し、Flux、Wan、LTX などの生成モデルで 1.3x〜1.8x の速度向上を実現し、ジャストインタイムコンパイルのオーバーヘッドを排除します。
word2vecが学習すること: 特徴学習の閉形式理論
BAIR の研究者は、word2vec の学習が重みなし最小二乗行列因子分解に還元されることを証明する予測的理論を構築し、学習された表現が特定のターゲット行列に対する主成分分析(PCA)の結果であることを示しました。
OpenAI gpt-realtime と Realtime API の一般提供開始
OpenAI は高性能音声‑to‑音声モデル `gpt-realtime` をリリースし、画像入力、リモート MCP サーバー、SIP 電話呼び出しをサポートした Realtime API を一般提供開始しました。
OpenAI 非営利団体およびコミュニティイノベーション基金の支援
OpenAIは、米国拠点の501(c)(3)非営利団体およびコミュニティ組織に対し、公共の利益のためのAI主導のイノベーションを促進する無制限の助成金を提供する5,000万ドルの基金の応募を開始します。
OpenAI 集団アラインメントとモデル仕様の更新
OpenAI は、1,000 人以上の世界中の参加者からの公共の好みを Model Spec に統合する集団アラインメント研究を開始し、AI のデフォルト挙動が多様な人間価値を反映することを目指しています。
OpenAI と Anthropic の共同安全性評価結果
OpenAI と Anthropic は共同安全性評価結果を発表し、Claude 4 モデルが指示階層で優れている一方、OpenAI の推論モデルがジャイルブレイク耐性でリードしていることを示し、両ラボは AI アラインメントにおけるラボ間協力の価値を強調しています。
OpenAI メンタルヘルスと危機介入の安全策
OpenAI は、ChatGPT におけるメンタルヘルス危機管理のための多層的な安全スタックを詳細に示し、GPT-5 の応答精度向上と直接的な緊急サービス統合計画を発表しました。
OpenAI Learning Accelerator インドローンチ
OpenAIは、戦略的な機関パートナーシップを通じて、インドでLearning Acceleratorを開始し、AI研究、トレーニング、そしてChatGPTライセンスを数百万の教育者と学生に提供します。
OpenAI と Retro Biosciences: GPT-4b micro でライフサイエンスを加速
OpenAI と Retro Biosciences は、Yamanaka 因子を再設計し、野生型対照に比べて 50 倍以上の幹細胞再プログラミング発現を実現した、特殊なタンパク質工学モデル GPT-4b micro を開発しました。
Blue J が GPT-4.1 で税務リサーチをスケール
Blue J は GPT-4.1 と独自の RAG システムを活用し、米国、カナダ、英国にわたる複雑な税務リサーチを自動化し、不同意率を 700 件中 1 件未満に削減しています。
NVIDIA Nemotron ポストトレーニングデータセット v2 と Nemotron Nano 2 9B リリース
NVIDIAは、600万サンプルの多言語推論データセットと、ハイブリッドTransformer-Mambaアーキテクチャを活用して推論コストとスループットを最適化するNemotron Nano 2 9Bモデルをリリースしました。
MIXI ChatGPT Enterprise デプロイメント
MIXIは組織全体にChatGPT Enterpriseを45日で導入し、いくつかのプロジェクトで作業時間を90%以上削減し、従業員が1,600以上のカスタムGPTを作成できるようにしました。
Claude と Hugging Face で画像を生成する
Hugging Face は、Model Context Protocol(MCP)サーバーを介して AI を Hugging Face Spaces に接続することで、Claude 内で画像生成を可能にします。
Qwen-Image-Edit リリースノート
Qwen-Image-Edit は、20B パラメータの画像編集モデルで、Qwen2.5-VL と VAE Encoder を活用し、正確なセマンティック編集と外観編集、さらにはバイリンガルテキストの修正を可能にします。
研究のための Hugging Face MCP: AI と研究ツールをつなぐ
Hugging Face は Research Tracker MCP を導入し、AI エージェントが Model Context Protocol を通じて arXiv、GitHub、Hugging Face を統合し、研究の発見を自動化できるようにします。
Hugging Face kernel-builder: プロダクション対応 CUDA カーネルの構築とスケーリングガイド
Hugging Face は、プロダクション対応 CUDA カーネルの開発、マルチアーキテクチャコンパイル、そして Hugging Face Hub を通じた配布を簡素化する kernel-builder ライブラリを導入しました。
DoorDash AI 実装戦略
DoorDash は AI を活用して、エンジニアでない人々にも技術的創造を民主化し、従業員の成長とパフォーマンス管理をパーソナライズしています。
Kimina-Prover-RL リリース
Hugging Faceは、Lean 4における形式的な定理証明のためのオープンソースRLトレーニングパイプライン、および2つのSOTAモデル(0.6Bおよび1.7B)をリリースしました。
Arm と ExecuTorch 0.7: 生成AI を何十億台のデバイスへ拡大
Arm と ExecuTorch 0.7 ベータは、KleidiAI による自動 AI アクセラレーションを実現し、SDOT 命令を活用して Llama 3.2 などの LLM を何十億台もの既存 Arm ベースデバイスへ提供します。
Arm Neural Super Sampling (NSS) リリース
Arm は Neural Super Sampling (NSS) をリリースしました。これは GPU の負荷を軽減し、モバイルデバイスで高解像度レンダリングを可能にする AI 搭載のアップスケーリングソリューションです。
FilBench: フィリピン語におけるLLMの能力評価
Hugging Faceは、タガログ語、フィリピン語、セブアノ語におけるLLMの流暢さ、言語能力、文化的知識を評価するために設計された包括的な評価スイート、FilBenchを導入しました。
TextQuests: テキストベースのビデオゲームにおけるLLMエージェント的推論の評価
Hugging Faceは、25本のクラシックなInfocomインタラクティブフィクションゲームを使用したベンチマーク「TextQuests」を導入し、LLMエージェントの長文コンテキスト推論能力と探索能力を評価します。
BasisがOpenAI GPT-5とo3で会計自動化を拡大
BasisはOpenAIのGPT-5、GPT-4.1、o3モデルを活用したマルチエージェントアーキテクチャを用いて、複雑な会計ワークフローを自動化し、会計事務所の時間を最大30%削減しています。
カリフォルニア州におけるAI規制の調和に関するOpenAI提案
OpenAIは、イノベーションと米国の競争力を阻害する可能性のある州ごとの規則のパッチワークを防ぐため、カリフォルニア州のAI規制を国内外の基準に合わせるよう、ギャビン・ニューサム知事に要請しました。
Hugging Face AI Sheets リリース
Hugging Face は、オープンソースのノーコードツールである AI Sheets をリリースしました。このツールは、オープンAIモデルを使用してデータセットを構築、変換、強化するためのものです。
Accelerate ND-Parallel: 効率的なマルチGPU訓練ガイド
Hugging FaceはAccelerateとAxolotlにND-Parallelismを統合し、ユーザーがデータ並列、完全分割データ並列、テンソル並列、コンテキスト並列の各戦略を組み合わせて、大規模モデルのマルチGPU訓練を最適化できるようにしました。
OpenAI GPT-5 リリースノート
OpenAI は、推論、エージェント、そして高度な数学機能を統合した統一モデル GPT-5 をリリースし、ビジネスオペレーションにおける精度、速度、問題解決能力を向上させました。
開発者向け GPT-5 リリースノート
OpenAI は GPT-5 を 3 つのサイズ(gpt-5、gpt-5-mini、gpt-5-nano)でリリースし、コーディング、エージェント的ツール呼び出し、長文コンテキスト検索において最先端の性能を提供します。
GPT-5 のコーディングとデザイン機能
OpenAI は、コーディングとデザイン向けの機能強化に焦点を当てた GPT-5 を発表しましたが、発表では具体的な技術的詳細は提供されていません。
OpenAI GPT-5 クリエイティブ・ライティング機能
OpenAIはGPT-5の新しいクリエイティブ・ライティング機能を発表し、モデルが高品質な物語や芸術的テキストを生成する能力を拡大しました。
GPT-5 を用いた医療研究
OpenAIはGPT-5を医療研究に適用すると発表し、モデルの専門的な科学領域での有用性を拡大しました。
TRLにおけるVision Language Modelのアライメント
Hugging Faceは、MPO、GRPO、GSPOを含むVision Language Modelsのための高度なアライメント手法、ならびにネイティブなSFTサポートとvLLM統合を含む、TRLライブラリの拡張を行いました。
Cursor における GPT-5 統合
OpenAI は GPT-5 を Cursor コードエディタに統合したことを発表し、AI 搭載のソフトウェア開発機能を強化しました。
OpenAI GPT-5 初見
OpenAIはGPT-5の初見を提供し、同社の大規模言語モデルシリーズの新世代を示しました。
AmgenがGPT-5を活用する方法
AmgenはOpenAI APIを通じてGPT-5を活用し、バイオテクノロジー研究と医薬品開発プロセスを加速させています。
OpenAI GPT-5 システムカード
OpenAI は GPT-5 をリリースしました。これはリアルタイムルーターを備えた統合システムで、クエリの複雑さに応じて高速・高スループットモデルと深い推論モデルを動的に切り替えます。
GPT-5 セーフコンプリーション: 拒否ベースから出力中心の安全トレーニングへの移行
OpenAIはGPT-5向けにセーフコンプリーションを導入しました。この安全トレーニング手法は有用性を最大化しつつ安全でない出力にペナルティを課し、二元的な「従うか拒否するか」のトレードオフをデュアルユースプロンプトに対して削減します。
OpenAI GPT-5 リリースノート
OpenAIは、高速モデルと深層推論モデルの間を切り替えるリアルタイムルーターを備えた統合AIシステムであるGPT-5をリリースし、コーディング、数学、ヘルスの分野でエキスパートレベルのインテリジェンスを提供します。
OpenAI と GSA のパートナーシップ:米国連邦労働力向け ChatGPT Enterprise
OpenAI は、米国連邦行政部門全体の労働力に対し、1 年間、1 代理店あたり 1 ドルという名目上の料金で ChatGPT Enterprise を提供し、行政負担の軽減と公共サービスの提供向上を図ります。
OpenAI がオープンウェイト LLM の最悪ケースフロンティアリスクを推定
OpenAI は、悪意あるファインチューニング(MFT)を用いて gpt-oss の生物学およびサイバーセキュリティにおける最大能力を引き出すことでリスクを評価し、既存のオープンウェイトモデルと比較してリスクのフロンティアを実質的に前進させていないことを確認しました。
OpenAI gpt-oss-120b と gpt-oss-20b のリリース
OpenAI は、エージェントワークフロー向けに設計され、カスタマイズ可能な推論努力を提供する、Apache 2.0 ライセンスの下で公開された 2 つのオープンウェイト推論モデル、gpt-oss-120b と gpt-oss-20b をリリースしました。
OpenAI gpt-oss リリースノート
OpenAIは、Apache 2.0ライセンスのもとで提供されるオープンウェイトの推論モデルであるgpt-oss-120bとgpt-oss-20bをリリースしました。これらは、消費者向けハードウェアに最適化された最先端レベルの推論およびツール使用機能を提供します。
OpenAI オープンウェイトリリース
OpenAIは、最も高性能なオープンウェイト推論モデルをリリースし、AIへのアクセスを民主化し、米国主導の民主的AI標準を世界的に促進します。
NVIDIA AI-Q Blueprint: DeepResearch Benchでトップランクのオープンディープリサーチエージェント
NVIDIAのAI-Q Blueprintは、Hugging Face DeepResearch Benchでオープンライセンススタックのトップに立ち、Llama 3.3-70B Instruct と Llama-3.3-Nemotron-Super-49B-v1.5 の組み合わせを活用しています。
Qwen-Image リリース:ネイティブテキストレンダリングと精密画像編集
Qwen-Image は、最先端の複雑なテキストレンダリングと精密な画像編集機能を提供する 20B MMDiT 画像基盤モデルです。
OpenAI、ユーザーの有用性とウェルビーイングのためにChatGPTを最適化
OpenAIは、滞在時間などのエンゲージメント指標から、実際の有用性とユーザーのウェルビーイングへとChatGPTの最適化目標を転換し、休憩リマインダーや重要な個人的決定への対応改善を導入しています。
3LM: アラビア語LLM向けSTEMとコードのベンチマーク
Hugging Face と TII UAE が 3LM を発表しました。これは、アラビア語大型言語モデルを STEM 分野とコード生成で評価するために設計された、初の包括的ベンチマークです。