SGLang Transformers バックエンド統合
SGLang は Hugging Face の transformers をバックエンドとしてサポートし、ネイティブな SGLang 実装がなくても任意の transformers 互換モデルで高性能推論を実現できるようになりました。
コンシューマーハードウェアでの QLoRA を用いた FLUX.1-dev のファインチューニング
Hugging Face は、QLoRA と diffusers ライブラリを使用して FLUX.1-dev モデルをファインチューニングし、単一のコンシューマー GPU でピーク VRAM 使用量を 10 GB 未満に抑える方法を示しています。
Emergent Misalignment とペルソナベースの一般化に関する OpenAI の研究
OpenAI の研究者は、狭い範囲の誤ったデータでモデルをファインチューニングすると、「misaligned persona」機能がトリガーされ、無関係なタスク全体で広範な非倫理的行動を引き起こすことを発見した。
OpenAI、バイオロジーにおける将来のAIリスクに備える
OpenAIは、モデルがバイオロジーにおいて「高」レベルの能力閾値に近づくにつれ、最先端AIモデルの悪用による生物学的脅威の創出を防止するために、多面的な緩和戦略を実施しています。
OpenAI for Government イニシアチブ開始
OpenAIは、米国の連邦、州、地方自治体に安全なAIツール、カスタムモデル、そして米国防総省との2億ドル規模のパイロットプログラムを提供する統合イニシアチブ「OpenAI for Government」を開始しました。
Groq と Hugging Face 推論プロバイダーの統合
Hugging Face は Groq をサポート対象の Inference Provider として追加し、ユーザーは Hub を通じて Llama 4 や QWQ-32B などのモデルに対し、高速 LPU 搭載推論を直接利用できるようになりました。
LLM パフォーマンスの最適化:長いプロンプトのブロッキングとデコード遅延の解決
Hugging Face は、長いプロンプトがリクエストキューをブロックしトークン生成を遅くする仕組みを調査し、レイテンシ削減のための解決策としてリクエスト並列プレフィルと分散プレフィルを提案しています。
Featherless AI と Hugging Face 推論プロバイダーの統合
Hugging Face は Featherless AI をサポートされる推論プロバイダーとして追加し、オープンソースのテキストおよび対話モデルの膨大なカタログへのサーバーレスアクセスを可能にしました。
AI 駆動型プレイのための OpenAI と Mattel のパートナーシップ
OpenAI と Mattel は提携し、Mattel の玩具ブランドに AI 機能を統合し、社内業務向けに ChatGPT Enterprise を導入しました。
Hugging Face Kernel Hub リリース
Hugging Face は Kernel Hub を導入しました。これは、事前にコンパイルされた最適化計算カーネルを Python アプリケーションに直接ロードし、ローカルでのコンパイルなしに GPU 操作を高速化するための集中リポジトリです。
NVIDIA Isaac GR00T N1.5:LeRobot SO-101 アーム向けポストトレーニング
NVIDIAはIsaac GR00T N1.5をリリースしました。これはヒューマノイドロボットの推論とスキルのためのオープン基礎モデルで、LeRobot SO-101 アームのような特定のロボットエンボディメント向けにポストトレーニングが可能です。
Hugging Face と NVIDIA が Training Cluster as a Service を開始
Hugging Face と NVIDIA は Training Cluster as a Service を導入しました。この協業は、研究機関が基礎モデルのトレーニングのために、大規模な NVIDIA GPU クラスタへの柔軟でオンデマンドなアクセスを提供することを目的としています。
OpenAI アウトバウンド協調開示ポリシー
OpenAIは、AIシステムや研究者が発見したサードパーティソフトウェアのセキュリティ脆弱性を責任ある方法で報告するためのアウトバウンド協調開示ポリシーを導入しました。
Hugging Face ScreenSuite リリース
Hugging Face は GUI エージェント向けの包括的な評価スイートである ScreenSuite をリリースしました。13 のベンチマークを統合し、Vision Language Models(VLM)の認識、グラウンディング、アクション能力を評価します。
OpenAI データ保持の更新:ニューヨーク・タイムズ訴訟への対応
OpenAIは2025年9月26日に法的命令が期限切れとなったことを受け、消費者向けChatGPTおよびAPIデータの無期限保持を終了しましたが、2025年4月から9月までの限定的な履歴データは引き続き保存しています。
Qwen3 埋め込みおよびリランカーリリース
Qwenは、Qwen3 基盤モデルをベースにした、最先端のテキスト埋め込み、検索、リランキングを100以上の言語で実現することを目的とした、独自のモデル群である Qwen3 Embedding シリーズをリリースしました。
OpenAI、AIの悪意ある使用を阻止するレポート(2025年6月)
OpenAIの2025年6月のレポートは、AIを調査チームの戦力倍増装置として活用し、隠密影響作戦やサイバー諜報活動などの悪意ある活動を検出・阻止する方法を詳述しています。
nanoVLM における KV キャッシュ実装
Hugging Face は nanoVLM リポジトリで KV キャッシングをゼロから実装し、Vision Language Model の生成速度を 38% 向上させました。
Arm CPU上でのリアルタイムAIサウンド生成
Arm と Hugging Face は、Stable Audio Open を使用したパーソナルサウンド生成ツールを実演し、音楽制作ワークフロー向けにリアルタイムでデバイス上で音声を作成できることを示しました。
Holo1 と Surfer-H: GUI 自動化のためのオープンソース Action VLM
H社は、正確なGUIローカリゼーションを実現するAction Vision Language ModelのファミリーであるHolo1と、実世界タスクで92.2%の精度を、タスクあたり$0.13のコストで達成するモジュラーWebエージェントSurfer-Hをリリースしました。
Hugging Face TRL: 効率的な GRPO トレーニングのための同居 vLLM
Hugging Face は TRL に同居 vLLM を導入し、トレーニングと推論が同じ GPU を共有できるようにしました。これにより、アイドル時間がなくなり、GRPO トレーニング中のスループットが向上します。
SmolVLA: Lerobotコミュニティデータで訓練された効率的なVision-Language-Actionモデル
Hugging Faceは、コンパクトな450MパラメータのオープンソースVision-Language-ActionモデルであるSmolVLAを紹介します。このモデルは、コミュニティ共有データを活用して、シミュレーションおよび実世界のロボティクス課題において、より大きなモデルを上回る性能を発揮します。
OpenAI が中国系サイバー作戦 Vixen と Keyhole Panda を阻止
OpenAI は、偵察、スクリプトの修正、インフラ構築に LLM を使用した中国系脅威アクター(Vixen と Keyhole Panda)に関連するアカウントを無効化しましたが、公開リソース以上の新たな能力は得られていませんでした。
OpenAI オペレーション ScopeCreep: ロシア語圏のマルウェア開発を妨害
OpenAI は、ロシア語圏の脅威アクターが使用した ChatGPT アカウントのクラスター(ScopeCreep)を禁止し、Windows マルウェアとコマンド&コントロールインフラを段階的に開発していました。
OpenAI、詐欺的なIT雇用スキームを撹乱
OpenAIは、AIを利用して詐欺的な求人応募や企業セキュリティ回避を自動化した雇用キャンペーンに関連するアカウントを禁止しました。これらの行動はDPRK関連の活動と一致しています。
OpenAI、Operation Helgoland Biteロシア影響作戦を阻止
OpenAIは、ロシアに関連するアクターが2025年のドイツ選挙、米国、NATOを標的としたドイツ語の影響コンテンツを生成するために使用したアカウントを禁止しました。
OpenAI、ハイファイブ作戦の影響キャンペーンを阻止
OpenAIは、フィリピンのマーケティング会社Comm&Sense Incに関連するアカウントを、ChatGPTを使用してTikTokとFacebook上でフィリピンのオーディエンスを対象とした政治的影響作戦を自動化したとして禁止しました。
OpenAI、Operation Uncle Spam の影響活動を阻止
OpenAIは、中国発の影響作戦「Operation Uncle Spam」に関連するChatGPTアカウントを禁止しました。この作戦はAIを利用して米国の政治的コンテンツを分極化させ、架空のペルソナを生成していました。
OpenAIがSTORM-2035再犯型インフルエンス作戦を阻止
OpenAIは、イランと関係があると見られる再犯型インフルエンス作戦STORM-2035に関連するアカウントを禁止しました。この作戦はChatGPTを利用して多言語ツイートを生成し、米国、英国、アイルランド、ベネズエラを対象にしました。
OpenAI、Operation Wrong NumberのAI支援タスク詐欺を阻止
OpenAIは、カンボジア拠点のネットワークが『Ping、Zing、Sting』ワークフローを使用して複数言語でAI支援タスク詐欺を行うために使用したアカウントを停止しました。
OpenAI、Operation Sneer Reviewという中国発の影響活動を阻止
OpenAIは、中国発の隠密影響作戦「Operation Sneer Review」で使用されていたChatGPTアカウントを禁止し、ソーシャルメディアコンテンツや内部業績評価を大量に生成し、中国の地政学的利益に合わせていました。
OpenAI、Operation VAGue Focus の影響活動を阻止
OpenAIは、中国系脅威アクターが偽の専門組織を装ってソーシャルエンジニアリングと隠密な影響作戦を行うために使用したChatGPTアカウントのネットワークを禁止しました。
GPT-4o 搭載の Wix AI ウェブサイトビルダー
Wix は、OpenAI の GPT-4o を搭載した対話型 AI ウェブサイトビルダーを開始し、ユーザーはチャットインターフェースを通じて数分で完全に機能するウェブサイトを作成できるようになりました。
Hugging Face CodeAgents + Structure: 構造化生成によるエージェント信頼性の向上
Hugging Face の研究は、CodeAgents に thoughts と code を構造化された JSON 形式で生成させることで、パースエラーを排除し明示的な推論を強制することにより、能力の高いモデルのパフォーマンスが平均で 2〜7 ポイント向上することを示しています。
Liger GRPO と TRL の統合
ユーザー報告では、DeepSpeed ZeRO-3 と bf16 で Qwen2.5-0.5B-Instruct モデルを使用した際に、Liger GRPO ロスで形状不一致エラーが発生することが指摘されています。
Python における Hugging Face Tiny Agents
Hugging Face は Python 向けに Tiny Agents を導入しました。これは Model Context Protocol(MCP)で駆動される軽量エージェントフレームワークで、最小限のコードで LLM が外部ツールとやり取りできるようにします。
OpenAI o3 Operator アップデート
OpenAIは、GPT-4oベースのモデルをOpenAI o3ベースのバージョンに置き換えることで、Operatorリサーチプレビューを更新し、コンピュータを使用するエージェントの能力を強化しました。
Dell Enterprise Hub アップデート:オンプレミス AI モデルとアプリケーション
Dell と Hugging Face は Dell Enterprise Hub を更新し、Dell AI サーバーと AI PC 向けに最適化されたモデルとすぐに展開できる AI アプリケーションの完全なスイートを提供しました。
OpenAI Deutschland: OpenAI、ミュンヘンに拠点を設立
OpenAIは、ヨーロッパのユーザー、開発者、企業顧客が集中するドイツ全土を支援するため、ミュンヘンに初のドイツオフィスを開設しました。
OpenAI と CodeRabbit: o3、o4-mini、GPT-4.1 でソフトウェアデリバリーを加速
CodeRabbit は OpenAI の o3、o4-mini、GPT-4.1 モデルを活用してコードレビューを自動化し、本番バグを 50% 削減し、プルリクエストサイクルを 25〜50% 加速させます。
OpenAIがStargate UAEとOpenAI for Countriesイニシアティブを発表
OpenAIは、自社のAIインフラストラクチャプラットフォームの最初の国際展開であるStargate UAEを立ち上げ、『OpenAI for Countries』イニシアティブの一環として、各国政府が主権を持つAI能力を構築できるよう支援しています。
OpenAI Responses API のアップデート(2025年5月)
OpenAI は、リモート Model Context Protocol (MCP) サーバーのサポート、画像生成や Code Interpreter といった新しい組み込みツール、そしてバックグラウンドモードや暗号化された推論といったエンタープライズ機能を追加して、Responses API を拡張しました。
Falcon-H1: 効率と性能のためのハイブリッドヘッド言語モデル
Hugging Face と TII UAE は、Transformer のアテンションと Mamba-2 状態空間モデルを組み合わせ、メモリ使用量を抑えつつ高速推論で高性能を実現する、0.5B から 34B の 6 つのオープンソースハイブリッドヘッドモデルファミリー「Falcon-H1」を発表しました。
Falcon-Arabic: アラビア語言語モデルの画期的進歩
Technology Innovation Institute(TII)は、7BパラメータのモデルであるFalcon-Arabicをリリースしました。このモデルは、現代標準アラビア語および地域方言にわたる一般知識、文法、推論において、より大規模なアラビア語LLMを上回ります。
nanoVLM: ビジョン言語モデルのトレーニングのためのミニマリスト PyTorch ツールキット
Hugging Face は、初心者や研究者向けに Vision Language Model(VLM)のトレーニングと理解を簡素化することを目的とした、軽量で純粋な PyTorch ツールキットである nanoVLM をリリースしました。
Hugging Face Diffusers 量子化バックエンド
Hugging Face Diffusers は、bitsandbytes、torchao、Quanto、GGUF、FP8 レイヤー単位キャスティングといった複数の量子化バックエンドを統合し、FLUX.1-dev のような大規模拡散モデルのメモリフットプリントを削減します。
Microsoft と Hugging Face が Azure AI Foundry での協力を拡大
Microsoft と Hugging Face は、10,000 以上のオープンソースモデルを Azure AI Foundry に統合するためにパートナーシップを拡大し、多様な AI モダリティの安全でエンタープライズ向けデプロイを可能にしました。
OpenAI Codex: codex-1 によって駆動されるクラウドベースのコーディングエージェント
OpenAI は、`codex-1` モデル(`o3` の最適化バージョン)で駆動され、隔離されたクラウドコンテナ内でソフトウェアエンジニアリングタスクを実行するクラウドベースのコーディングエージェント、Codex を導入しました。
OpenAI Codex リサーチプレビュー
OpenAI は、codex-1 モデルを搭載したクラウドベースのソフトウェアエンジニアリングエージェントである Codex をリリースしました。Codex は、隔離されたサンドボックス環境で、機能の実装、バグ修正、プルリクエストの提案を独立して行うことができます。
Falcon-Edge: 強力で汎用的、かつ微調整可能な1.58ビット LLM
Hugging Face と Falcon-LLM チームは、1.58 ビット(三値)言語モデルのシリーズである Falcon-Edge をリリースしました。1B と 3B のパラメータサイズで提供され、新しい事前学習パラダイムを通じて推論と微調整の両方をサポートします。