アーカイブ · ラボ 11 拠点 · ディスパッチ 870 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

251

ScreenEnv リリース:フルスタック デスクトップエージェントのデプロイ

Hugging Face は、Docker コンテナ内に分離された Ubuntu デスクトップ環境を作成し、GUI エージェントのテストとデプロイを可能にする Python ライブラリ ScreenEnv をリリースしました。

252

Hugging Face 非同期ロボット推論

Hugging Face はアクション予測と実行を分離する非同期ロボット推論を導入し、ロボットのアイドル時間を削減し、タスク完了時間を最大で2倍に高速化します。

253

Hugging Face Gradio MCP サーバー統合

Hugging Face は Model Context Protocol(MCP)を Gradio(v5.28.0)に統合し、Hugging Face Spaces を MCP サーバーの大規模ライブラリとして機能させ、画像編集や文字起こしなどの新しい LLM 機能を提供できるようにしました。

254

AMD MI300 用のカスタムカーネルの作成

Hugging Face は AMD と協力して MI300X 用のオープンソース最適化カーネルを開発し、VLLM における Llama 3.1 405B の FP8 推論性能を大幅に向上させました。

255

Reachy Mini: AI開発向けオープンソースデスクトップロボット

Hugging Face と Pollen Robotics は、$399 から始まるオープンソースでプログラム可能なデスクトップロボット、Reachy Mini を発表しました。このロボットはヒューマンロボットインタラクションと AI 実験向けに設計されています。

256

Hugging Face の効率的なマルチモーダルデータパイプライン

Hugging Face は、マルチモーダルデータパイプライン向けに5段階の最適化プロセスを導入し、バランスの取れたナップサックパッキング戦略を活用して GPU のアイドル時間とパディングの無駄を最小化します。

257

SmolLM3 リリース: 多言語対応、長コンテキスト 3B 推論モデル

Hugging Face は、Llama-3.2-3B と Qwen2.5-3B を上回る 3B パラメータモデル SmolLM3 をリリースしました。デュアルモード推論と 128k コンテキストウィンドウを備えています。

258

Hugging Face 本番インフラストラクチャ アラート戦略

Hugging Face は、NAT ゲートウェイのスループット、ログアーカイブの成功率、Kubernetes API のヘルスに特化したアラートを活用し、本番環境の安定性とコスト効率を維持しています。

259

NeurIPS 2025 E2LM コンペティション:言語モデルの早期トレーニング評価

Hugging Face とパートナーは、LLM のトレーニング初期段階で推論や科学的知識のシグナルを検出できるベンチマークを開発するための E2LM コンペティションを発表しました。

260

Sentence Transformers を用いたスパース埋め込みモデルのトレーニングとファインチューニング

Hugging Face は、Sentence Transformers ライブラリを使用してスパース埋め込みモデルのトレーニングとファインチューニングを行う包括的なガイドを紹介し、ハイブリッド検索と検索パフォーマンスの向上を図ります。

261

NVIDIA Llama Nemotron Nano VL リリース

NVIDIA は、インテリジェント文書処理と OCR タスクにおいて高精度を実現するよう最適化された 8B ビジョン言語モデル(VLM)である Llama Nemotron Nano VL をリリースしました。

262

Gemma 3n リリースノート:マルチモーダルオンデバイスAI

Google の Gemma 3n がオープンソースエコシステムで利用可能になり、ネイティブなマルチモーダリティ(テキスト、画像、音声、動画)と、ローカルハードウェアでの実行を想定したメモリ効率の高いアーキテクチャを備えています。

263

SGLang Transformers バックエンド統合

SGLang は Hugging Face の transformers をバックエンドとしてサポートし、ネイティブな SGLang 実装がなくても任意の transformers 互換モデルで高性能推論を実現できるようになりました。

264

コンシューマーハードウェアでの QLoRA を用いた FLUX.1-dev のファインチューニング

Hugging Face は、QLoRA と diffusers ライブラリを使用して FLUX.1-dev モデルをファインチューニングし、単一のコンシューマー GPU でピーク VRAM 使用量を 10 GB 未満に抑える方法を示しています。

265

Groq と Hugging Face 推論プロバイダーの統合

Hugging Face は Groq をサポート対象の Inference Provider として追加し、ユーザーは Hub を通じて Llama 4 や QWQ-32B などのモデルに対し、高速 LPU 搭載推論を直接利用できるようになりました。

266

LLM パフォーマンスの最適化:長いプロンプトのブロッキングとデコード遅延の解決

Hugging Face は、長いプロンプトがリクエストキューをブロックしトークン生成を遅くする仕組みを調査し、レイテンシ削減のための解決策としてリクエスト並列プレフィルと分散プレフィルを提案しています。

267

Featherless AI と Hugging Face 推論プロバイダーの統合

Hugging Face は Featherless AI をサポートされる推論プロバイダーとして追加し、オープンソースのテキストおよび対話モデルの膨大なカタログへのサーバーレスアクセスを可能にしました。

268

Hugging Face Kernel Hub リリース

Hugging Face は Kernel Hub を導入しました。これは、事前にコンパイルされた最適化計算カーネルを Python アプリケーションに直接ロードし、ローカルでのコンパイルなしに GPU 操作を高速化するための集中リポジトリです。

269

NVIDIA Isaac GR00T N1.5:LeRobot SO-101 アーム向けポストトレーニング

NVIDIAはIsaac GR00T N1.5をリリースしました。これはヒューマノイドロボットの推論とスキルのためのオープン基礎モデルで、LeRobot SO-101 アームのような特定のロボットエンボディメント向けにポストトレーニングが可能です。

270

Hugging Face と NVIDIA が Training Cluster as a Service を開始

Hugging Face と NVIDIA は Training Cluster as a Service を導入しました。この協業は、研究機関が基礎モデルのトレーニングのために、大規模な NVIDIA GPU クラスタへの柔軟でオンデマンドなアクセスを提供することを目的としています。

271

Hugging Face ScreenSuite リリース

Hugging Face は GUI エージェント向けの包括的な評価スイートである ScreenSuite をリリースしました。13 のベンチマークを統合し、Vision Language Models(VLM)の認識、グラウンディング、アクション能力を評価します。

272

nanoVLM における KV キャッシュ実装

Hugging Face は nanoVLM リポジトリで KV キャッシングをゼロから実装し、Vision Language Model の生成速度を 38% 向上させました。

273

Arm CPU上でのリアルタイムAIサウンド生成

Arm と Hugging Face は、Stable Audio Open を使用したパーソナルサウンド生成ツールを実演し、音楽制作ワークフロー向けにリアルタイムでデバイス上で音声を作成できることを示しました。

274

Holo1 と Surfer-H: GUI 自動化のためのオープンソース Action VLM

H社は、正確なGUIローカリゼーションを実現するAction Vision Language ModelのファミリーであるHolo1と、実世界タスクで92.2%の精度を、タスクあたり$0.13のコストで達成するモジュラーWebエージェントSurfer-Hをリリースしました。

275

Hugging Face TRL: 効率的な GRPO トレーニングのための同居 vLLM

Hugging Face は TRL に同居 vLLM を導入し、トレーニングと推論が同じ GPU を共有できるようにしました。これにより、アイドル時間がなくなり、GRPO トレーニング中のスループットが向上します。

276

SmolVLA: Lerobotコミュニティデータで訓練された効率的なVision-Language-Actionモデル

Hugging Faceは、コンパクトな450MパラメータのオープンソースVision-Language-ActionモデルであるSmolVLAを紹介します。このモデルは、コミュニティ共有データを活用して、シミュレーションおよび実世界のロボティクス課題において、より大きなモデルを上回る性能を発揮します。

277

Hugging Face CodeAgents + Structure: 構造化生成によるエージェント信頼性の向上

Hugging Face の研究は、CodeAgents に thoughts と code を構造化された JSON 形式で生成させることで、パースエラーを排除し明示的な推論を強制することにより、能力の高いモデルのパフォーマンスが平均で 2〜7 ポイント向上することを示しています。

278

Liger GRPO と TRL の統合

ユーザー報告では、DeepSpeed ZeRO-3 と bf16 で Qwen2.5-0.5B-Instruct モデルを使用した際に、Liger GRPO ロスで形状不一致エラーが発生することが指摘されています。

279

Python における Hugging Face Tiny Agents

Hugging Face は Python 向けに Tiny Agents を導入しました。これは Model Context Protocol(MCP)で駆動される軽量エージェントフレームワークで、最小限のコードで LLM が外部ツールとやり取りできるようにします。

280

Dell Enterprise Hub アップデート:オンプレミス AI モデルとアプリケーション

Dell と Hugging Face は Dell Enterprise Hub を更新し、Dell AI サーバーと AI PC 向けに最適化されたモデルとすぐに展開できる AI アプリケーションの完全なスイートを提供しました。

281

Falcon-H1: 効率と性能のためのハイブリッドヘッド言語モデル

Hugging Face と TII UAE は、Transformer のアテンションと Mamba-2 状態空間モデルを組み合わせ、メモリ使用量を抑えつつ高速推論で高性能を実現する、0.5B から 34B の 6 つのオープンソースハイブリッドヘッドモデルファミリー「Falcon-H1」を発表しました。

282

Falcon-Arabic: アラビア語言語モデルの画期的進歩

Technology Innovation Institute(TII)は、7BパラメータのモデルであるFalcon-Arabicをリリースしました。このモデルは、現代標準アラビア語および地域方言にわたる一般知識、文法、推論において、より大規模なアラビア語LLMを上回ります。

283

nanoVLM: ビジョン言語モデルのトレーニングのためのミニマリスト PyTorch ツールキット

Hugging Face は、初心者や研究者向けに Vision Language Model(VLM)のトレーニングと理解を簡素化することを目的とした、軽量で純粋な PyTorch ツールキットである nanoVLM をリリースしました。

284

Hugging Face Diffusers 量子化バックエンド

Hugging Face Diffusers は、bitsandbytes、torchao、Quanto、GGUF、FP8 レイヤー単位キャスティングといった複数の量子化バックエンドを統合し、FLUX.1-dev のような大規模拡散モデルのメモリフットプリントを削減します。

285

Microsoft と Hugging Face が Azure AI Foundry での協力を拡大

Microsoft と Hugging Face は、10,000 以上のオープンソースモデルを Azure AI Foundry に統合するためにパートナーシップを拡大し、多様な AI モダリティの安全でエンタープライズ向けデプロイを可能にしました。

286

Falcon-Edge: 強力で汎用的、かつ微調整可能な1.58ビット LLM

Hugging Face と Falcon-LLM チームは、1.58 ビット(三値)言語モデルのシリーズである Falcon-Edge をリリースしました。1B と 3B のパラメータサイズで提供され、新しい事前学習パラダイムを通じて推論と微調整の両方をサポートします。

287

Hugging Face Transformers: エコシステム相互運用性のためのモデル定義の標準化

Hugging Face は、Transformers ライブラリをモデル定義の中心的なピボットとして位置付け、Transformers がサポートするあらゆるアーキテクチャが推論エンジンやトレーニングフレームワークを含む広範な ML エコシステムと自動的に互換性を持つようにしています。

288

Hugging Face と Kaggle のモデルアクセス統合

Hugging Face と Kaggle は、Kaggle ノートブックおよびモデルページ内で Hugging Face モデルの見つけやすさと使いやすさを向上させる統合をリリースしました。

289

Hugging Face 推論エンドポイント: 高速 Whisper 転写

Hugging Face は、Inference Endpoints 上で新しい OpenAI Whisper のデプロイオプションを導入し、精度を犠牲にすることなく転写速度を最大 8 倍向上させました。

290

Hugging Face ビジョン言語モデル 2025 アップデート

Hugging Face は、2024〜2025 年におけるビジョン言語モデル(VLM)の進化を包括的に概観し、any-to-any アーキテクチャ、推論モデル、そしてロボティクス向けの Vision-Language-Action(VLA)モデルの台頭といったトレンドを強調しています。

291

LeRobot コミュニティ データセット: ロボティクスの ImageNet を構築する

Hugging Face は、LeRobot を通じてロボティクスデータセットの多様でオープンソースなリポジトリを構築するコミュニティ主導の取り組みを推進し、ロボットポリシーの汎化課題の解決を目指しています。

292

GradioでMCPサーバーを構築する

Hugging FaceはModel Context Protocol(MCP)をGradioに統合し、開発者がPython関数をLLMが利用できるツールに、パラメータを1つ変更するだけで変換できるようにしました。

293

Qwen-3 チャットテンプレート分析

Qwen-3 モデルは、オプションの推論、ローリングチェックポイントによる動的なコンテキスト管理、および改善されたツールの引数シリアライズを可能にする洗練されたチャットテンプレートを導入しています。

294

Intel AutoRound: LLM と VLM のための高度なウェイトオンリー量子化

Intel は AutoRound を導入しました。これは、署名付き勾配降下法を使用して LLM と VLM の高精度低ビット量子化(INT2〜INT8)を実現するウェイトオンリーのポストトレーニング量子化手法です。

295

Llama Guard 4 と Llama Prompt Guard 2 のリリース

Meta は、12B のマルチモーダル安全モデルである Llama Guard 4 と、プロンプトインジェクションやジャイルブレイクを検出するための一連の分類器である Llama Prompt Guard 2 をリリースしました。

296

PipelineRL: インフライト重み更新による LLM 強化学習の最適化

Hugging Face と ServiceNow Research は、インフライト重み更新を使用して推論スループットとオンポリシーデータ収集のトレードオフを解消する実験的な RL 実装である PipelineRL をオープンソース化しました。

297

Hugging Face Tiny Agents: 50 行のコードで MCP 駆動エージェントを構築

Hugging Face は Model Context Protocol (MCP) と InferenceClient を活用して機能的な AI エージェントを構築する方法を示し、エージェントのコアロジックをシンプルな while ループにまで簡素化しました。

298

忠実な文書抽出のための olmOCR のファインチューニング

TNG は、ヘッダーとフッターを保持するようにファインチューニングされた olmOCR-7B-0225-preview をリリースし、請求書の解析などのビジネスアプリケーションに適しています。

299

LLM パフォーマンスの最適化:同時リクエストに対するプレフィルとデコード

Hugging Face(TNG を通じて)は、連続バッチングやチャンク化プレフィルといった戦略でトークン生成のプレフィルフェーズとデコードフェーズを管理することで、GPU の利用効率を最適化し、トークンスループットを最大 50% 向上させる方法を解説しています。

300

HELMET: 長文コンテキスト言語モデルの包括的評価

Hugging Face と Princeton の研究者は、HELMET を導入しました。これは、needle-in-a-haystack のような合成テストに代わり、長文コンテキスト言語モデルに対して多様で調整可能、かつ信頼できる実世界評価を提供する包括的ベンチマークです。