アーカイブ · ラボ 11 拠点 · ディスパッチ 870 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

451

Hugging Face データセットハブ検索機能のアップデート

Hugging Face は、モダリティ、サイズ、形式、ライブラリ互換性の 4 つの新しい検索フィルタを導入し、データセットハブ上の 180,000 を超える公開データセットの発見性を向上させました。

452

Intel Gaudi 2上でのタンパク質言語モデルProtSTの高速化

IntelとMILAは、ProtSTマルチモーダルタンパク質言語モデルをIntel Gaudi 2アクセラレータ向けに最適化し、NVIDIA A100 GPUと比較して最大2.92倍高速なファインチューニングを実現しました。

453

Hugging Face Transformers コードエージェント GAIA ベンチマーク結果

Hugging Face は、transformers.agents ライブラリで構築されたコードエージェントを使用して GAIA ベンチマークでトップランクを獲得し、コードベースのアクションが JSON ベースのツール呼び出しよりも効率的かつ効果的であることを示しました。

454

Google Gemma 2 リリースノート

GoogleはGemma 2をリリースしました。これは9Bと27Bパラメータサイズで利用可能なオープンウェイトLLMのファミリーで、蒸留とアテンションメカニズムにおける技術的進歩により性能が向上しています。

455

XLSCOUT ParaEmbed 2.0 リリース

XLSCOUTは、専門家がキュレーションした特許データでファインチューニングされた独自の埋め込みモデル、ParaEmbed 2.0をリリースしました。これにより、ParaEmbed 1.0に比べて精度が23%向上しています。

456

Hugging Face Ethics and Society Newsletter #6: データ品質の重要性

Hugging Face は、データ品質に対して包括的かつ責任あるアプローチを示し、データはその目的に適合していることが AI モデルの性能、公平性、科学的再現性を確保する上で不可欠であると強調しています。

457

Microsoft Florence-2 の DocVQA に対するファインチューニング

Hugging Face は、Microsoft の Florence-2 ビジョン・ランゲージモデルを DocVQA データセットでファインチューニングし、7 エポック後に検証時の類似度を 0 から 57.0 に向上させる方法を示しています。

458

Hugging Face データは共にあるイニシアチブ

Hugging Face と Argilla は、オープンソースコミュニティが機械学習のために高品質で多様かつ包括的なデータセットを共同で作成できるよう支援するために、Data Is Better Together(DIBT)イニシアチブを立ち上げました。

459

Prezi ケーススタディ:Hugging Face エキスパートサポートでMLロードマップを加速

Preziは、Hugging Face エキスパートサポートプログラムとInference Endpointsを活用し、効率的なオープンソースのマルチモーダルモデルをPrezi AIのプレゼンテーション生成ツールに統合しています。

460

BigCodeBench: 複雑な Python コード生成のための新しいベンチマーク

Hugging Face は、実践的なプログラミングと多様なライブラリ利用を評価するために設計された 1,140 の関数レベルタスクからなるベンチマーク、BigCodeBench をリリースしました。これにより、HumanEval の単純さやデータ汚染の問題に対処します。

461

Hugging Face Accelerate: DeepSpeed と FSDP の精度を調和させる

Hugging Face Accelerate 0.30.0 は、PyTorch FSDP の精度処理を DeepSpeed と合わせるために自動アップキャストを導入し、収束性を失うことなく 2 つのバックエンド間をシームレスに切り替えられるようにしました。

462

Diffusers との Stable Diffusion 3 Medium 統合

Hugging Face は Stable Diffusion 3 Medium(2B パラメータ)を Diffusers ライブラリに統合し、マルチモーダル拡散トランスフォーマー(MMDiT)と整流フローマッチングを導入して、テキストから画像への合成を改善しました。

463

Hugging Face TRL RLOO トレーナー リリース

Hugging FaceはTRLにRLOO(REINFORCE Leave One-Out)トレーナーを導入しました。このオンラインRLHFアルゴリズムは、PPOに比べてvRAMを50〜70%削減し、最大で3倍速く収束しながら、性能面でも競争力を保ちます。

464

Amazon SageMaker 用 Hugging Face Embedding コンテナのリリース

Hugging Face は、テキスト埋め込み推論(TEI)を活用した、オープン埋め込みモデルの高性能デプロイを実現する、Amazon SageMaker 用の一般提供(GA)Embedding コンテナをリリースしました。

465

Hugging Face Transformers ドキュメントの再設計

Hugging Face は、堅牢で段階的な構造から、製品開発者向けにコードファーストで統合された体験へと、Transformers ドキュメントを再設計しています。

466

人工分析テキストから画像へのリーダーボードとアリーナの開始

Hugging Faceは、45,000件以上の投票から得られた人間の好みデータを使用して、オープンソースおよび商用の画像生成モデルをランク付けするArtificial Analysis Text to Image LeaderboardとArenaを開始しました。

467

Hugging Face NPC-Playground: LLM駆動NPCを3D環境に統合する

Hugging FaceはNPC-Playgroundを紹介します。これはCubzhとGigaxを活用した3Dデモで、関数呼び出しとLuaスクリプトにより、リアルなLLM駆動NPCインタラクションを実現します。

468

Intel Gaudi アシスト生成サポート

Hugging Face はアシスト生成(スペキュレーティブサンプリング)を Optimum Habana に統合し、Intel Gaudi プロセッサ上で大規模なトランスフォーマーベースモデルに対して最大 2 倍の速度向上を実現しました。

469

Hugging Face Spaces シークレット セキュリティ更新

Hugging Face は、Spaces のシークレットの一部への不正アクセスを伴うセキュリティインシデントを公表し、影響を受けたトークンの失効と細粒度アクセス トークンへの移行を行いました。

470

テキスト生成推論のベンチマーク

Hugging Face は、テキスト生成推論(`TGI`)のベンチマークツールを導入し、開発者がスループットとレイテンシのトレードオフをプロファイルして、LLM のデプロイコストとパフォーマンスを最適化できるよう支援します。

471

Sentence Transformers を用いた埋め込みモデルのトレーニングとファインチューニング

Hugging Face は、Sentence Transformers ライブラリを使用して埋め込みモデルをトレーニングおよびファインチューニングするための包括的なガイドを提供しており、セマンティック検索や RAG などのタスク向けに新しい SentenceTransformerTrainer を紹介しています。

472

Falcon 2 11B リリースノート

TIIはFalcon 2 11Bをリリースしました。これは、5,000億トークン以上で学習された事前学習済みLLMとビジョン・ランゲージモデル(VLM)を含む、より小型で高性能なモデル群です。

473

CyberSecEval 2: 大規模言語モデルにおけるサイバーセキュリティリスクの評価

Hugging Face と Meta は、コードインタプリタの悪用、攻撃的サイバーセキュリティ機能、プロンプトインジェクション攻撃に対する LLM の脆弱性を評価する包括的フレームワークとして CyberSecEval 2 を導入しました。

474

Hugging Face AWS Inferentia2 統合

Hugging Face は AWS Inferentia2 のサポートを拡大し、Amazon SageMaker を通じて 100,000 以上のモデルをデプロイできるようにし、Hugging Face Inference Endpoints 用の新しい Inf2 インスタンスオプションを導入しました。

475

Hugging Face と Microsoft の戦略的協業アップデート 2024年5月

Hugging Face と Microsoft は、人気のオープンモデルを Azure Model Catalog に統合し、Azure 上で AMD MI300X GPU のサポートを可能にし、Hugging Face Spaces 用の VS Code 統合を導入することで、戦略的パートナーシップを拡大しました。

476

AMD Instinct MI300 GPU 用 Hugging Face 統合

Hugging Face は AMD Instinct MI300 GPU のファーストクラス統合を実現し、MI250 と比較して Llama 3 70B の推論が最大 3 倍、ファインチューニングが 2 倍高速になることを提供しています。

477

Dell Enterprise Hub: オンプレミス AI のデプロイとトレーニング

Hugging Face と Dell は、Dell ハードウェア上でオープンソースの大規模言語モデルのオンプレミスでのトレーニングとデプロイを簡素化するプラットフォーム、Dell Enterprise Hub を立ち上げました。

478

Hugging Face Spaces Dev Mode リリース

Hugging Face は Spaces Dev Mode を導入し、PRO サブスクライバーが VS Code または SSH を介してリアルタイムにコード編集できるようにし、変更ごとに git プッシュを行う必要がなくなります。

479

Hugging Face KV キャッシュ量子化

Hugging Face は、Transformers ライブラリに KV キャッシュ量子化を導入し、長文コンテキストのテキスト生成におけるメモリ使用量を削減し、モデル品質への影響を最小限に抑えました。

480

Open Arabic LLM Leaderboard の紹介

Hugging Face と Technology Innovation Institute は、アラビア語大型言語モデル向けの専門的かつオープンな評価プラットフォームを提供するために、Open Arabic LLM Leaderboard (OALL) を立ち上げました。

481

PaliGemma ビジョン言語モデルリリース

Google は、SigLIP-So400m と Gemma-2B を組み合わせたオープンなビジョン‑言語モデルファミリーである PaliGemma をリリースし、画像キャプション生成、ビジュアル質問応答、物体検出などのタスクを実現します。

482

Hugging Face と LangChain が langchain_huggingface パートナーパッケージをリリース

Hugging Face と LangChain は、Hugging Face のモデルを LangChain エコシステムにシームレスに統合するために、共同で保守されるパートナーパッケージ langchain_huggingface をリリースしました。

483

Transformers Agents 2.0 リリースノート / 新機能

Hugging Faceは、反復的な問題解決エージェントと、Llama-3-70B-Instructを使用したGAIAベンチマークでの高い性能を特徴とする、モジュール式エージェントフレームワーク、Transformers Agents 2.0を導入します。

484

インテル Gaudi 2 とインテル Xeon を使用したコスト効率の高いエンタープライズ RAG アプリケーションの構築

Hugging Face は、OPEA フレームワークを介して Intel Gaudi 2 アクセラレータと Intel Xeon CPU を組み合わせることで、エンタープライズが H100 ベースのシステムと比較して、パフォーマンス・パー・ドルが優れた RAG アプリケーションを構築できることを示しています。

485

Hugging Face Enterprise Hub が AWS Marketplace で利用可能になりました

Hugging Face は Enterprise Hub を AWS Marketplace と統合し、組織がアカウントをアップグレードし、AWS アカウントを通じて請求を直接管理できるようにしました。

486

ヘブライ語 LLM 用 Hugging Face オープンリーダーボード

Hugging Face は、ヘブライ語の大規模言語モデル(LLM)を評価・改善するために特化したオープンリーダーボードを開始し、リソースが少なく形態的に複雑な言語の課題に取り組んでいます。

487

Hugging Face の Artificial Analysis LLM Performance Leaderboard

Hugging Face は Artificial Analysis LLM Performance Leaderboard を統合し、AI エンジニアに 100 以上のサーバーレス LLM API エンドポイントの品質、価格、速度を比較できる統一メトリックシステムを提供しています。

488

Hugging Face Inference Endpoints の ASR と Diarization パイプライン

Hugging Face は、Inference Endpoints 上で Whisper ASR、Pyannote ダイアリゼーション、投機的デコードを組み合わせたモジュラーパイプラインをデプロイするためのカスタム推論ハンドラを導入しました。

489

構造化生成によるプロンプトの一貫性の向上

Hugging FaceとDottxtの研究は、構造化生成を使用してLLMの出力を制約することで、パフォーマンスの分散を抑え、異なるプロンプト形式やショットの順序にわたるランキングの一貫性を向上させられることを示しています。

490

StarCoder2-15B-Instruct-v0.1 リリースノート / 新機能

Hugging Faceは、完全に透明で許容的なパイプラインを使用して、HumanEvalでCodeLlama-70B-Instructを上回る、完全に自己調整された最初のコードLLMであるStarCoder2-15B-Instruct-v0.1を導入します。

491

Hugging Face オープン思考連鎖リーダーボード

Hugging Face は、難易度の高い推論タスクにおいて、さまざまな LLM に対するチェーン・オブ・ソート(思考の連鎖)プロンプトによって得られる特定の精度向上を測定するために、Open Chain of Thought Leaderboard を導入しました。

492

Jack of All Trades (JAT) 多目的トランスフォーマーエージェント

Hugging Face は、Jack of All Trades (JAT) を紹介します。これは、Atari、BabyAI、Meta-World、MuJoCo 環境にわたる多様なシーケンシャル意思決定タスクを実行できる、単一のトランスフォーマーベースのエージェントです。

493

オープン・メディカルLLMリーダーボード:医療分野における大規模言語モデルのベンチマーク

Hugging Face は、さまざまな医療データセット上で LLM の性能を評価・比較する標準化プラットフォームである Open Medical-LLM Leaderboard を導入し、信頼性と患者安全性の向上を目指しています。

494

Meta Llama 3 リリースノート

MetaはLlama 3をリリースしました。これは8Bと70Bパラメータモデルを備えたオープンアクセスLLMファミリーで、トークナイゼーションの改善と15兆トークンでの訓練が特徴です。

495

Ryght ケーススタディ:Hugging Face と共にライフサイエンス向け生成AIプラットフォームを構築

Ryghtは、医療・ライフサイエンス向けのエンタープライズグレード生成AIプラットフォーム「Ryght Preview」を開始しました。このプラットフォームは、Hugging Face のエキスパートサポート、TGI、TEI を活用し、セキュアで柔軟かつ高性能なAIコパイロットを提供します。

496

Hugging Face エンドポイントでプライバシー保護推論を実行する

Hugging Face と Zama は、Fully Homomorphic Encryption(FHE)モデルを Hugging Face エンドポイント経由でデプロイできるようにし、ユーザーが暗号化されたデータを復号せずに機械学習の推論を実行できるようにしました。

497

LiveCodeBench リーダーボード:コード LLM の汚染フリー評価

Hugging Face は、UCバークレー、MIT、コーネル大学の研究者が開発した新しいベンチマークである LiveCodeBench リーダーボードを導入しました。このベンチマークは、時間ウィンドウで区切られた問題セットを使用してベンチマーク汚染を防ぎながら、LLM のコード生成および推論能力を評価します。

498

Gradio リロードモードで AI アプリ開発を高速化

Gradio のリロードモードにより、開発者はサーバーを再起動せずに AI アプリケーションのソースコード変更を即座に適用でき、開発の遅延を大幅に削減します。

499

Idefics2 8B ビジョン・ランゲージモデルリリース – アーキテクチャ、データ、パフォーマンス

Hugging Face は、VQA と OCR ベンチマークで他の 8B モデルを上回る性能を持ち、🤗 Transformers でのファインチューニングが可能な 8B のオープンソースビジョン・ランゲージモデル Idefics2 をリリースしました。

500

ビジョン言語モデルの解説

Hugging Face は、ビジョン言語モデル(VLM)のアーキテクチャ、オープンソースの選択肢、評価ベンチマーク、そして TRL ライブラリによるファインチューニングの新しい実験的サポートを網羅的に解説したガイドを提供しています。