Jack of All Trades (JAT) 多目的トランスフォーマーエージェント
Hugging Face は、Jack of All Trades (JAT) を紹介します。これは、Atari、BabyAI、Meta-World、MuJoCo 環境にわたる多様なシーケンシャル意思決定タスクを実行できる、単一のトランスフォーマーベースのエージェントです。
オープン・メディカルLLMリーダーボード:医療分野における大規模言語モデルのベンチマーク
Hugging Face は、さまざまな医療データセット上で LLM の性能を評価・比較する標準化プラットフォームである Open Medical-LLM Leaderboard を導入し、信頼性と患者安全性の向上を目指しています。
Meta Llama 3 リリースノート
MetaはLlama 3をリリースしました。これは8Bと70Bパラメータモデルを備えたオープンアクセスLLMファミリーで、トークナイゼーションの改善と15兆トークンでの訓練が特徴です。
Ryght ケーススタディ:Hugging Face と共にライフサイエンス向け生成AIプラットフォームを構築
Ryghtは、医療・ライフサイエンス向けのエンタープライズグレード生成AIプラットフォーム「Ryght Preview」を開始しました。このプラットフォームは、Hugging Face のエキスパートサポート、TGI、TEI を活用し、セキュアで柔軟かつ高性能なAIコパイロットを提供します。
Hugging Face エンドポイントでプライバシー保護推論を実行する
Hugging Face と Zama は、Fully Homomorphic Encryption(FHE)モデルを Hugging Face エンドポイント経由でデプロイできるようにし、ユーザーが暗号化されたデータを復号せずに機械学習の推論を実行できるようにしました。
LiveCodeBench リーダーボード:コード LLM の汚染フリー評価
Hugging Face は、UCバークレー、MIT、コーネル大学の研究者が開発した新しいベンチマークである LiveCodeBench リーダーボードを導入しました。このベンチマークは、時間ウィンドウで区切られた問題セットを使用してベンチマーク汚染を防ぎながら、LLM のコード生成および推論能力を評価します。
Gradio リロードモードで AI アプリ開発を高速化
Gradio のリロードモードにより、開発者はサーバーを再起動せずに AI アプリケーションのソースコード変更を即座に適用でき、開発の遅延を大幅に削減します。
Idefics2 8B ビジョン・ランゲージモデルリリース – アーキテクチャ、データ、パフォーマンス
Hugging Face は、VQA と OCR ベンチマークで他の 8B モデルを上回る性能を持ち、🤗 Transformers でのファインチューニングが可能な 8B のオープンソースビジョン・ランゲージモデル Idefics2 をリリースしました。
ビジョン言語モデルの解説
Hugging Face は、ビジョン言語モデル(VLM)のアーキテクチャ、オープンソースの選択肢、評価ベンチマーク、そして TRL ライブラリによるファインチューニングの新しい実験的サポートを網羅的に解説したガイドを提供しています。
Hugging Face と Google Cloud Vertex AI Model Garden の統合
Hugging Face は「Deploy on Google Cloud」を開始し、ユーザーが Hugging Face Hub または Vertex Model Garden を通じて、数千のオープン基盤モデルを Vertex AI または Google Kubernetes Engine (GKE) にデプロイできるようにしました。
CodeGemma リリースノート / 新機能
Googleは、Gemma をベースにしたオープンアクセスのコード専門 LLM ファミリーである CodeGemma をリリースしました。コード、数学、英語データの追加で 5000 億トークンを学習しています。
Hugging Face 公共政策プログラムの概要と提出資料
Hugging Faceは、米国、EU、英国の政策立案者に詳細な立場文書、証言、コメントレターを提供する包括的な公共政策プログラムを発表し、責任あるオープン性への横断的なコミットメントとAI規制の形成を反映しています。
Hugging Face と Wiz の研究パートナーシップによる AI セキュリティ
Hugging Face は Wiz と提携し、先進的な脆弱性管理とクラウドセキュリティ姿勢管理を統合して、プラットフォームと広範な AI/ML エコシステムを保護しています。
Hugging Face Dataset Viewer API と DuckDB-NSQL-7B を使用した Text2SQL
Hugging Face は、DuckDB-NSQL-7B モデルと Dataset Viewer API を使用して、自然言語の質問を SQL クエリに変換し、120,000 以上のオープンデータセットを分析する方法を示しています。
Xeon上で 🤗 Optimum Intel を使用した SetFit 推論の高速化
Hugging Face は、🤗 Optimum Intel ライブラリを介した事後トレーニング静的量子化を使用して、Intel Xeon CPU 上で SetFit モデルの推論スループットを最大 7.8 倍高速化する方法を示しています。
Hugging Face と Cloudflare Workers AI の統合
Hugging Face が Cloudflare Workers AI を統合し、人気のオープンモデル向けにサーバーレス GPU 推論を提供。開発者はリクエストごとの課金モデルで AI アプリケーションをデプロイできるようになった。
Pollen-Vision: ロボティクスにおけるゼロショットビジョンモデルの統一インターフェース
Hugging Face と Pollen Robotics チームは、ゼロショットビジョンモデルを統合し、ロボットが未知の物体を 3D 空間で検出・位置特定できるようにするオープンソースライブラリ pollen-vision をリリースしました。
Hugging Face Transformers: オープンソース機械学習の初心者向けガイド
Hugging Face は、Transformers ライブラリと Hub を使用して、Microsoft の Phi-2 のようなオープンソース機械学習モデルをデプロイおよび実行するための包括的な入門ガイドを提供しています。
埋め込み量子化:高速・低コスト検索のためのバイナリおよびスカラー手法
Hugging Face はバイナリおよび int8 の埋め込み量子化を発表し、メモリを 32 倍または 4 倍削減し、検索速度を最大 45 倍に向上させながら、元の性能の 96%〜99% を維持します。
Hugging Face と Lighthouz AI が Chatbot Guardrails Arena を導入
Hugging Face と Lighthouz AI は、LLM とそのガードレールのデータプライバシーとセキュリティを評価するためのコミュニティ主導のストレステストプラットフォーム「Chatbot Guardrails Arena」を開始しました。
GaLore: コンシューマ向けハードウェアでの大規模モデル学習の進化
GaLoreは、低ランク勾配射影によりオプティマイザ状態のメモリ要件を82.5%以上削減することで、コンシューマ向けGPU上で数十億パラメータのモデルの学習を可能にします。
Cosmopedia: LLM事前学習のための大規模合成データ
Hugging Faceは、LLM事前学習向けの最大規模のオープン合成データセットであるCosmopediaを紹介します。このデータセットは、Mixtral-8x7B-Instruct-v0.1によって生成された3000万ファイル、250億トークンを含みます。
Intel Meteor Lake上のPhi-2:ローカルLLM推論
Hugging Faceは、OpenVINO と Optimum Intel を使用した4ビット量子化により、Intel Meteor Lake(Core Ultra)プロセッサ上でMicrosoft Phi-2モデルをローカルで実行する方法を示しています。
Quanto: Optimum 用の PyTorch 量子化バックエンド
Hugging Face は、あらゆるモダリティで低精度モデルのデプロイを簡素化するよう設計された、汎用性とデバイス非依存性を備えた Optimum 用 PyTorch 量子化バックエンド、Quanto を発表しました。
Hugging Face の DGX Cloud トレーニング
Hugging Face は、Enterprise Hub 組織が NVIDIA H100 および L40S GPU を使用してオープンモデルをノーコードでファインチューニングできるサービス「Train on DGX Cloud」を開始しました。
WebSight データセットと Sightseer モデル
Hugging Face は、200 万件のスクリーンショットと HTML のペアからなる合成データセット WebSight と、ウェブスクリーンショットを機能的な HTML コードに変換できるビジョン・ランゲージモデル Sightseer を発表しました。
Optimum Intel と fastRAG を使用した CPU 最適化埋め込み
Hugging Face と Intel は、Optimum Intel と fastRAG を活用し、Xeon CPU 上で埋め込みモデルを高速化する手法を導入しました。int8 量子化により、レイテンシを最大 4.5 倍削減し、スループットを最大 4 倍向上させます。
ConTextual: テキストが豊富なシーンにおけるマルチモーダル推論のベンチマーク
Hugging Face と UCLA の研究者は、テキストが豊富な複雑な画像において、テキストと視覚的手がかりを共同で推論する大型マルチモーダルモデル(LMM)の評価を目的としたデータセットとリーダーボードである ConTextual を導入しました。
Hugging Face と Argilla が共同コミュニティデータセット構築を実現
Hugging Face と Argilla は、Hugging Face Spaces と Argilla を活用した簡略化されたワークフローを導入し、コミュニティが共同で高品質なオープンソースデータセットを構築できるようにしました。
Intel Gaudi 2 AIアクセラレータ上のテキスト生成パイプライン
Hugging Face は Intel Gaudi 2 AIアクセラレータ向けにカスタムテキスト生成パイプラインを導入し、Optimum Habana を通じて Llama 2 モデル(7b、13b、70b)の簡易デプロイを実現しました。
StarCoder2 と The Stack v2 のリリース
BigCode は、3B、7B、15B のパラメータサイズで透明に訓練されたオープンコード LLM のファミリーである StarCoder2 を、巨大な新しい Stack v2 データセットを活用してリリースしました。
Hugging Face TTS Arena: テキスト音声合成モデルのベンチマーク
Hugging Faceは、Eloレーティングシステムを用いたクラウドソース型の並列比較ツールとリーダーボードであるTTS Arenaを立ち上げ、テキスト音声合成モデルの品質を客観的に測定できるようにしました。
AIウォーターマーキング 101: ツールとテクニック
Hugging Face は、ディープフェイクと戦い、コンテンツの出所を保証するために、画像、テキスト、オーディオにわたる AI ウォーターマーキング技術の包括的な概要を提供しています。
Matryoshka 埋め込みモデルの紹介
Matryoshka 埋め込みモデルは、サイズ可変の埋め込みを提供し、性能の大幅な低下なしに切り詰めることができ、ストレージ、速度、精度の間で柔軟にトレードオフできるようにします。
Hugging FaceでのGemmaモデルのファインチューニング
Hugging Face は、パラメータ効率的ファインチューニング(PEFT)と低ランク適応(LoRA)を使用して、Google の Gemma モデルを GPU および Cloud TPU 上でカスタマイズするためのガイドを提供しています。
Hugging Face と Haize Labs が Red-Teaming Resistance Leaderboard を発表
Hugging Face と Haize Labs は、特定の安全違反カテゴリにわたる高品質で人間らしい敵対的プロンプトに対する LLM の堅牢性を評価するために、Red-Teaming Resistance (RTR) Benchmark を開始しました。
Google Gemma オープン LLM リリース
GoogleはGemmaをリリースしました。Geminiに基づくオープンアクセスの大規模言語モデルファミリーで、2Bと7Bのパラメータサイズがあり、ベースと指示チューニングされたバリアントが提供されます。
Open Ko-LLM リーダーボード
Hugging Face と Upstage は、プライベートテストセットを使用して汚染を防止し、韓国語大規模言語モデルの公平で透明な評価エコシステムを提供するために Open Ko-LLM Leaderboard を立ち上げました。
Hugging Face PEFT 新しい LoRA マージング手法
Hugging Face は PEFT ライブラリにいくつかの新しいマージング手法を導入し、ユーザーが同じベースモデルからの複数の LoRA アダプタをオンザフライで組み合わせて新たな機能を合成できるようにしました。
オープンソースLLMによる合成データで、カスタムモデルのコスト、レイテンシ、炭素排出を削減
Hugging Face は、オープンソース LLM を用いて合成データを生成し、小型 RoBERTa モデルをファインチューニングすることで、推論コストを $3061 から $2.7 に、レイテンシを数秒から 0.13 s に、CO₂ 排出を約 1 t から 0.12 kg に削減し、金融感情分類タスクで GPT‑4 と同等の精度を実現したことを示しています。
AMD パーベイシブ AI デベロッパーコンテスト
AMD と Hugging Face はパーベイシブ AI デベロッパーコンテストを開始するために提携し、開発者に AMD ハードウェアへの無料アクセスと、ジェネレーティブ AI、ロボティクス AI、PC AI の分野で AI アプリケーションを構築するための賞金を提供します。
Hugging Face TGI メッセージ API リリース
Hugging Faceはバージョン1.4.0からText Generation Inference(TGI)向けのMessages APIを導入し、オープンLLM向けにOpenAI Chat Completion APIとの互換性を実現しました。
SegMoE: Segmind の拡散エキスパート混合モデル
SegMoE は、Stable Diffusion アーキテクチャの Feed‑Forward 層をスパース MoE 層に置き換えることで、プロンプト理解を向上させた Mixture‑of‑Experts(MoE)拡散モデルを作成するフレームワークです。
NPHardEval リーダーボード:計算複雑性による LLM 推論の評価
Hugging Face は、計算複雑性クラスを用いて大規模言語モデル(LLM)の論理的推論能力を定量的に測定する動的ベンチマークである NPHardEval リーダーボードを導入しました。
PatchTST の Hugging Face への統合
Hugging Face は、時系列パッチングとチャネル独立性を用いて長期予測を改善し、転移学習を可能にする Transformer ベースのモデルである PatchTST を統合しました。
Hugging Face Text Generation Inference が AWS Inferentia2 をサポート開始
Hugging Face は、Amazon SageMaker を通じて AWS Inferentia2 上で Text Generation Inference の一般提供を開始したことを発表しました。これにより、GPU デプロイの代替として、コスト効果が高くハイスループットな LLM 提供が可能になります。
オープンLLMを用いた憲法AI
Hugging Face は、オープンモデル上で憲法AI(CAI)を実装するためのエンドツーエンドのレシピと llm-swarm ツールを紹介し、ユーザー定義の原則に基づくスケーラブルな自己整合を、コストのかかる人間フィードバックなしで可能にします。
エンタープライズシナリオリーダーボード:実世界ユースケースにおけるLLMの評価
Hugging Face と Patronus AI は、エンタープライズシナリオリーダーボードを立ち上げ、6つの実世界ビジネス課題に対して言語モデルを評価し、学術ベンチマークを超えて実務的なエンタープライズの有用性を測定します。
Optimum Intel を使用した Intel Xeon 上の StarCoder の高速化
Hugging Face と Intel は、8 ビット量子化と支援生成を組み合わせることで、第4世代 Intel Xeon プロセッサ上の StarCoder-15B モデルに対して 7 倍以上の推論高速化を実証しました。
Hugging Face 幻覚リーダーボードの開始と初期結果
Hugging Face は、複数のオープンソースデータセットを用いて LLM の事実性と忠実性のエラーをベンチマークするために Hallucinations Leaderboard を開始し、モデル選択や研究を導く透明なランキングを提供しています。