Hugging Face Accelerate: PyTorchで大規模モデルを実行する
Hugging Face Accelerateは、PyTorch の meta デバイスとシャーディングチェックポイントを活用し、GPU、CPU RAM、ディスクにまたがるメモリ管理を行うことで、コンシューマーハードウェア上で巨大な AI モデルの実行を可能にします。
SetFit: プロンプト不要の効率的な少数ショット学習
Hugging Face は、最小限のラベル付きデータで高精度を実現する、プロンプト不要の Sentence Transformer 少数ショットファインチューニングフレームワークである SetFit を紹介します。
Hugging Face Ethics and Society ニュースレター #1
Hugging Face は Ethics and Society ニュースレターを開始し、協働・透明性・責任という価値に基づく分散型のアプローチで AI 倫理を実践化する方法を概説しています。
DeepSpeed と Accelerate を用いた驚異的に高速な BLOOM 推論
Hugging Face は、8×80 GB A100 GPU 上で DeepSpeed‑Inference のテンソル並列と Accelerate のパイプライン並列を使用し、176B パラメータの BLOOM モデルでトークンあたりミリ秒未満の生成を実証しました。
Diffusers 0.3 リリースは、画像から画像への変換、テキストインバージョン、インペインティング、GPU 最適化、Mac MPS、ONNX サポート、そして新しいドキュメントを追加します
Hugging Face は Diffusers バージョン 0.3 を発表し、画像から画像への変換、テキストインバージョン、実験的インペインティング、低スペック GPU 向け最適化、Mac MPS サポート、ONNX エクスポーター、拡張されたドキュメント、そして多数のコミュニティプロジェクトを導入しました。
オフライン強化学習のためのDecision Transformersのトレーニング
Hugging Face は、transformers の Trainer とカスタムデータコレータを使用して、HalfCheetah 環境を解くためにオフライン Decision Transformer をゼロからトレーニングするためのガイドと実装を提供しています。
Megatron-LM を用いた言語モデルのトレーニング
Hugging Face は、NVIDIA の Megatron-LM フレームワークを使用して GPU 上で大規模言語モデルを効率的に事前学習する方法と、Transformers ライブラリとの統合についてのガイドを提供しています。
OpenRAIL: オープンで責任あるAIライセンスフレームワークへ向けて
Hugging Face は、オープンアクセスと使用ベースの制限を組み合わせ、機械学習モデルの責任ある展開を促進する AI 特化型ライセンス群「OpenRAIL」を発表しました。
Hugging Face Spacesでタンパク質を可視化
Hugging Face は、Gradio を介して 3Dmol.js を Hugging Face Spaces に統合し、ブラウザ上で 3D タンパク質構造の可視化を可能にするガイドを提供しています。
Hugging Face Transformers と Habana Gaudi を使用した BERT の事前学習
Hugging Face は、AWS の Habana Gaudi DL1 インスタンスを使用して BERT-base をスクラッチから事前学習する方法を示し、NVIDIA V100 GPU ベースのトレーニングと比較して 25% のコスト削減を実現しています。
Diffusers を使った Stable Diffusion
Hugging Face は、Diffusers ライブラリを使用してテキストから画像への Stable Diffusion モデルを実行する方法を発表し、コード、ライセンス情報、そしてモデルの潜在拡散アーキテクチャの解説を提供しました。
Vertex AI で Hugging Face ViT をデプロイする
Hugging Face は、Google Cloud の Vertex AI プラットフォーム上で Vision Transformer (ViT) モデルをデプロイし、Kubernetes レベルのスケーラビリティを大幅にコード量を削減して実現する方法を示しています。
Hugging Face Optimum Graphcore 上の Vision Transformers
Hugging Face と Graphcore は、Optimum ライブラリを使用して、Intelligence Processing Units(IPU)上で Vision Transformer(ViT)モデルの効率的なファインチューニングを可能にし、マルチラベル胸部X線分類タスクでその有用性を示しています。
Hugging Face、LLM.int8() 8ビット行列乗算を Transformers と Accelerate に統合
Hugging Face は、LLM.int8() 8ビット量子化手法を Transformers と Accelerate ライブラリに統合し、性能低下なしで非常に大規模な言語モデルの推論を可能にし、最大で 2 倍のメモリ削減を実現しました。
Hugging FaceのTensorFlow哲学
Hugging FaceはTensorFlow統合に対する技術的アプローチを概説し、KerasとXLAとの深い整合性を強調して、トランスフォーマーモデルのパフォーマンスとデプロイメントを最適化しています。
Skops ライブラリは scikit-learn モデルのホスティング、ドキュメント作成、そして Hugging Face Hub 上でのコラボレーションを可能にします
Hugging Face は Skops を発表しました。このライブラリは、ユーザーが scikit-learn モデルをパッケージ化し、ドキュメント化し、Hub に自動生成されたモデルカードと推論ウィジェットと共にプッシュできるようにします。
TF Serving を使用した Kubernetes 上の Hugging Face ViT デプロイ
Hugging Face は、Docker と Kubernetes、TensorFlow Serving を用いて Vision Transformer (ViT) のデプロイをスケールさせる技術ガイドを提供し、プロダクションレベルのオートスケーリングとリソース管理を実現します。
Hugging Face Sentence Transformers トレーニングガイド(歴史的リファレンス)
Hugging Face は、Sentence Transformers モデルのトレーニングとファインチューニングに関する古いチュートリアルを発表し、モデルのアーキテクチャ、データセット形式、損失関数、モデルのアップロード方法を説明するとともに、ユーザーを新しいトレーニング API に案内しています。
Hugging Face Deep RL クラス ユニット8:近接方策最適化(PPO)解説
Hugging Face は近接方策最適化(PPO)の詳細なウォークスルーを公開し、方策更新比率をクリップすることで学習を安定化させる仕組みを示し、CartPole‑v1 と LunarLander‑v2 で検証した、スクラッチからの PyTorch 実装を提供しました。
Hugging Face Private Hub の紹介
Hugging Face は Private Hub(現在は Enterprise Hub)を導入し、企業が機械学習モデル、データセット、Spaces を統一されたツールセットで共同作業できる、安全でコンプライアンスに準拠した環境を提供します。
Nyströmformer: Nyström 法による線形時間とメモリでの自己注意の近似
Nyströmformer は Nyström 法を用いてサンプリングされたランドマークでソフトマックス行列を近似することで、標準的な自己注意の計算量とメモリ使用量を O(n^2) から O(n) に削減します。
米国ナショナルAI研究リソースに対するHugging Faceの提言
Hugging Faceはホワイトハウスと国立科学財団に対し、ナショナルAI研究リソース(NAIRR)が倫理的専門性、標準化されたドキュメンテーション、そしてアクセスしやすいツールを優先し、AI研究の民主化を促進すべきだという回答を提出しました。
Hugging Face Datasets の音声およびビジョン ドキュメント更新
Hugging Face は 🤗 Datasets ライブラリのドキュメントを拡充し、音声およびビジョンデータセット向けの専用ガイドとツールを追加して、マルチモーダルデータのロードと処理を簡素化しました。
TensorFlow と XLA を使用した高速テキスト生成
Hugging Face は TensorFlow を使用した transformers ライブラリでテキスト生成に XLA コンパイルを有効化し、最大 100 倍の速度向上と、しばしば PyTorch を上回る性能を実現しました。
Hugging Face で TF Serving を使用した TensorFlow ビジョンモデルのデプロイ
Hugging Face は、Vision Transformer (ViT) などの TensorFlow ビジョンモデルを TensorFlow Serving を使用してデプロイし、REST または gRPC エンドポイントとして公開する方法に関するガイドを提供しています。
Advantage Actor Critic (A2C) の解説
Hugging Face は、ポリシーベースと価値ベースの手法を組み合わせてポリシー勾配推定の分散を低減するハイブリッド強化学習アーキテクチャである Advantage Actor Critic (A2C) を解説しています。
MNIST 用 Dynamic Adversarial Data Collection(DADC) – Hugging Face チュートリアル
Hugging Face は、MNIST における Dynamic Adversarial Data Collection(DADC)のステップバイステップチュートリアルを発表し、人間が生成した敵対的サンプルを収集し、モデルを再訓練してロバスト性を向上させる方法を示しました。
BLOOM 176B トレーニング技術概要
Hugging Face は、384 台の A100 GPU、Megatron‑DeepSpeed の 3D 並列化、BF16 混合精度を用いて 1760 億パラメータの BLOOM モデルがどのようにトレーニングされたかを詳細に解説し、ハードウェア、ソフトウェアスタック、エンジニアリング上の課題を強調しました。
Sentence Transformers を使用したプレイリストジェネレーターの構築
Hugging Face は、歌詞埋め込みに Sentence Transformers を、ユーザーインターフェースに Gradio Blocks を使用した、意味検索ベースのプレイリストジェネレーターの作り方を示しています。
BLOOM: 世界最大のオープンマルチリンガル言語モデル
Hugging Face と BigScience プロジェクトは、46 の自然言語と 13 のプログラミング言語にわたって完全に透明なトレーニングを行った、1760 億パラメータのオープンアクセスマルチリンガル言語モデル BLOOM をリリースしました。
Twitterで感情分析を始める
Hugging Face は、開発者とノンコーダーの両方向けに、Inference API を使用して Twitter データの自動感情分析を実行するガイドを提供しています。
PyTorchによるポリシー勾配 – Hugging Face Deep RLクラス ユニット5
Hugging Faceは、PyTorchでREINFORCE(モンテカルロ・ポリシー勾配)アルゴリズムをゼロから実装し、CartPole‑v1、PixelCopter、Pongで評価するチュートリアルを公開しました。
Sentence Transformers を使用した機械学習入門
Hugging Face は、初心者が Sentence Transformers ライブラリを使用して埋め込みを作成し、セマンティック検索を実行することで、最初の機械学習プロジェクトを開始するためのガイドを提供しています。
Hugging Face の Hub 上での評価
Hugging Face は Evaluation on the Hub を導入しました。これは AutoTrain が提供するノーコードツールで、ユーザーは Hugging Face Hub 上で任意のモデルを任意のデータセット上で任意の指標を用いて評価できます。
DeepSpeed を使用した大規模モデルのトレーニングを加速する
Hugging Face は、Accelerate ライブラリを使用して DeepSpeed の ZeRO 最適化を統合する方法を示し、バッチサイズを大きくし、GPU メモリを超えてしまうようなモデルのトレーニングを可能にします。
埋め込みの入門 – Hugging Face チュートリアル
Hugging Face は、Sentence‑Transformers ライブラリと Hugging Face Hub を使用してベクトル埋め込みを作成、ホスト、クエリする手順を示すガイドを発表し、検索可能な FAQ システムを実演しました。
Hugging Face OptimumでTransformersをONNXに変換
Hugging Face は、低レベルの torch.onnx API からハイレベルの Optimum ライブラリまで、Transformers モデルを ONNX に変換する 3 つの方法を提供しています。
Intel と Hugging Face の機械学習ハードウェアアクセラレーションに関するパートナーシップ
Intel は Hugging Face ハードウェアパートナープログラムに参加し、Optimum Intel ライブラリを開発しています。これにより、Intel プラットフォーム上での Transformer モデルのトレーニング、ファインチューニング、推論におけるハードウェアアクセラレーションが効率化されます。
Hugging Face 機械学習インサイト部ディレクター:金融エディション
U.S. Bank、RBC、Moody's Analytics の専門家は、機械学習が詐欺検出やパーソナライズされた製品を通じて金融を変革していること、そしてレガシーシステムや規制要件といった課題に対処しながら進めていることを議論しています。
スペースインベーダーでのDeep Q-Learning
Hugging Face は、Atari ゲームのような高次元状態空間に対して Q 値を近似するためにニューラルネットワークを使用する強化学習手法、Deep Q-Learning(DQN)について解説しています。
注釈付き拡散モデル – DDPM実装の詳細なウォークスルー
Hugging Face は、拡散モデル(DDPM)を構築、訓練、サンプリングする方法を示す、注釈付きのステップバイステップ PyTorch 実装を公開しました。
Graphcore と Hugging Face が IPU 対応トランスフォーマーモデルを拡張
Graphcore と Hugging Face は、Graphcore IPU 用に NLP、音声、コンピュータビジョンの分野で 10 の最適化されたトランスフォーマーモデルを含むように Hugging Face Optimum ライブラリを拡張しました。
Hugging Face Hub コミュニティアップデート:プルリクエストとディスカッション
Hugging Face は Hub にプルリクエストとディスカッションを導入し、リポジトリのフォークなしでモデル、データセット、Spaces 全体での協働を可能にしました。
TAPEX: ニューラルSQL実行による効率的なテーブル事前学習
TAPEX は、合成された SQL 実行ペアを用いたテーブル事前学習手法で、テーブル質問応答や事実検証において従来手法よりもはるかに高い効率で最先端の結果を達成します。
Hugging Face Q学習入門
Hugging Face は、Qテーブルを使用して最適な状態-行動ペアを決定する、オフポリシーの価値ベース強化学習手法である Q-Learning に関する技術ガイドを提供しています。
Hugging Face マルチモーダルプロジェクト倫理憲章
Hugging Face は、マルチモーダル学習プロジェクトのために倫理憲章を策定し、倫理原則、透明性、公平性を機械学習研究ライフサイクルに直接組み込んでいます。
Sempre Health ケーススタディ:Hugging Face エキスパートアクセラレーションプログラムでNLPパイプラインを加速
Sempre Healthは、Hugging Face エキスパートアクセラレーションプログラムを活用してNLPパイプラインを導入し、受信患者メッセージの20%以上を自動で処理することで、ビジネスのスケーラビリティを大幅に向上させました。
Hugging Face Deep RL コース ユニット2 パート1:Q-ラーニング概念の紹介
Hugging Face は Deep Reinforcement Learning コースの第1部を公開し、価値ベース手法、ベルマン方程式、Monte‑Carlo と Temporal‑Difference 学習を Q‑Learning の基礎として解説しました。
Hugging Face フェローシッププログラムのお知らせ
Hugging Face は、リソース、認知、そして個別のサポートを通じて、オープンソース機械学習エコシステムの主要な貢献者を支援し、力を与えるためにフェローシッププログラムを開始しました。
機械学習エキスパートインタビュー:サシャ・ルチオーニ – 倫理的AIと気候影響のハイライト
Hugging Faceは研究科学者のサシャ・ルチオーニにインタビューし、倫理的AI、カーボンフットプリント測定、そして機械学習を気候や社会課題に応用する取り組みについて語ってもらいました。