7051

SetFitABSA: 少数ショットのアスペクトベース感情分析

Hugging Face と Intel Labs は、プロンプト不要で少数ショットのアスペクトベース感情分析フレームワークである SetFitABSA を導入しました。このフレームワークは、データが少ないシナリオにおいて、Llama 2 や T5 などの大規模生成モデルを上回る性能を示します。

7052

Optimum-NVIDIA リリースノート

Hugging Face は、FP8 量子化と TensorRT-LLM を使用して NVIDIA プラットフォーム上の LLM 推論を最大 28 倍に高速化する推論ライブラリ Optimum-NVIDIA をリリースしました。

7053

Hugging Face LoRA 動的ロードで推論速度が300%向上し、レイテンシを削減

Hugging Face は、ウォームアップ時間を 25 秒から 3 秒に短縮し、LoRA 推論を最大 300 % 高速化、総応答時間を 35 秒から 13 秒に削減する動的 LoRA ローディングシステムを発表しました。

7054

Hugging Face と AMD GPU 加速 for LLMs

Hugging Face と AMD は、Transformers ライブラリと Text Generation Inference に AMD Instinct GPU 用の即時サポートを統合し、コード変更なしで高性能な LLM 実行を可能にしました。

7055

Hugging Face Open LLM Leaderboard DROP ベンチマーク分析

Hugging Face は、誤った正規化とストップトークンの設定によりほとんどのモデルが誤って低いスコアになることを発見した後、Open LLM Leaderboard から DROP ベンチマークを削除しました。

7056

OpenAI リーダーシップ アップデート: サム・アルトマンが CEO に復帰

サム・アルトマンは、新しい初期取締役会の支援と企業ガバナンスの強化へのコミットメントにより、OpenAI の CEO に復帰しました。

7057

OpenAI リーダーシップ移行: ミラ・ムラティが暫定CEOに任命

OpenAIは、CEO役職と取締役会の両方を離れたサム・アルトマンの退任後に、ミラ・ムラティを暫定CEOに任命しました。

7058

OpenAI データパートナーシップ

OpenAIは、組織と協力して公共およびプライベートなデータセットを作成し、AIモデルのトレーニングに使用することで、ドメイン固有の理解を向上させ、AGIへの進展を目指すデータパートナーシッププログラムを立ち上げました。

7059

SDXL と Stable Diffusion の 高速 推論 と Latent Consistency LoRAs

Hugging Face は、SDXL と Stable Diffusion モデルで 4 ~ 8 ステップの 高品質 画像 生成 を 可能 に する LCM LoRAs という 手法 を 紹介 し、推論 時間 を 大幅 に 短縮 しました。

7060

Prodigy-HF 統合リリースノート

Explosionは、注釈付きデータ上でHugging Faceトランスフォーマーモデルの直接ファインチューニングを可能にし、Hugging Face Hubへのデータセットの直接アップロードを可能にするプラグインProdigy-HFをリリースしました。

7061

optimum-neuron を使用した AWS Inferentia2 上への Llama 2 のデプロイ

Hugging Face は、高性能なテキスト生成のために、Llama 2 モデルを AWS Inferentia2 アクセラレータ上でデプロイできるように、optimum-neuron を AWS Neuron SDK と統合しました。

7062

LoRAを用いた災害ツイート分類におけるRoBERTa、Llama 2、およびMistralの比較

Low-Rank Adaptation (LoRA) を用いてファインチューニングした場合、小規模なRoBERTaモデルが災害ツイートの二値分類においてLlama 2およびMistral 7Bよりも優れた性能を示すことが比較研究により明らかになりました。

7063

OpenAI が GPTs を発表

OpenAI は、コーディング不要で特定の目的のためにユーザーが作成できる ChatGPT のカスタムバージョンである GPTs をローンチし、個人、職場、エンタープライズ向けのカスタマイズされた AI アシスタントを可能にしました。

7064

OpenAI DevDay 2023: GPT-4 Turbo, Assistants API, and Multimodal Updates

OpenAIは、128Kのコンテキストウィンドウを備えたGPT-4 Turbo、エージェントのような体験を実現する新しいAssistants API、そしてDALL·E 3やTTSを含む拡張されたマルチモーダル機能を発表しました。

7065

Hugging Face Hub ストレージリージョン

Hugging Faceは、Enterprise Hubの顧客向けにストレージリージョンを導入し、組織がモデルとデータセットの保存場所を選択できるようになり、規制遵守とデータ転送パフォーマンスの向上を実現します。

7066

パーソナル Copilot: 自分専用のコーディングアシスタントを訓練する

Hugging Faceは、QLoRAおよびフルファインチューニング技術を使用してStarCoderを特定のコードベースでファインチューニングすることにより、パーソナライズされたコーディングアシスタントであるHugCoderを作成する方法を実証しています。

7067

OpenAI フロンティアリスクと準備フレームワーク

OpenAIは、フロンティアAIモデルに関連する災害的リスクを特定、評価、軽減するため、専門のPreparednessチームとRisk-Informed Development Policyを設立しました。

7068

フロンティアモデルフォーラム アップデート

OpenAI、Anthropic、Google、およびMicrosoftは、Chris Meseroleをフロンティアモデルフォーラムのエグゼクティブディレクターに任命し、1000万ドルのAIセーフティファンドを設立して、能力のあるAIモデルの評価に関する研究を推進しました。

7069

Hugging Face と Renumics Spotlight の統合によるスケーラブルなデータ検査

Hugging Face は Renumics Spotlight と統合し、1 行のコードで機械学習データセットのインタラクティブな可視化と検査を可能にし、マルチモーダルデータとモデル結果のサポートも含みます。

7070

Stable Diffusion XL (SDXL) の推論速度とメモリ使用量の最適化

Hugging Faceは、Stable Diffusion XL (SDXL) のメモリ使用量を28GBから最小11.47GBまで削減し、推論レイテンシを72.2秒から約10.3秒まで短縮する方法を示す、いくつかの最適化手法を調査しています。

7071

Hugging Face Inference Endpoints を使用したエンベディングモデルのデプロイ

Hugging Face は、Inference Endpoints を通じて Text Embeddings Inference (TEI) を導入し、RAG やセマンティック検索向けのオープンソースエンベディングモデルを高パフォーマンスかつコスト効率よくデプロイする方法を提供します。

7072

PPOを用いたRLHFの実装詳細 – Hugging Face Blog 要約

Hugging Faceのブログ記事は、OpenAIの2019年のRLHFコードベースを再現して学習曲線の一致を確認し、よりアグレッシブな更新を引き起こすPyTorch Adamオプティマイザの重要な違いを含む、詳細な実装仕様を記述しています。

7073

ChatGPT PlusおよびEnterpriseでのDALL·E 3の統合

OpenAIはChatGPT PlusおよびEnterpriseにDALL·E 3を統合し、視覚的忠実度が高く、プロンプトへの従順性が向上し、テキスト、手、顔のレンダリングが改善されたモデルを導入しました。

7074

Gradio-Lite: ブラウザ内で完全に動作するサーバーレス Gradio

Hugging Face は、Pyodide を使用して Gradio アプリケーションをウェブブラウザで直接実行し、サーバーサイドインフラストラクチャの必要性をなくす JavaScript ライブラリである Gradio-Lite (@gradio/lite) を紹介します。

7075

Typeform Formless: AIを活用した会話型データ収集

Typeformは、GPT-3.5 TurboとGPT-4を基盤とするAIを活用したプラットフォームFormlessを発表しました。これにより、従来のフォーム構造が動的な双方向会話型体験に置き換わります。

7076

Ironclad AI Assist の GPT-4 統合

Ironclad は AI Assist を通じて契約ライフサイクル管理プラットフォームに GPT-4 を統合し、初期の契約レッドライン時間を 40 分から 2 分に短縮しました。

7077

Retool AI と GPT-4 の統合

Retool は、GPT-4 を駆動する機能スイートである Retool AI をローンチしました。これにより、ビジュアル キャンバスを使用してカスタム AI 駆動アプリケーションとワークフローを構築できるようになります。

7078

ONNX Runtime を使用した Hugging Face モデルの高速化

Hugging Face と ONNX Runtime は、130,000 を超えるモデルのパフォーマンス向上を可能にし、PyTorch と比較して whisper-tiny モデルのレイテンシーを最大 74.30% 削減します。

7079

DALL·E 3 システムカード

OpenAIは、DALL·E 2と比較してキャプションの忠実度と画像品質の改善を詳細に説明したDALL·E 3システムカードをリリースし、広範な安全評価とリスク軽減策も併せて示しました。

7080

Hugging Face チャットテンプレート

Hugging Faceは、チャットモデルがトレーニング時と全く同じ形式で入力を受け取れるようにし、サイレントなパフォーマンス低下を防ぐためのJinjaベースのシステムとして、チャットテンプレートを導入しました。

7081

Cloud TPU v5e上のJAXを使用したStable Diffusion XL推論の高速化

Hugging Face Diffusersは、Cloud TPU v5e上のJAXを使用してStable Diffusion XL(SDXL)の提供をサポートし、TPU v4と比較してドルあたりの性能が最大2.4倍向上します。

7082

Hugging Face Inference API を使用した AI Comic Factory のデプロイ

Hugging Face は、Inference API を使用して AI Comic Factory のプライベート インスタンスをデプロイするガイドを提供しており、Llama-2 と SDXL 1.0 モデルを活用しています。

7083

TRL を用いた DDPO による Stable Diffusion のファインチューニング

Hugging Face は TRL ライブラリに Denoising Diffusion Policy Optimization (DDPO) を統合し、強化学習を使用して Stable Diffusion モデルを人間の好みに合わせることを可能にしました。

7084

Hugging Face 倫理と社会 アップデート 2023年夏

Hugging Faceは、米国、EU、英国におけるAI規制に影響を与えるための2023年夏の取り組みを詳しく説明し、公共の広報活動と技術的研究を通じてオープンソースの倫理を推進しました。

7085

Hugging Face ガイド: コード不要で LLaMA 2 チャットボットをトレーニング

Hugging Face は、Spaces、AutoTrain、ChatUI を使用したノーコード ワークフローを提供し、エンジニアでないユーザーでも LLaMA 2 をファインチューニングし、機能的なチャット アプリケーションとしてデプロイできるようにします。

7086

Llama 2 on Amazon SageMaker ベンチマーク

Hugging Face は、Amazon SageMaker 上の Llama 2 の 60 種類のデプロイ構成を分析し、コスト、スループット、レイテンシに対して最適なセットアップを特定しました。

7087

GPT-4V(ision) システムカード

OpenAIは、GPT-4のマルチモーダル拡張であるGPT-4V(ision)を導入しました。これにより、モデルは画像入力を分析および処理し、新しいタスクを解決し、新規のユーザーエクスペリエンスを提供できるようになります。

7088

ChatGPT 音声と画像機能アップデート

OpenAIはChatGPTにマルチモーダル機能を導入し、Plusおよびエンタープライズユーザーが音声会話を行い、画像を共有して分析できるようにしました。

7089

Hugging Face PRO向け推論

Hugging FaceはPROユーザー向けにInferenceを導入し、キュレートされた最先端モデルへの高速APIエンドポイントと、無料Inference APIのレート制限の向上を提供します。

7090

OpenAI レッドチームネットワーク

OpenAIは、レッドチームネットワークを立ち上げました。これは、AIモデルを厳密に評価し、リスクを特定し、開発ライフサイクル全体を通じて安全性を向上させる任務を負った、グローバルな専門家による正式なコミュニティです。

7091

Rocket Money x Hugging Face: 本番環境での変動的MLモデルのスケーリング

Rocket Moneyは、Hugging FaceのInference APIを使用してレガシーなregexベースのシステムを置き換えることで、トランザクション分類システムを月間10億件以上にスケールさせました。

7092

3D Gaussian Splatting入門

3D Gaussian Splattingは、少数の画像から学習したフォトリアリスティックな3Dシーンのリアルタイムレンダリングを可能にするラスタライズ技術です。

7093

Hugging Face オブジェクト検出 リーダーボード

Hugging Face は、COCO スタイルのメトリクスを使用してオープンソース モデルをランク付けする Object Detection Leaderboard をリリースし、Average Precision と Average Recall の計算方法および結果に影響を与える要因を説明するブログを公開しました。

7094

本番環境でのLLM最適化: 精度、注意、アーキテクチャ

Hugging Faceは、効率的なLLMデプロイのための主要な技術を概説し、低精度量子化、メモリ効率のためのFlash Attention、およびRoPE、ALiBi、MQA、GQAなどのアーキテクチャ最適化に焦点を当てています。

7095

OpenAIは新しいダブリン事務所でヨーロッパでのプレゼンスを確立

OpenAIはアイルランドのダブリンに新しいオフィスを開設し、ヨーロッパでの運営、信頼と安全、セキュリティエンジニアリング、法務機能を拡大しています。

7096

PyTorch FSDP を使用した Llama 2 70B のファインチューニング

Hugging Face は、PyTorch Fully Sharded Data Parallelism (FSDP) と Accelerate を使用して Llama 2 70B をファインチューニングし、CPU RAM のボトルネックを克服し、VRAM 使用量を最適化する方法を示しています。

7097

Würstchenの紹介: 画像生成のための高速ディフュージョン

Würstchenは、42xの空間圧縮を達成し、トレーニングと推論のコストを大幅に削減する高速かつ効率的なテキスト・トゥ・イメージディフュージョンモデルです。

7098

Hugging Face Transformers 量子化の概要

Hugging Face は、bitsandbytes と auto-gptq の量子化スキームをネイティブにサポートし、小型デバイスでの大規模モデルの推論と効率的なアダプター ファインチューニングを可能にします。

7099

SafeCoder と クローズドソース コード アシスタント

Hugging Face は、オープンソースの StarCoder モデルに基づくエンタープライズグレードのコード アシスタントである SafeCoder を発表しました。これは、クローズドソースの代替品よりも透明性、カスタマイズ性、データ プライバシーを優先します。

7100

T2I-Adapters を用いた SDXL の効率的な制御可能な生成

Hugging Face と TencentARC は、軽量なプラグアンドプレイ モデルである T2I-Adapter-SDXL を紹介します。このモデルは、スケッチや深度マップなどの外部信号を使用して Stable Diffusion XL (SDXL) の生成を精密に制御でき、ControlNet と比較して計算オーバーヘッドが大幅に低減されます。