アーカイブ · ラボ 11 拠点 · ディスパッチ 3,061 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

2551

BERTopic 与 Hugging Face Hub 的集成

Hugging Face 博客文章宣布 BERTopic 与 Hub 的集成,除标题外未提供可读的详细信息。

2552

Hugging Face LLM 推論コンテナ for Amazon SageMaker

Hugging Faceは、オープンソースのLarge Language Modelの高パフォーマンスなデプロイを可能にする、Amazon SageMaker向けの目的別構築LLM推論コンテナ(DLC)をText Generation Inference(TGI)で駆動して発表しました。

2553

OpenAI 民主的入力 AI プログラム

OpenAIは、AIシステムが従うべきルールを決定するための民主的プロセスを開発することを目的とした10件の10万ドルの実験に資金を提供する助成金プログラムを立ち上げました。

2554

NNCFと🤗 Optimumを使ったIntel CPU向けStable Diffusionの最適化

Hugging Faceは、NNCFとOptimumを使用してStable Diffusionを量子化し、Token Mergingを適用するワークフローを発表しました。これにより、Intel CPU上で推論速度が最大5.1倍向上し、モデルのフットプリントが4倍削減されます。

2555

Azure Machine Learning 上の Hugging Face モデル カタログ

Hugging Face と Microsoft は、Azure Machine Learning Studio 内に Hugging Face Hub モデル カタログのネイティブ統合をローンチし、セキュアな Azure インフラストラクチャ上でのオープンソース モデルのデプロイを簡素化しました。

2556

Hugging Face 4ビット量子化とQLoRAリリース

Hugging Faceはbitsandbytesによる4ビット量子化サポートとQLoRA手法を発表し、コンシューマーGPU上で大規模言語モデルの推論とアダプタ微調整を可能にしました。

2557

Anthropic Interpretability Dreams Research Vision

Anthropicは、大規模なニューラルネットワークの分析を可能にするために、重ね合わせの課題の解決に焦点を当てた、メカニズム的解釈可能性に関する長期的なビジョンを概説しています。

2558

Anthropic Circuits Updates May 2023

Anthropicの2023年5月の解釈可能性に関するアップデートは、マルチエージェントシステムの失敗、労働者の再教育プログラムの証拠、および研究用バージョンのClaudeによるリーマンゼータ関数の進展に関する研究をカバーしています。

2559

InstructPix2Pix を用いた Stable Diffusion の指示チューニング

Hugging Face は、InstructPix2Pix を拡張し、マルチタスク指示チューニング手法を通じて Stable Diffusion に特定の画像変換や低レベル処理の指示に従わせることを探求しています。

2560

Hugging Face Safetensors セキュリティ監査とデフォルト採用

Hugging Face、EleutherAI、Stability AI は、Trail of Bits によるセキュリティ監査で任意のコード実行につながる重大な欠陥がないことが確認されたことを受け、safetensors をデフォルトのモデル保存形式へ移行しています。

2561

Hugging Face と IBM の watsonx.ai パートナーシップ

Hugging Face と IBM は提携し、Hugging Face のオープンソースライブラリとモデルを watsonx.ai に統合しました。watsonx.ai は、基盤モデルのトレーニング、チューニング、デプロイを行うエンタープライズ AI スタジオです。

2562

Anthropicが信頼性の高いAI製品を拡大するために4億5000万ドルのシリーズC資金調達を実施

Anthropicは、Claudeアシスタントの開発を加速し、製品ラインナップを拡大し、AI安全性研究に資金を提供するため、Spark Capitalが主導する4億5000万ドルのシリーズC資金調達を実施したと発表しました。

2563

OpenAI 超知能ガバナンス提案

OpenAI は、国際的な調整、IAEA に類似したグローバル規制機関、そして先進的な安全性研究の3本柱からなる超知能管理フレームワークを提案しています。

2564

Q8-Chat: Intel Xeon CPU上の効率的な生成AI

Hugging Face と Intel は、SmoothQuant を使用して LLM を 8 ビット整数に圧縮することで、高品質なチャット体験をシングルソケットの Intel Xeon CPU 上で効率的に実行できることを示しました。

2565

BigCode の背後にある大規模ニア重複除去

Hugging Face は MinHash と Locality Sensitive Hashing (LSH) を活用して BigCode プロジェクト向けに大規模ニア重複除去を実施し、ニア重複データを除去することでモデル性能とトレーニング効率が向上することを示しました。

2566

AnthropicとZoomのパートナーシップおよび投資

AnthropicとZoomは、Claude AIをZoomのエンタープライズ向けコラボレーション製品に統合するために提携し、Zoom VenturesはAnthropicに投資しました。

2567

RWKV アーキテクチャの Hugging Face Transformers への統合

Hugging Face は、RWKV RNN‑Transformer ハイブリッドモデルを Transformers ライブラリに統合したことを発表しました。これにより、RNN の効率性と Transformer の性能を組み合わせた、オープンソースの長文コンテキスト対応言語モデルが利用可能になります。

2568

AMD GPU上で ROCm を使用して Vicuna 13B を実行する

Hugging Face は、ROCm と GPTQ 4 ビット量子化を用いて Vicuna 13B オープンソースチャットボットを単一の AMD GPU 上にデプロイする技術ガイドを提供し、メモリ要件を 28 GB から 7.52 GB に削減します。

2569

Hugging FaceがCNIL拡張支援プログラムに選出

Hugging Faceは、フランスのデータ保護機関(CNIL)の拡張支援プログラムに選ばれ、AI開発におけるデータ保護とGDPR遵守の実装を改善します。

2570

低遅延テキスト生成のための Hugging Face アシスト生成

Hugging Face は Assisted Generation を導入しました。これは小さなアシスタントモデルが候補トークンを予測し、より大きなモデルがそれらを検証するデコード手法で、ハードウェア構成によってはレイテンシを最大 10 倍まで削減します。

2571

AnthropicがClaudeに100Kトークンのコンテキストウィンドウを発表

AnthropicはClaudeのコンテキストウィンドウを9Kから100Kトークンに拡大し、モデルが数百ページのテキストを1分未満で取り込み、分析することを可能にしました。

2572

OpenAI、GPT‑4を使用してGPT‑2の自動ニューロン説明データセットを公開

OpenAI は、GPT‑4 を用いて GPT‑2 のすべてのニューロンに対する自然言語説明を生成・スコア付けする手法を発表し、生成されたデータセット、ビューア、コードを研究コミュニティに公開しました。

2573

StarCoderでコーディングアシスタントを作成 – 要約

この記事では、Hugging Face チームが 16 B パラメータの StarCoder コード生成モデルを会話型コーディングアシスタント(StarChat‑α)に変換した方法を説明しています。特別なチャットトークンを追加し、フィルタ済みの Open‑Assistant 対話データセットを準備し、DeepSpeed ZeRO‑3 でファインチューニングすることで、ユーザーのプロンプトを理解し、実行可能なコード(例:プロット、地図、可視化)を生成できるモデルを訓練しました。記事では、トークナイザーの設定、ユーザーターンのロスマスキング、トレーニング環境、評価(ベンチマークと LLM ベースの両方)、制限事項、今後の方向性についても取り上げています。完成したモデルは Hub で公開されています。

2574

Claudeの憲法:モデルのアライメントのための憲法AIの実装

Anthropicは、暗黙的な人間によるフィードバックにのみ頼るのではなく、明示的な一連の書かれた原則に基づいて、Claudeを「有用、誠実、無害」にするためのトレーニング手法である憲法AIを導入しています。

2575

テキストからビデオへのモデルへの深掘り

Hugging Face は、テキストからビデオへの生成モデルの進化について技術的な概要を提供し、GAN から Transformer、Diffusion アーキテクチャへの移行を詳述するとともに、時間的一貫性とデータ不足という独自の課題を強調しています。

2576

StarCoder リリースノート

Hugging Face と ServiceNow の BigCode 共同プロジェクトは、許可されたライセンスのデータで学習された 15B パラメータのコード LLM である StarCoder と StarCoderBase をリリースしました。これらはプログラミングベンチマークで複数のオープンおよびクローズドモデルを上回ります。

2577

Anthropic Research: Distributed Representations, Composition, and Superposition

Anthropicは、分散表現における組成と重ね合わせの区別を明確にし、これら2つのメカニズムがニューラルネットワークの汎化と線形計算可能性にどのように影響するかを説明しています。

2578

Hugging Face Unity API インストールと使用ガイド

Hugging Face Unity API は、専用パッケージと API ウィザードを通じて、開発者が Hugging Face Inference API のモデルを Unity プロジェクトに統合できるようにします。

2579

Hugging Face Transformers、TensorFlow、TPU を使用した言語モデルのトレーニング

Hugging Face は、TensorFlow と TPU ポッドを使用してマスク付き言語モデルをスクラッチからトレーニングするためのスケーラブルなエンドツーエンドガイドを提供し、XLA 互換性を活用して高性能コンピューティングを実現します。

2580

Databricks と Hugging Face が Apache Spark を統合し、LLM のトレーニングを高速化

Databricks は Dataset.from_spark() 関数を通じて Hugging Face Datasets に本格的な Apache Spark サポートを導入し、大規模モデルのトレーニングとチューニングにおけるデータロード時間を最大 40% 短縮しました。

2581

Diffusers を使用した無料ティアの Google Colab で DeepFloyd IF を実行する

Hugging Face は、8 ビット量子化、モジュラー パイプラインのロード、Diffusers 統合の最適化を使用して、オープンソースの DeepFloyd IF テキスト‑ツー‑イメージモデルを無料の Google Colab ノートブックで実行する方法を示しています。

2582

AnthropicとScaleのエンタープライズ向け生成AIパートナーシップ

AnthropicはScaleと提携し、Claude AIアシスタントをScaleのプラットフォームに統合することで、企業にデプロイメントツール、プロンプトエンジニアリング、および安全なデータ統合を提供します。

2583

OpenAI、ChatGPT向けの新しいデータ管理コントロールを導入

OpenAIは、ユーザーの会話がモデル学習に使用されるのを防ぐためにチャット履歴を無効化する新設定を導入し、ChatGPT Businessサブスクリプションと新しいデータエクスポートツールの計画も発表しました。

2584

Hugging Face、グローバルAIコミュニティを支援するために中国語ブログを開始

Hugging Faceは、翻訳された技術リソースを提供し、中国のAIコミュニティとの協力を深めるために、専用の中国語ブログ(hf.co/blog/zh)を開始しました。

2585

Hugging Face SpacesでUnityゲームをホストする

Hugging Face Spacesは、Static HTMLテンプレートとWebGLビルドターゲットを活用することで、プレイ可能なUnityゲームをホストできます。

2586

AI測定のためのNISTへの資金提供増額に関するAnthropicの提案

Anthropicは、標準化されたAI測定ツールと安全性の閾値を開発するために、国立標準技術研究所(NIST)への資金提供を野心的に増額することを提案しています。これは、効果的なAI規制を実現するための前提条件であると彼らは主張しています。

2587

AWS Inferentia2 で Hugging Face Transformers を高速化

Hugging Face と AWS は、特定用途向け推論アクセラレータである AWS Inferentia2 用に Transformers を最適化し、大規模モデルのレイテンシを大幅に削減し、スループットを向上させました。

2588

トランスフォーマーによるグラフ分類

Hugging Face は、Transformers ライブラリ内の Graphormer モデルを使用したグラフ分類の実施方法を示し、データのフォーマット、前処理、ファインチューニングについて解説しています。

2589

Substraでプライバシー保護AIを作成する

Hugging Face と Substra は、フェデレーテッドラーニングが分散したデータソース上で AI モデルのトレーニングを可能にし、特に医療などの機密性の高い領域でプライバシーとセキュリティを維持できることを示しています。

2590

OpenAI バグバウンティプログラムのお知らせ

OpenAI は Bugcrowd と提携し、システムの脆弱性を特定・対処するセキュリティ研究者に報酬を提供するバグバウンティプログラムを開始しました。

2591

エンタープライズ向け基盤モデルのための Snorkel AI と Hugging Face の統合

Snorkel AI は Hugging Face と提携し、Hugging Face Inference Endpoints を Snorkel Flow に統合しました。これにより、エンタープライズは 150,000 以上のオープンソース基盤モデルに簡単にアクセスし、適応させることができます。

2592

OpenAI の AI 安全へのアプローチ

OpenAI は、厳格な事前展開テスト、反復的な実世界展開、継続的なアラインメント研究を組み合わせた多層的な安全戦略を採用し、強力な AI システムに伴うリスクを軽減しています。

2593

StackLLaMA: Stack Exchange向けにRLHFでLLaMAをトレーニング

Hugging Faceは、Supervised Fine-tuning、Reward Modeling、そしてHuman Feedbackによる強化学習(RLHF)を用いてStack Exchangeの質問に回答するために訓練されたモデル、StackLLaMAを発表しました。

2594

Hugging Face Ethics and Society ニュースレター #3: 倫理的オープンネスイニシアチブ

Hugging Face は、6 つの倫理タグ、フラグ機能、閲覧者向けメタデータなどの新しい倫理的オープンネス施策を発表し、オープンソースの機械学習をより安全で包括的にすることを目指しています。

2595

Intel Sapphire Rapids CPUでのStable Diffusion推論の高速化

Hugging Faceは、Optimum Intel、OpenVINO、システムレベルの調整、IPEX BF16、そして高速なスケジューラを使用して、Intel Sapphire Rapids CPU上でStable Diffusionの画像生成を32秒から約5秒に短縮する方法を示しています。

2596

Habana Gaudi2アクセラレータ上でのBLOOMZ推論

Hugging Faceは、Optimum HabanaライブラリとDeepSpeed-inferenceを活用し、Habana Gaudi2アクセラレータがNvidia A100 80GBよりもBLOOMZ 176Bモデルの推論を高速に実行できることを示しました。

2597

Hugging Face と Flower を用いたフェデレーテッドラーニング

Hugging Face は、Flower フレームワークを使用して、事前学習済みの distilBERT モデルを IMDB データセットの感情分析に対してフェデレーテッドラーニングを実行する方法を示しています。

2598

OpenAI 3月20日 ChatGPT 停止とデータ漏洩分析

OpenAIは2023年3月20日に、オープンソースライブラリのバグにより、アクティブなChatGPT Plus加入者の一部に対してチャットタイトルと支払い情報が漏洩したため、ChatGPTをオフラインにしました。

2599

Hugging Face DiffusersでControlNetをトレーニングする

Hugging Faceは、diffusersライブラリを通じて包括的なガイドとトレーニングスクリプトを提供し、ユーザーがStable Diffusion用のカスタムControlNetモデルをトレーニングできるようにしています。これは「Uncanny Faces」ポーズモデルの作成で実証されています。

2600

ChatGPT プラグインのリリース

OpenAI は ChatGPT 用のプラグインを導入し、モデルがリアルタイム情報にアクセスし、計算を実行し、サードパーティサービスと統合できるようにすることで、ユーティリティを拡大し、幻覚(ハルシネーション)を減らします。