OpenAI、退役米軍将軍ポール・M・ナカソネを取締役会に任命
OpenAIは、AIの能力がAGIへと進展する中で、企業のサイバーセキュリティ体制と安全監視を強化するため、退役米軍将軍ポール・M・ナカソネを取締役会に任命しました。
Hugging Face Accelerate: DeepSpeed と FSDP の精度を調和させる
Hugging Face Accelerate 0.30.0 は、PyTorch FSDP の精度処理を DeepSpeed と合わせるために自動アップキャストを導入し、収束性を失うことなく 2 つのバックエンド間をシームレスに切り替えられるようにしました。
Diffusers との Stable Diffusion 3 Medium 統合
Hugging Face は Stable Diffusion 3 Medium(2B パラメータ)を Diffusers ライブラリに統合し、マルチモーダル拡散トランスフォーマー(MMDiT)と整流フローマッチングを導入して、テキストから画像への合成を改善しました。
Hugging Face TRL RLOO トレーナー リリース
Hugging FaceはTRLにRLOO(REINFORCE Leave One-Out)トレーナーを導入しました。このオンラインRLHFアルゴリズムは、PPOに比べてvRAMを50〜70%削減し、最大で3倍速く収束しながら、性能面でも競争力を保ちます。
OpenAI、サラ・フリアーをCFOに、ケビン・ワイルをCPOに任命
OpenAIは、サラ・フリアーを最高財務責任者(CFO)に、ケビン・ワイルを最高製品責任者(CPO)に任命し、企業の成長に伴い運用と製品展開のスケールアップを図ります。
OpenAI Voice Engine: 技術実装と安全フレームワーク
OpenAI の Voice Engine は、2022 年から開発された合成音声モデルで、制御されたリリースを通じて段階的に展開され、安全研究と政策策定に活用されています。
Amazon SageMaker 用 Hugging Face Embedding コンテナのリリース
Hugging Face は、テキスト埋め込み推論(TEI)を活用した、オープン埋め込みモデルの高性能デプロイを実現する、Amazon SageMaker 用の一般提供(GA)Embedding コンテナをリリースしました。
Hugging Face Transformers ドキュメントの再設計
Hugging Face は、堅牢で段階的な構造から、製品開発者向けにコードファーストで統合された体験へと、Transformers ドキュメントを再設計しています。
Qwen2 リリースノート / 新機能
QwenはQwen2を発表しました。これは0.5Bから72Bパラメータまでの5つのオープンソースモデルで、27の追加言語への多言語サポートが強化され、コンテキスト長は最大128Kトークンです。
10BedICU と OpenAI:インドの救急医療インフラを強化する
10BedICU は、OpenAI の GPT-4 と Whisper モデルを CARE プラットフォームに統合し、医療文書の自動化、レガシーハードウェアの統合、インド政府病院における退院サマリーの効率化を実現しています。
Qwen-Agent: 8kから1MコンテキストへのLLMの汎化
Qwenは、8kコンテキストモデルが1Mトークンを処理できるエージェントフレームワークを開発し、特定のベンチマークでRAGおよびネイティブの長コンテキストモデルの両方を上回っています。
人工分析テキストから画像へのリーダーボードとアリーナの開始
Hugging Faceは、45,000件以上の投票から得られた人間の好みデータを使用して、オープンソースおよび商用の画像生成モデルをランク付けするArtificial Analysis Text to Image LeaderboardとArenaを開始しました。
GPT-4から概念を抽出する
OpenAIは、GPT-4の内部表現を1600万の人間が解釈可能な特徴に分解するためのスケーラブルなスパースオートエンコーダ手法を開発しました。
Hugging Face NPC-Playground: LLM駆動NPCを3D環境に統合する
Hugging FaceはNPC-Playgroundを紹介します。これはCubzhとGigaxを活用した3Dデモで、関数呼び出しとLuaスクリプトにより、リアルなLLM駆動NPCインタラクションを実現します。
Intel Gaudi アシスト生成サポート
Hugging Face はアシスト生成(スペキュレーティブサンプリング)を Optimum Habana に統合し、Intel Gaudi プロセッサ上で大規模なトランスフォーマーベースモデルに対して最大 2 倍の速度向上を実現しました。
Hugging Face Spaces シークレット セキュリティ更新
Hugging Face は、Spaces のシークレットの一部への不正アクセスを伴うセキュリティインシデントを公表し、影響を受けたトークンの失効と細粒度アクセス トークンへの移行を行いました。
OpenAIが隠密AI影響作戦を阻止
OpenAIは、AIを使用して欺瞞的コンテンツを生成した5つの隠密影響作戦に関連するアカウントを停止したが、いずれも大きなオーディエンスリーチを達成しなかった。
OpenAI、大学向けにChatGPT Eduを導入
OpenAIは、大学が大規模にAIを導入できるように、エンタープライズレベルのセキュリティとデータプライバシー、そしてGPT-4oへのアクセスを備えたChatGPTのバージョン、ChatGPT Eduを発表しました。
OpenAI for Nonprofits イニシアチブ
OpenAIはOpenAI for Nonprofitsを開始し、ChatGPT BusinessとEnterpriseへの割引アクセスを提供して、非営利組織が運営上や資金面の制約を克服できるよう支援します。
OpenAIを活用したMavenAGIの自動カスタマーサポートエージェント
MavenAGIは、GPT-4をベースに構築されたAIカスタマーサービスエージェントをリリースしました。これにより、サポート質問の最大93%を自動化し、チケット1件あたりの平均コストを40ドルから8ドルに削減します。
OpenAI と WAN-IFRA がニュースルーム AI カタリスト プログラムを開始
OpenAI と WAN-IFRA は、AI の導入を迅速化し、ジャーナリズムの持続可能性を向上させるために、世界中の 128 のニュースルームに資金と技術支援を提供するアクセラレータープログラム「The Newsroom AI Catalyst」を開始しました。
OpenAI と The Atlantic のニュース統合パートナーシップ
OpenAI と The Atlantic は、The Atlantic のプレミアムニュースコンテンツを ChatGPT やその他の OpenAI 製品に統合する戦略的パートナーシップを締結しました。コンテンツには帰属表示と全文記事へのリンクが含まれます。
OpenAI と Vox Media の戦略的パートナーシップ
OpenAI と Vox Media は、Vox Media のジャーナリスティックコンテンツを ChatGPT に統合し、消費者と広告主向けの AI 駆動型製品で協業する戦略的パートナーシップを締結しました。
テキスト生成推論のベンチマーク
Hugging Face は、テキスト生成推論(`TGI`)のベンチマークツールを導入し、開発者がスループットとレイテンシのトレードオフをプロファイルして、LLM のデプロイコストとパフォーマンスを最適化できるよう支援します。
OpenAI取締役会が安全・セキュリティ委員会を設置
OpenAIは、次世代フロンティアモデルの訓練を開始するにあたり、プロジェクトと運用における重要な安全・セキュリティの意思決定を監督する安全・セキュリティ委員会を設置しました。
Sentence Transformers を用いた埋め込みモデルのトレーニングとファインチューニング
Hugging Face は、Sentence Transformers ライブラリを使用して埋め込みモデルをトレーニングおよびファインチューニングするための包括的なガイドを提供しており、セマンティック検索や RAG などのタスク向けに新しい SentenceTransformerTrainer を紹介しています。
Falcon 2 11B リリースノート
TIIはFalcon 2 11Bをリリースしました。これは、5,000億トークン以上で学習された事前学習済みLLMとビジョン・ランゲージモデル(VLM)を含む、より小型で高性能なモデル群です。
CyberSecEval 2: 大規模言語モデルにおけるサイバーセキュリティリスクの評価
Hugging Face と Meta は、コードインタプリタの悪用、攻撃的サイバーセキュリティ機能、プロンプトインジェクション攻撃に対する LLM の脆弱性を評価する包括的フレームワークとして CyberSecEval 2 を導入しました。
OpenAI と News Corp の複数年にわたるグローバルパートナーシップ
OpenAI と News Corp は、The Wall Street Journal や The Times など主要出版物の現在および過去のコンテンツを OpenAI の製品に統合し、情報の信頼性を向上させることを目的とした複数年にわたる合意を締結しました。
Hugging Face AWS Inferentia2 統合
Hugging Face は AWS Inferentia2 のサポートを拡大し、Amazon SageMaker を通じて 100,000 以上のモデルをデプロイできるようにし、Hugging Face Inference Endpoints 用の新しい Inf2 インスタンスオプションを導入しました。
OpenAI の安全実践
OpenAIは、フロンティアAIモデルの開発と展開に使用される10の主要な安全実践を詳細に示し、安全性をモデルライフサイクルのすべての段階に統合する科学的アプローチを強調しています。
Hugging Face と Microsoft の戦略的協業アップデート 2024年5月
Hugging Face と Microsoft は、人気のオープンモデルを Azure Model Catalog に統合し、Azure 上で AMD MI300X GPU のサポートを可能にし、Hugging Face Spaces 用の VS Code 統合を導入することで、戦略的パートナーシップを拡大しました。
AMD Instinct MI300 GPU 用 Hugging Face 統合
Hugging Face は AMD Instinct MI300 GPU のファーストクラス統合を実現し、MI250 と比較して Llama 3 70B の推論が最大 3 倍、ファインチューニングが 2 倍高速になることを提供しています。
Dell Enterprise Hub: オンプレミス AI のデプロイとトレーニング
Hugging Face と Dell は、Dell ハードウェア上でオープンソースの大規模言語モデルのオンプレミスでのトレーニングとデプロイを簡素化するプラットフォーム、Dell Enterprise Hub を立ち上げました。
Hugging Face Spaces Dev Mode リリース
Hugging Face は Spaces Dev Mode を導入し、PRO サブスクライバーが VS Code または SSH を介してリアルタイムにコード編集できるようにし、変更ごとに git プッシュを行う必要がなくなります。
OpenAI ChatGPT 音声選択プロセス
OpenAIは、ChatGPT向けに5人のプロの声優を選出するために実施した5か月間のキャスティングプロセスの詳細を公開し、声「Sky」がスカーレット・ヨハンソンを模倣する意図はなかったことを明らかにしました。
ChatGPT データ分析の改善(2024年5月)
OpenAI は、GPT-4o によって実現された、クラウドストレージの直接統合、インタラクティブテーブル、カスタマイズ可能なチャートなど、ChatGPT のデータ分析機能を強化しました。
OpenAIとRedditのパートナーシップ
OpenAIとRedditは、リアルタイムのRedditコンテンツをChatGPTに統合し、Redditのユーザーおよびモデレーター機能を強化するためにOpenAIのAIモデルを実装することで提携しました。
Hugging Face KV キャッシュ量子化
Hugging Face は、Transformers ライブラリに KV キャッシュ量子化を導入し、長文コンテキストのテキスト生成におけるメモリ使用量を削減し、モデル品質への影響を最小限に抑えました。
Canva Magic Studio と OpenAI の統合
Canva は OpenAI の GPT-4 と API を統合し、Magic Studio AI スイートを提供しています。このスイートは、非専門家向けにデザインを簡素化するために 50 億回以上利用されています。
OpenAI のリーダーシップ変更:Ilya Sutskever が退任、Jakub Pachocki がチーフサイエンティストに任命
OpenAI は共同創業者の Ilya Sutskever が退社し、Jakub Pachocki が新チーフサイエンティストに任命され、AGI に向けた研究活動を主導することを発表しました。
Open Arabic LLM Leaderboard の紹介
Hugging Face と Technology Innovation Institute は、アラビア語大型言語モデル向けの専門的かつオープンな評価プラットフォームを提供するために、Open Arabic LLM Leaderboard (OALL) を立ち上げました。
PaliGemma ビジョン言語モデルリリース
Google は、SigLIP-So400m と Gemma-2B を組み合わせたオープンなビジョン‑言語モデルファミリーである PaliGemma をリリースし、画像キャプション生成、ビジュアル質問応答、物体検出などのタスクを実現します。
Hugging Face と LangChain が langchain_huggingface パートナーパッケージをリリース
Hugging Face と LangChain は、Hugging Face のモデルを LangChain エコシステムにシームレスに統合するために、共同で保守されるパートナーパッケージ langchain_huggingface をリリースしました。
OpenAI GPT-4o リリースノート
OpenAIは、テキスト、ビジョン、オーディオをエンドツーエンドで学習したオムニモデルGPT-4oをリリースし、人間に近い応答遅延で自然なヒューマン・コンピュータ相互作用を実現しました。
OpenAI春のアップデート:GPT-4oの紹介
OpenAIは、音声・映像・テキストをリアルタイムで推論できる新しいフラッグシップモデルGPT-4oをリリースし、ChatGPTの無料ユーザーにも高度な機能を拡大しました。
OpenAI GPT-4o Release and ChatGPT Free Tier Enhancements
OpenAIは、テキスト、音声、ビジョンにわたる速度とマルチモーダル機能が向上した、GPT-4レベルの知能を提供するフラッグシップモデルGPT-4oをリリースしました。現在、無料ユーザーと有料ユーザーの両方が利用可能です。
Transformers Agents 2.0 リリースノート / 新機能
Hugging Faceは、反復的な問題解決エージェントと、Llama-3-70B-Instructを使用したGAIAベンチマークでの高い性能を特徴とする、モジュール式エージェントフレームワーク、Transformers Agents 2.0を導入します。
Qwen-Max-0428 リリースノート
Qwenは、MT-Bench で Qwen1.5-110B-Chat を上回り、Chatbot Arena リーダーボードでトップ10にランクインした指示チューニング済みチャットモデル Qwen-Max-0428 をリリースしました。
インテル Gaudi 2 とインテル Xeon を使用したコスト効率の高いエンタープライズ RAG アプリケーションの構築
Hugging Face は、OPEA フレームワークを介して Intel Gaudi 2 アクセラレータと Intel Xeon CPU を組み合わせることで、エンタープライズが H100 ベースのシステムと比較して、パフォーマンス・パー・ドルが優れた RAG アプリケーションを構築できることを示しています。