Outlines-core 0.1.0 リリースノート / 新機能
Hugging Face と dottxt は、インデックスコンパイル速度とポータビリティを向上させた、構造化生成用の Outlines コアアルゴリズムを Rust に移植した outlines-core 0.1.0 をリリースしました。
Diffusers との Stable Diffusion 3.5 Large 統合
Hugging Face は、標準版とタイムステップ蒸留版の 8B パラメータモデルである Stable Diffusion 3.5 Large を Diffusers ライブラリに統合しました。
Hugging Face、Protect AIと提携しモデルセキュリティ向上のためGuardianスキャナーを追加
Hugging FaceはProtect AIと提携し、HubにGuardianスキャナーを組み込み、危険なモデルシリアライズの脆弱性を自動検出して、MLコミュニティ全体のセキュリティを向上させました。
Transformers.js v3 リリースで WebGPU 加速、モデルサポートの拡充、サーバーサイド JavaScript 互換性を追加
Transformers.js v3 は WebGPU 加速、新しい量子化フォーマット、120 のモデルアーキテクチャのサポート、そして Node.js/Deno/Bun 互換性を追加し、ブラウザや JavaScript ランタイムで高速なオンデバイス推論を可能にします。
KerasでのLlama 3.2
Llama 3.2 は keras-hub を通じて Keras で完全にサポートされており、ユーザーは Hugging Face のチェックポイントをロードし、JAX、PyTorch、または TensorFlow バックエンドでモデルを実行できます。
Hugging Face Transformers 勾配蓄積修正
Hugging Face は Transformers Trainer を更新し、損失のバッチ間平均方法を修正することで、勾配蓄積がフルバッチ学習と数式上で同等になるようにしました。
OpenAI の ChatGPT における公平性評価研究サマリー
OpenAI の研究は、名前に基づく有害なステレオタイプが ChatGPT の回答の 0.1% 未満にしか現れず、全体的な回答品質は性別や人種に関する名前の手がかりに対して一貫していることを示しています。
OpenAI MLE-bench: 機械学習エンジニアリングにおける機械学習エージェントの評価
OpenAIはMLE-benchを導入しました。このベンチマークは75のKaggleコンペティションを使用してAIエージェントの機械学習エンジニアリング能力を測定し、o1-previewはタスクの16.9%でブロンズメダルレベルを達成しました。
Gradio 5 セキュリティレビュー
Hugging Face は Trail of Bits と共に Gradio 5 の包括的なセキュリティ監査を実施し、特定されたすべての脆弱性を修正して、機械学習アプリケーションがデフォルトで安全になるようにしました。
AMD EPYC Turin CPUはGenoaに対してLLM推論スループットを2倍提供
AMDの第5世代EPYC Turin CPUは、Genoaに比べてLLM推論スループットを約2倍にし、Hugging Faceのワークロードで低レイテンシと高スループットを実現します。
Hugging Face と Dask による AI データ処理のスケーリング
Hugging Face と Dask は、分散コンピューティングとマルチ GPU 並列推論を活用して、ローカルの小規模サンプルから数億行規模のデータまで AI ベースのデータ処理をスケールさせることを可能にします。
Gradio 5 リリースノート
Hugging Face は、Python を使用して高性能・スケーラブル・安全な機械学習ウェブアプリケーションを構築するための本番環境対応フレームワーク、Gradio 5 をリリースしました。
OpenAIとHearstのコンテンツパートナーシップ
OpenAI は Hearst と提携し、20 以上の雑誌ブランドと 40 を超える新聞のコンテンツを AI 製品(ChatGPT など)に統合します。これにより、ユーザーはより信頼性が高く、出典が明示されたジャーナリズムを利用できるようになります。
Hugging Face Transformers 4.45.0 動的投機的デコード
Hugging Face と Intel Labs は Transformers 4.45.0 で動的投機的デコードを導入し、モデルの信頼度に基づいてドラフトトークン数を動的に調整することで、テキスト生成を最大 2.7 倍高速化しました。
Hugging Face Hub における Parquet 重複排除の改善
Hugging Face はストレージアーキテクチャを最適化し、Parquet ファイルの重複排除を改善するために、データセット更新時のストレージオーバーヘッドを削減するコンテンツ定義行グループを提案しています。
Open FinLLM Leaderboard の開始 – 金融言語モデル向け包括的なゼロショットベンチマーク
Hugging Face は Open FinLLM Leaderboard を開始しました。このゼロショットベンチマークは、7 つのカテゴリにわたる 40 の金融特化タスクをカバーし、実際の金融アプリケーションに対する LLM の準備状況を評価します。
OpenAI Canvas ベータローンチ:ChatGPT 用の共同執筆・コーディングインターフェース
OpenAI は Canvas を導入しました。このベータインターフェースは、ChatGPT がインライン編集、バージョン管理、専用ショートカットを用いて執筆やコーディングプロジェクトで共同作業できるようにし、当初は Plus および Team ユーザーに提供されます。
OpenAI、財務柔軟性のために40億ドルの信用枠を設立
OpenAIは、流動性を高めAI研究とインフラのスケールアップを支援するため、世界的な銀行コンソーシアムと40億ドルのリボルビング信用枠を設立しました。
中国AIのグローバル展開分析
中国のAI企業は、国内市場の飽和、激しい価格競争、規制圧力により国際展開を加速しており、東南アジア、中東、そして西側の消費者市場をターゲットにしています。
OpenAI 資金調達発表 2024年10月
OpenAIは、フロンティアAI研究を加速し、コンピュート容量を増やすために、ポストマネーバリュエーション$157 billionで新たに$6.6 billionの資金調達を行いました。
OpenAI リアルタイム API リリース
OpenAIはリアルタイム API をパブリックベータでリリースし、開発者が GPT-4o を使用して低遅延・マルチモーダルな音声対音声体験を構築できるようにしました。
GPT-4o ビジョンファインチューニング API リリース
OpenAIはGPT-4o向けのビジョンファインチューニングを導入し、開発者が画像とテキストのデータセットでモデルをカスタマイズできるようにし、専門的な視覚理解や物体検出を向上させます。
OpenAI プロンプトキャッシュ API リリース
OpenAI は GPT-4o、GPT-4o mini、o1-preview、o1-mini 向けにプロンプトキャッシュを導入し、再利用される入力トークンに対して 50% の割引とレイテンシ削減を提供します。
OpenAI モデル蒸留 API 統合
OpenAI は、o1-preview や GPT-4o といったフロンティアモデルの出力を利用して、GPT-4o mini のような小型モデルをファインチューニングし、性能を向上させることができる統合型 Model Distillation スイートを導入しました。
OpenAIとAltera:GPT-4oで協働デジタルヒューマンを創造する
Alteraは、GPT-4oを搭載した脳インスパイア型アーキテクチャを用いて、Minecraftなどの環境で人々と協働できる自律型AIエージェント、いわゆるデジタルヒューマンを開発しました。
BenCzechMark: チェコ語 LLM 用の包括的評価スイート
Hugging Face と学術パートナーは、チェコ語モデル向けの初の包括的評価スイートである BenCzechMark をリリースしました。9 つのカテゴリにまたがる 50 のタスクと、新しいデュエル方式のスコアリングメカニズムを備えています。
OpenAIがSTORM-0817イラン系マルウェア活動を阻止
OpenAIは、イラン拠点の脅威アクターSTORM-0817がAndroidマルウェアを開発し、Instagramプロファイルをスクレイピングし、パキスタンのサイバーセキュリティ専門家に対して偵察を行うために使用していたアカウントを無効化しました。
OpenAI、SweetSpecter(中国関連)サイバー活動を阻止
OpenAIは、中国拠点の脅威アクターSweetSpecterに関連するアカウントを特定し、禁止しました。同アクターはChatGPTを攻撃的なサイバー作戦に利用しようとし、OpenAI従業員を標的としたスピアフィッシング攻撃を行っていました。
OpenAI調査:偽ロシア・トロールエラーメッセージのホーク
OpenAIは、ロシアのトロールアカウントのGPT-4oエラーメッセージを暴露したと主張するバイラル投稿を否定し、この事件が米国で作成された手作業のホークである可能性が高いことを明らかにしました。
OpenAIがイラン系CyberAv3ngersのサイバーリサーチ活動を阻止
OpenAIは、イラン系脅威アクターであるCyberAv3ngersに関連するアカウントを禁止しました。同グループは産業制御システムを標的に、偵察、コードデバッグ、脆弱性調査にLLMを使用していました。
OpenAI、ロシアの影響活動「Stop News」作戦を阻止
OpenAIは、ロシア発の影響作戦「Stop News」に使用されたChatGPTアカウントのクラスターを禁止しました。この作戦はAI生成のテキストと画像を用いてニュースアウトレットを模倣し、欺瞞的なパートナーシップを構築していました。
OpenAI、Operation A2Zの多言語影響活動を阻止
OpenAIは、APIを使用して多言語影響作戦「Operation A2Z」を実行していたアカウント群を停止しました。この作戦はAIを活用して偽のペルソナを管理し、X と Facebook 上で政治的コンテンツを生成していました。
OpenAI、Bet Botギャンブルスパムネットワークを撹乱
OpenAIは、イスラエル拠点のスタートアップを通じてAPIを利用し、X上でギャンブルスパムネットワークを運営していたアカウント群を禁止し、AI生成のペルソナを使ってユーザーをギャンブルサイトへ誘導していました。
OpenAIがSTORM-2035イラン影響活動を阻止
OpenAIは、イラン起源のアクターであるStorm-2035が使用するChatGPTアカウントを禁止し、米国選挙やその他の世界的な政治課題を標的とした欺瞞的な長文記事やソーシャルメディアコメントの生成を阻止しました。
OpenAI、ルワンダ選挙の政治コメントネットワークを撹乱
OpenAIは、ルワンダで選挙に関する党派的コンテンツを生成し、高頻度のコメントスパムでXのトレンド操作を試みていたChatGPTアカウントのネットワークを禁止しました。
OpenAI トートレポート:濫用的通報活動の阻止
OpenAIは、AIを使用してFacebookとYouTube上の独立系ベトナムメディアに対し、一般的な通報を生成したカテゴリ1の影響作戦「Tort Report」に関与したアカウントを禁止しました。
OpenAI が「Corrupt Comment」影響作戦を阻止
OpenAI は、腐敗撲滅基金とアレクセイ・ナワルニーの関係者を標的とした X 上の英語コメントを生成するために使用された API アクティビティのクラスターを禁止しました。
頂点カラー メッシュをテクスチャメッシュに変換する
Hugging Face は、頂点カラーの 3D メッシュを UV マッピングされたテクスチャメッシュに変換し、アプリケーションとの互換性を向上させる方法と InstantTexture ライブラリを紹介します。
OpenAI Moderation API アップデート:omni-moderation-latest モデルリリース
OpenAI は、テキストと画像の両方で有害検出精度を向上させ、特に英語以外の言語において効果を発揮する GPT-4o ベースのマルチモーダルモデレーションモデル、omni-moderation-latest をリリースしました。
ミネソタ州企業翻訳オフィス ChatGPT 統合
ミネソタ州の企業翻訳オフィスは、ChatGPT を統合して政府の翻訳サービスを加速させ、ターンアラウンド時間を数週間から48時間未満に短縮し、月額10万ドル以上のコスト削減を実現しました。
OpenAIとGEDIのイタリア語ニュースコンテンツに関する戦略的パートナーシップ
OpenAIとGEDIは、La RepubblicaやLa Stampaなどの出版物からの高品質なイタリア語ニュースコンテンツをChatGPTとSearchGPTに統合するために提携しました。
Llama 3.2 リリースノート: マルチモーダルビジョンとオンデバイス小型言語モデル
Meta は Llama 3.2 をリリースし、11B と 90B のサイズでマルチモーダルビジョン機能を、オンデバイス展開に最適化された軽量な 1B と 3B のテキスト専用モデルを導入しました。
Mercado Libre Verdi AI 開発プラットフォームのローンチ
Mercado Libre は GPT‑4o を基盤とした AI 開発プラットフォーム Verdi を発表しました。これにより開発者は安全で自律的な LLM アプリケーションを作成でき、まずは AI 主導のカスタマーサービス仲裁で 10 % の紛争を処理します。
Hugging Face Daily Papers 機能ガイド
Hugging FaceのDaily Papersページは、AI研究のコミュニティキュレーションハブを提供し、著者の主張、論文提出、研究者と開発者間の直接的なやり取りを可能にするツールを備えています。
FineVideo データセットリリース
Hugging Face は、43,000 本(3,400 時間)の高品質なオープンビデオデータセットである FineVideo をリリースしました。このデータセットは、ビデオ理解と生成 AI のトレーニング向けに、豊富で構造化されたアノテーションが付与されています。
Optimum-Intel と OpenVINO GenAI を使用した Hugging Face モデルの最適化とデプロイ
Hugging Face と Intel は、Optimum-Intel と OpenVINO GenAI を活用したシンプルなワークフローを提供し、Intel ハードウェア上で Transformers モデルを最適化およびデプロイします。特にエッジやクライアント側の C++ および Python 環境を対象としています。
Genmab「AI Everywhere」展開:エンタープライズChatGPTの拡大とバイオテクノロジー向け100以上のカスタムGPT
GenmabはChatGPT Enterpriseを2,000人以上のスタッフに拡大し、100以上のカスタムGPTを導入して、各ユーザーが週に3.5時間の時間を節約し、バイオテクノロジーの研究と文書作成を加速させました。
Qwen2.5 リリースノート:新しい基盤、Coder、Math モデル
Qwen は、汎用 LLM、専門の Coder と Math バリアント、そして更新された Qwen2-VL-72B を含む、オープンウェイトの密集デコーダーオンリーモデルの包括的スイートである Qwen2.5 をリリースしました。
Qwen2.5 LLMシリーズリリース
QwenはQwen2.5シリーズを発表しました – 0.5Bから72Bパラメータまでのオープンソースデコーダー専用LLMで、Qwen2の能力を2倍にし、18兆トークン規模のデータセット拡大、知識・コーディング・数学・アラインメントの大幅な向上、そして128Kトークンのコンテキストウィンドウを追加しています。
Qwen2.5-Coder リリースノート
Qwenは、5.5兆トークンで学習されたオープンソースのコーディングモデルシリーズであるQwen2.5-Coderをリリースしました。このシリーズは、コード生成、推論、数学において大規模モデルを上回ります。