Qwen2.5-Coder シリーズ リリースノート
Qwenは、0.5Bから32Bまでの6つのモデルサイズを備えたQwen2.5-Coderシリーズをリリースしました。32B-Instructモデルは、コーディングタスクにおいてGPT-4oに匹敵するオープンソースSOTAパフォーマンスを達成しています。
Hugging Face PyCharm 統合
Hugging Face は、その Hub を PyCharm Professional に直接統合し、開発者が IDE を離れることなく機械学習モデルを検出、挿入、管理できるようにしました。
Argilla 2.4 リリースノート / 新機能
Argilla 2.4 は、Hugging Face Hub のデータセットをインポートし、人間のフィードバックを通じてファインチューニングおよび評価用データセットを構築するためのノーコード UI を導入しました。
ChatGPT検索の紹介
OpenAIはChatGPTに新しいウェブ検索機能を統合し、ユーザーが関連するウェブソースへの直接リンクとともに迅速かつタイムリーな回答を得られるようにしました。
Promega ChatGPT導入事例研究
Promegaは組織全体にChatGPTを統合し、1,400以上のカスタムGPTを展開して製造、販売、マーケティングのワークフローを加速させました。
OpenAI SimpleQA ベンチマークリリース
OpenAI は SimpleQA をリリースしました。これは 4,326 の短い事実探索質問からなるオープンソースベンチマークで、最先端言語モデルの事実的正確性とキャリブレーションを評価するためのものです。
OpenAI を使用した Decagon の顧客サポート自動化
Decagon は、GPT-3.5、GPT-4、o1-mini を活用したマルチモデル戦略により、エンタープライズクライアント向けのグローバルサポートの最大 91% を自動化しています。
ユニバーサル・アシスト生成: 任意のアシスタントモデルで高速デコード
Hugging Face と Intel Labs は、トークナイザーに関係なく任意の小型モデルをアシスタントとして利用できることで、LLM 推論を 1.5 倍〜2.0 倍高速化する手法、Universal Assisted Generation(UAG)を発表しました。
Digital Green Farmer.chat: LLM-as-a-Judge で RAG を強化
Digital Green は、RAG ベースの農業チャットボットである Farmer.chat に対して、LLM-as-a-judge 評価フレームワークを導入し、RAG の正確性を客観的に測定し、34 万件のクエリにわたるモデル選択を最適化しました。
Aya Expanse リリース:多言語 LLM パフォーマンスの向上
Hugging Face と Cohere For AI は、8B と 32B のオープンウェイトモデルファミリーである Aya Expanse をリリースしました。このモデルは多言語パフォーマンスにおいて新たな最先端ベンチマークを設定しています。
連続時間一貫性モデルの簡素化、安定化、スケーリング
OpenAIは、連続時間一貫性モデルを簡素化したsCMを導入しました。このモデルはわずか2つのサンプリングステップで拡散レベルのサンプル品質を実現し、生成速度を約50倍に向上させます。
HUGS のローンチ:ゼロ構成、ハードウェア最適化された推論(インフェレンス)をオープンLLM向けに
Hugging Face は、NVIDIA、AMD、そして近日中に AWS Inferentia と Google TPU でも動作する、オープンソース LLM 向けのゼロ構成・ハードウェア最適化された推論サービス HUGS を発表しました。これにより、企業は OpenAI 互換 API を使用してモデルを社内でホストできるようになります。
CinePile 2.0 リリース:対抗的リファインメントでビデオ QA データセットの品質向上
CinePile 2.0 は、弱い QA ペアを視覚依存の質問に昇格させる対抗的リファインメントパイプラインを導入し、改善されたデータセットと完全なコードの両方を公開するとともに、商用およびオープンソースのビデオ‑LLM に対して大幅な性能向上を示します。
Transformers v4.46.0 における SynthID Text の統合
Google DeepMind と Hugging Face は SynthID Text を Transformers v4.46.0 に統合し、AI 生成テキストに目に見えない透かしを付与し、訓練済み分類器で検出できる手法を提供しました。
OpenAI と Microsoft が Lenfest Institute と提携し、AI コラボレーティブおよびフェローシッププログラムを開始
OpenAI と Microsoft は、Lenfest Institute for Journalism と提携し、地域のニュースルームがビジネスの持続可能性とイノベーションのために AI を導入できるよう、1,000万ドルの資金とクレジットを提供します。
Hugging Face Inference Endpoints での Speech-to-Speech のデプロイ
Hugging Face は、計算負荷の高い Speech-to-Speech (S2S) パイプラインをカスタム Docker イメージで Inference Endpoints にデプロイし、レイテンシを低減するためのガイドを提供しています。
Outlines-core 0.1.0 リリースノート / 新機能
Hugging Face と dottxt は、インデックスコンパイル速度とポータビリティを向上させた、構造化生成用の Outlines コアアルゴリズムを Rust に移植した outlines-core 0.1.0 をリリースしました。
Diffusers との Stable Diffusion 3.5 Large 統合
Hugging Face は、標準版とタイムステップ蒸留版の 8B パラメータモデルである Stable Diffusion 3.5 Large を Diffusers ライブラリに統合しました。
Hugging Face、Protect AIと提携しモデルセキュリティ向上のためGuardianスキャナーを追加
Hugging FaceはProtect AIと提携し、HubにGuardianスキャナーを組み込み、危険なモデルシリアライズの脆弱性を自動検出して、MLコミュニティ全体のセキュリティを向上させました。
Transformers.js v3 リリースで WebGPU 加速、モデルサポートの拡充、サーバーサイド JavaScript 互換性を追加
Transformers.js v3 は WebGPU 加速、新しい量子化フォーマット、120 のモデルアーキテクチャのサポート、そして Node.js/Deno/Bun 互換性を追加し、ブラウザや JavaScript ランタイムで高速なオンデバイス推論を可能にします。
KerasでのLlama 3.2
Llama 3.2 は keras-hub を通じて Keras で完全にサポートされており、ユーザーは Hugging Face のチェックポイントをロードし、JAX、PyTorch、または TensorFlow バックエンドでモデルを実行できます。
Hugging Face Transformers 勾配蓄積修正
Hugging Face は Transformers Trainer を更新し、損失のバッチ間平均方法を修正することで、勾配蓄積がフルバッチ学習と数式上で同等になるようにしました。
OpenAI の ChatGPT における公平性評価研究サマリー
OpenAI の研究は、名前に基づく有害なステレオタイプが ChatGPT の回答の 0.1% 未満にしか現れず、全体的な回答品質は性別や人種に関する名前の手がかりに対して一貫していることを示しています。
OpenAI MLE-bench: 機械学習エンジニアリングにおける機械学習エージェントの評価
OpenAIはMLE-benchを導入しました。このベンチマークは75のKaggleコンペティションを使用してAIエージェントの機械学習エンジニアリング能力を測定し、o1-previewはタスクの16.9%でブロンズメダルレベルを達成しました。
Gradio 5 セキュリティレビュー
Hugging Face は Trail of Bits と共に Gradio 5 の包括的なセキュリティ監査を実施し、特定されたすべての脆弱性を修正して、機械学習アプリケーションがデフォルトで安全になるようにしました。
AMD EPYC Turin CPUはGenoaに対してLLM推論スループットを2倍提供
AMDの第5世代EPYC Turin CPUは、Genoaに比べてLLM推論スループットを約2倍にし、Hugging Faceのワークロードで低レイテンシと高スループットを実現します。
Hugging Face と Dask による AI データ処理のスケーリング
Hugging Face と Dask は、分散コンピューティングとマルチ GPU 並列推論を活用して、ローカルの小規模サンプルから数億行規模のデータまで AI ベースのデータ処理をスケールさせることを可能にします。
Gradio 5 リリースノート
Hugging Face は、Python を使用して高性能・スケーラブル・安全な機械学習ウェブアプリケーションを構築するための本番環境対応フレームワーク、Gradio 5 をリリースしました。
OpenAIとHearstのコンテンツパートナーシップ
OpenAI は Hearst と提携し、20 以上の雑誌ブランドと 40 を超える新聞のコンテンツを AI 製品(ChatGPT など)に統合します。これにより、ユーザーはより信頼性が高く、出典が明示されたジャーナリズムを利用できるようになります。
Hugging Face Transformers 4.45.0 動的投機的デコード
Hugging Face と Intel Labs は Transformers 4.45.0 で動的投機的デコードを導入し、モデルの信頼度に基づいてドラフトトークン数を動的に調整することで、テキスト生成を最大 2.7 倍高速化しました。
Hugging Face Hub における Parquet 重複排除の改善
Hugging Face はストレージアーキテクチャを最適化し、Parquet ファイルの重複排除を改善するために、データセット更新時のストレージオーバーヘッドを削減するコンテンツ定義行グループを提案しています。
Open FinLLM Leaderboard の開始 – 金融言語モデル向け包括的なゼロショットベンチマーク
Hugging Face は Open FinLLM Leaderboard を開始しました。このゼロショットベンチマークは、7 つのカテゴリにわたる 40 の金融特化タスクをカバーし、実際の金融アプリケーションに対する LLM の準備状況を評価します。
OpenAI Canvas ベータローンチ:ChatGPT 用の共同執筆・コーディングインターフェース
OpenAI は Canvas を導入しました。このベータインターフェースは、ChatGPT がインライン編集、バージョン管理、専用ショートカットを用いて執筆やコーディングプロジェクトで共同作業できるようにし、当初は Plus および Team ユーザーに提供されます。
OpenAI、財務柔軟性のために40億ドルの信用枠を設立
OpenAIは、流動性を高めAI研究とインフラのスケールアップを支援するため、世界的な銀行コンソーシアムと40億ドルのリボルビング信用枠を設立しました。
中国AIのグローバル展開分析
中国のAI企業は、国内市場の飽和、激しい価格競争、規制圧力により国際展開を加速しており、東南アジア、中東、そして西側の消費者市場をターゲットにしています。
OpenAI 資金調達発表 2024年10月
OpenAIは、フロンティアAI研究を加速し、コンピュート容量を増やすために、ポストマネーバリュエーション$157 billionで新たに$6.6 billionの資金調達を行いました。
OpenAI リアルタイム API リリース
OpenAIはリアルタイム API をパブリックベータでリリースし、開発者が GPT-4o を使用して低遅延・マルチモーダルな音声対音声体験を構築できるようにしました。
GPT-4o ビジョンファインチューニング API リリース
OpenAIはGPT-4o向けのビジョンファインチューニングを導入し、開発者が画像とテキストのデータセットでモデルをカスタマイズできるようにし、専門的な視覚理解や物体検出を向上させます。
OpenAI プロンプトキャッシュ API リリース
OpenAI は GPT-4o、GPT-4o mini、o1-preview、o1-mini 向けにプロンプトキャッシュを導入し、再利用される入力トークンに対して 50% の割引とレイテンシ削減を提供します。
OpenAI モデル蒸留 API 統合
OpenAI は、o1-preview や GPT-4o といったフロンティアモデルの出力を利用して、GPT-4o mini のような小型モデルをファインチューニングし、性能を向上させることができる統合型 Model Distillation スイートを導入しました。
OpenAIとAltera:GPT-4oで協働デジタルヒューマンを創造する
Alteraは、GPT-4oを搭載した脳インスパイア型アーキテクチャを用いて、Minecraftなどの環境で人々と協働できる自律型AIエージェント、いわゆるデジタルヒューマンを開発しました。
BenCzechMark: チェコ語 LLM 用の包括的評価スイート
Hugging Face と学術パートナーは、チェコ語モデル向けの初の包括的評価スイートである BenCzechMark をリリースしました。9 つのカテゴリにまたがる 50 のタスクと、新しいデュエル方式のスコアリングメカニズムを備えています。
OpenAIがSTORM-0817イラン系マルウェア活動を阻止
OpenAIは、イラン拠点の脅威アクターSTORM-0817がAndroidマルウェアを開発し、Instagramプロファイルをスクレイピングし、パキスタンのサイバーセキュリティ専門家に対して偵察を行うために使用していたアカウントを無効化しました。
OpenAI、SweetSpecter(中国関連)サイバー活動を阻止
OpenAIは、中国拠点の脅威アクターSweetSpecterに関連するアカウントを特定し、禁止しました。同アクターはChatGPTを攻撃的なサイバー作戦に利用しようとし、OpenAI従業員を標的としたスピアフィッシング攻撃を行っていました。
OpenAI調査:偽ロシア・トロールエラーメッセージのホーク
OpenAIは、ロシアのトロールアカウントのGPT-4oエラーメッセージを暴露したと主張するバイラル投稿を否定し、この事件が米国で作成された手作業のホークである可能性が高いことを明らかにしました。
OpenAIがイラン系CyberAv3ngersのサイバーリサーチ活動を阻止
OpenAIは、イラン系脅威アクターであるCyberAv3ngersに関連するアカウントを禁止しました。同グループは産業制御システムを標的に、偵察、コードデバッグ、脆弱性調査にLLMを使用していました。
OpenAI、ロシアの影響活動「Stop News」作戦を阻止
OpenAIは、ロシア発の影響作戦「Stop News」に使用されたChatGPTアカウントのクラスターを禁止しました。この作戦はAI生成のテキストと画像を用いてニュースアウトレットを模倣し、欺瞞的なパートナーシップを構築していました。
OpenAI、Operation A2Zの多言語影響活動を阻止
OpenAIは、APIを使用して多言語影響作戦「Operation A2Z」を実行していたアカウント群を停止しました。この作戦はAIを活用して偽のペルソナを管理し、X と Facebook 上で政治的コンテンツを生成していました。
OpenAI、Bet Botギャンブルスパムネットワークを撹乱
OpenAIは、イスラエル拠点のスタートアップを通じてAPIを利用し、X上でギャンブルスパムネットワークを運営していたアカウント群を禁止し、AI生成のペルソナを使ってユーザーをギャンブルサイトへ誘導していました。
OpenAIがSTORM-2035イラン影響活動を阻止
OpenAIは、イラン起源のアクターであるStorm-2035が使用するChatGPTアカウントを禁止し、米国選挙やその他の世界的な政治課題を標的とした欺瞞的な長文記事やソーシャルメディアコメントの生成を阻止しました。