6601

OpenAI、AI支援による欺瞞的雇用スキームを阻止

OpenAIは、AIを利用して求人応募書類の作成、面接の実施、業務タスクの遂行を行う欺瞞的雇用スキームに使用された数十のアカウントを禁止しました。このスキームは、北朝鮮国家の取り組みとされるTTPと一致しています。

6602

OpenAI オペレーション ピアレビュー:AI支援監視計画の阻止

OpenAI は、中国発とみられる ChatGPT アカウントのクラスターを停止しました。これらのアカウントは AI を利用して政治関係者の調査、抗議文書の分析、監視ツールの開発を行っていました。

6603

OpenAI o3-mini System Card

OpenAIはo3-miniのシステムカードを公開し、大規模な強化学習とchain-of-thought推論が、どのようにしてモデルの最先端の安全性パフォーマンスとPreparedness FrameworkにおけるMediumリスク分類を可能にしているかを詳細に説明しています。

6604

OpenAI o3-mini リリースノート / 新機能

OpenAIは、STEM(科学、数学、コーディング)に最適化されたコスト効率の高い推論モデルo3-miniをリリースしました。これにより、数学、コーディング、科学においてo1と同等のパフォーマンスを提供し、レイテンシが低く、開発者向け機能が拡張されています。

6605

Mini-R1: GRPOとCountdown GameによるDeepSeek-R1の推論の再現

Hugging Faceは、Countdown GameにおいてGroup Relative Policy Optimization (GRPO) を用いてQwen2.5-3Bモデルをトレーニングすることにより、DeepSeek-R1の自己修正と推論という「aha moment」をどのように再現できるかを示しています。

6606

Hugging Face AI Tools アートニュースレター 第1号

Hugging FaceはオープンソースクリエイティブAIの現状を詳細に述べた月刊ニュースレターを開始し、2024年のDiffusion Transformersへのシフトと高品質なオープンビデオおよびオーディオモデルの登場を強調しています。

6607

OpenAIと米国国立研究所のパートナーシップ

OpenAIは米国国立研究所と提携し、Venadoスーパーコンピュータに推論モデルを導入して科学研究を加速し、国家安全保障を強化しています。

6608

AWSでのDeepSeek R1モデルのデプロイとファインチューニング方法

Hugging Faceは、Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、Amazon SageMaker AI(GPUおよびNeuronインスタンス)、およびHugging Face Neuron Deep Learning AMIを使用したEC2 Neuronを使って、AWS上でDeepSeek R1およびそのディスティルドバリアントをデプロイおよびファインチューニングする方法を示しています。

6609

Qwen2.5-Max リリースノート

Qwenは、20兆トークン以上で事前学習された大規模なMixture-of-Experts (MoE)モデルであるQwen2.5-Maxをリリースし、APIおよびQwen Chatを通じて利用可能になりました。

6610

Open-R1: DeepSeek-R1の完全なオープン再現

Hugging Faceは、Open-R1プロジェクトを立ち上げ、DeepSeek-R1のデータとトレーニングパイプラインを体系的に再構築し、オープンソースコミュニティに推論モデルのための欠落しているデータセットとコードを提供することを目的としています。

6611

Hugging Face Inference Providers Integration

Hugging Faceは、fal、Replicate、SambaNova、Together AIの4つのサーバーレス推論プロバイダーをHubに直接統合し、統合されたモデル中心のサーバーレス推論を提供しています。

6612

Diffusersにおけるオープンビデオ生成モデルの現状

Hugging Faceは、オープンビデオ生成モデルの包括的な概要を提供し、HunyuanVideoのようなモデルのVRAM要件を60GBから約6.5GBに削減できるDiffusersの最適化スイートを紹介しています。

6613

Qwen2.5-1M リリース:1MトークンコンテキストとvLLMベースの推論フレームワークを備えたオープンソースの7Bおよび14Bモデル

Qwenは、最大100万トークンのコンテキストをサポートするオープンソースのQwen2.5‑7B‑Instruct‑1MおよびQwen2.5‑14B‑Instruct‑1Mモデルをリリースし、最適化されたvLLMベースの推論フレームワークを伴って提供します。このフレームワークはプリフィルを3×〜7×高速化し、GPT‑4o‑miniと同等のショートタスク性能を維持します。

6614

Qwen2.5-VL リリースノート

Qwenは、3B、7B、72Bサイズで利用可能なフラッグシップビジョン言語モデルであるQwen2.5-VLをリリースしました。これにより、高度な視覚エージェント機能、長時間ビデオ理解、構造化ドキュメント解析が導入されます。

6615

smolagents ビジョンサポートのアップデート

Hugging Faceは smolagents にネイティブなビジョンサポートを追加し、自律的なウェブブラウジングなどのタスクにおいて、エージェントのパイプライン内で Vision Language Models (VLMs) を使用できるようにしました。

6616

OpenAI Operator リサーチプレビュー

OpenAIは、Computer-Using Agent (CUA)モデルによって駆動されるAIエージェントの研究プレビューであるOperatorを発表しました。このエージェントは、ウェブブラウザを独立してナビゲートし、フォームの入力や食料品の注文などのタスクを実行できます。

6617

OpenAI Computer-Using Agent (CUA) と Operator 研究プレビュー

OpenAI は、画面、マウス、キーボードの普遍的インターフェースを通じて GUI と対話し、デジタルタスクを実行できる Computer-Using Agent (CUA) モデルを導入し、現在 Operator を通じて研究プレビューとして利用可能です。

6618

OpenAI Operator システムカード

OpenAIは、ユーザーの代わりにタスクを実行するためにGUIと対話するComputer-Using Agent (CUA)モデルの研究プレビューであるOperatorを発表しました。これにより、プロンプトインジェクションやモデルのミスなどのリスクを軽減する多層的なセーフティフレームワークがサポートされます。

6619

NVIDIA KVPress: 長文コンテキストLLM向けKVキャッシュ圧縮ツールキット

NVIDIAは、長文コンテキストのLarge Language Modelsのメモリフットプリントを削減し、デコード速度を向上させる最先端のKVキャッシュ圧縮技術を実装したPythonツールキットであるKVPressをリリースしました。

6620

SmolVLM 256M と 500M リリースノート

Hugging Face は SmolVLM-256M と SmolVLM-500M を発表し、パラメータ数を大幅に削減しながらも強力なマルチモーダル性能を維持する高効率な Vision Language Model を提供します。

6621

Bertelsmann と OpenAI のエンタープライズ AI 統合パートナーシップ

Bertelsmann は、グローバルなメディア、サービス、教育ブランド全体に OpenAI テクノロジーと ChatGPT Enterprise を統合し、創造性、生産性、製品開発を規模を拡大して強化しています。

6622

敵対的堅牢性のための推論時計算量のトレードオフ

OpenAIの研究は、o1-preview や o1-mini のような推論モデルにおいて、推論時計算量を増やすことが、複数のタイプの敵対的攻撃に対する堅牢性を向上させることを示しています。

6623

Hugging Face と FriendliAI のモデルデプロイメントにおけるパートナーシップ

Hugging Face は、FriendliAI の推論インフラストラクチャを Hugging Face Hub に統合し、高パフォーマンスなエンドポイントへの生成 AI モデルのワンクリックデプロイを可能にしました。

6624

OpenAI Stargate インフラストラクチャ イニシアティブ

OpenAIは、次世代AIシステムに必要な物理的容量を開発するため、米国ベースのデータセンターインフラストラクチャ企業とのパートナーシップを求めています。

6625

OpenAIがThe Stargate Projectを発表

OpenAIとそのパートナーは、米国で巨大なAIインフラストラクチャを構築し、AGIの開発を支援するための5000億ドル規模のイニシアチブであるThe Stargate Projectを立ち上げました。

6626

Hugging Face 組織ブログ記事機能

Hugging Face は現在、Enterprise Hub に加入している組織が組織プロファイルに直接ブログ記事を公開できるようになりました。

6627

Qwen グローバルバッチ ロードバランス MoE LLM トレーニング

Qwenは、個々のマイクロバッチではなくグローバルバッチ全体でバランスを計算することにより、MoEモデルの性能を向上させ、エキスパートの専門化を可能にするグローバルバッチロードバランシング損失を導入します。

6628

Hugging Face テキスト生成推論 (TGI) マルチバックエンドサポート

Hugging Faceは、Text Generation Inference (TGI)のためのマルチバックエンドアーキテクチャを導入し、これによりユーザーは単一の統一されたフロントエンドを使用して大規模言語モデル (LLM) をデプロイし、ハードウェアとパフォーマンスのニーズに基づいて異なる実行エンジン間を切り替えることができます。このアップデートは、TGIが複数の専門的なバックエンドを統合するレイヤーとして機能することにより、推論エコシステムの断片化に対処します。

6629

Hugging Face Transformers timm 統合

Hugging Faceは、PyTorch Image Models(timm)ライブラリのあらゆるモデルを、推論、量子化、ファインチューニングのためにtransformersエコシステム内でシームレスに使用できるようにするTimmWrapperを導入しました。

6630

OpenAI ニュース業界パートナーシップと Axios の拡張

OpenAI は Axios と新しいコンテンツ パートナーシップを発表し、ローカルニュースへの資金提供を拡大するとともに、ほぼ 20 のメディア組織が AI を統合して生産を効率化し、ユーザー エンゲージメントを向上させ、ビジネス オペレーションを最適化していることを詳細に説明しています。

6631

Sentence Transformersを使用して400倍高速なStatic Embedding Modelをトレーニングする

Hugging Faceは、all-mpnet-base-v2のようなモデルの品質を少なくとも85%維持しつつ、CPUで100倍〜400倍高速に動作する静的埋め込みモデルをトレーニングする方法を導入しました。トレーニングスクリプトと評価結果を伴う2つのモデル(static-retrieval-mrl-en-v1 および static-similarity-mrl-multilingual-v1)を公開しています。

6632

Adebayo Ogunlesi、OpenAI 取締役会に加入

Global Infrastructure Partners の CEO かつ BlackRock の Senior Managing Director である Adebayo Ogunlesi 氏は、インフラストラクチャ投資およびグローバル市場戦略の専門知識を提供するため、OpenAI の取締役会に加入しました。

6633

Qwen2.5-Math-PRMとProcessBenchのリリース

Qwenは、中間推論エラーを特定するように設計された最先端のProcess Reward ModelであるQwen2.5-Math-PRM-7Bと72Bをリリースし、さらに段階レベルの評価ベンチマークであるProcessBenchも公開しました。

6634

Hugging Face AI Agents Ethics and Framework Analysis

Hugging Faceは、AIエージェントを理解するための包括的なフレームワークを提供しており、自律性が高まるにつれてリスクが増大すると主張し、完全自律型エージェントの開発には慎重な姿勢を示しています。

6635

Hugging Face が vdr-2b-multi-v1 多言語視覚ドキュメント検索モデルをリリース

Hugging Face は、ページのスクリーンショットを密ベクトルにエンコードすることで OCR なしで複雑なドキュメントの検索を可能にする、視覚ドキュメント検索用の多言語埋め込みモデル vdr-2b-multi-v1 を発表しました。

6636

Hugging Face Open LLM リーダーボード: CO₂ 排出量とモデル パフォーマンス分析

Hugging Face は、コミュニティ ファインチューン モデルが、簡潔さの向上と指示への従順性の向上により、公式リリースよりもしばしば高いカーボン効率を示すことを明らかにしました。

6637

Hugging Face smolagents リリース

Hugging Faceは、軽量ライブラリsmolagentsをリリースしました。これにより、LLMはJSONではなく実行可能なコードとしてアクションを記述することで複雑なタスクを実行でき、構成性と汎用性が向上します。

6638

OpenAI 企業構造の進化

OpenAIは、デラウェア州の公益株式会社(PBC)への営利部門の移行を計画しており、資金調達を容易にし、AGIが人類全体に利益をもたらすという非営利ミッションを維持することを目的としています。

6639

QVQ-72B-Preview リリース

Qwenは、Qwen2-VL-72Bベースのオープンウェイトマルチモーダル推論モデルであるQVQ-72B-Previewをリリースしました。MMMUベンチマークでスコア70.3を達成しています。

6640

PyTorchにおけるGPUメモリの可視化と理解 – Hugging Face Blog サマリー

Hugging Faceのブログ記事では、torch.cuda.memoryツールを使ってPyTorchにおけるGPUメモリ使用量を可視化する方法を説明し、モデルトレーニング中のメモリコンポーネントを分解し、総メモリ要件を見積もるための公式を提供しています。

6641

NVIDIA LogitsProcessorZoo: モジュール式 Logits Processor による言語モデル生成の制御

NVIDIA の LogitsProcessorZoo は、Hugging Face Transformers 用のモジュール式 logits processor を提供し、生成の長さの制御、フレーズの含入の強制、プロンプト内容の引用、および出力を多肢選択の回答に制限することを可能にします。

6642

Deliberative alignment: reasoning enables safer language models

OpenAI introduces deliberative alignment, a training paradigm that teaches o-series models to reason over explicit safety specifications, improving safety and reducing both under‑ and over‑refusals compared to prior models.

6643

Big Bench Audio リリース

Artificial Analysis は、音声言語モデルの推論能力を評価するために設計された 1,000 問の音声質問からなるデータセット Big Bench Audio をリリースし、テキストと音声の推論の間に大きなパフォーマンスギャップがあることを明らかにしました。

6644

ModernBERT リリースノート

Hugging Face、Answer.AI、および LightOn は、BERT の速度、精度、コンテキスト長を 8,192 トークンに改善した最先端のエンコーダー専用モデルファミリである ModernBERT をリリースしました。

6645

Bamba-9B: 推論効率の高いハイブリッド Mamba2 モデル

IBM、Princeton、CMU、UIUC による、2.2T のオープンなトークンでトレーニングされたハイブリッド Mamba2 モデルである Bamba-9B は、vLLM において Llama 3.1 8B に対して 2.5 倍のスループットと 2 倍のレイテンシ向上を達成し、transformers、vLLM、TRL、llama.cpp で即座に使用可能です。

6646

GCPにおける第5世代 Xeonでの言語モデル性能ベンチマーク

Hugging Faceは、Google CloudのC4(第5世代 Xeon)およびN2(第3世代 Xeon)インスタンスでテキスト埋め込みと生成のベンチマークを行い、C4が埋め込みスループットで10‑24倍、生成スループットで2.3‑3.6倍高いことを確認し、それにより総所有コストにおいてそれぞれ7‑19倍および1.7‑2.9倍の優位性が得られたと報告しています。

6647

Falcon 3 リリースノート / 新機能

Technology Innovation Institute (TII) は、高効率化と科学、数学、コーディング能力の強化を目的として設計された、100億パラメータ未満のデコーダーのみの(decoder-only)大規模言語モデルファミリーである Falcon 3 をリリースしました。

6648

OpenAI o1 およびデベロッパー・ツールキットのアップデート 2024年12月

OpenAIは、APIにプロダクション環境向けのo1推論モデルをリリースし、DPOによるPreference Fine-Tuningを導入し、WebRTCサポートと大幅な値下げを伴うRealtime APIのアップデートを行いました。

6649

Hugging Face Synthetic Data Generator

Hugging Faceは、自然言語プロンプトを使用してカスタムのテキスト分類およびチャットデータセットを作成できるノーコードアプリケーション「Synthetic Data Generator」を導入しました。

6650

OpenAIタイムライン: イーロン・マスクが提案した営利目的の構造と離脱

OpenAIは、2017年にイーロン・マスクが自身の絶対的支配下で営利目的の組織へ移行しようと積極的に働きかけていたことを明らかにする詳細なタイムラインと内部の通信を公開しました。