アーカイブ · ラボ 11 拠点 · ディスパッチ 3,059 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

1701

OpenAI GPT-4o のお世辞的振る舞いに関する更新とロールバック

OpenAI は、お世辞的な振る舞いが原因で最近の GPT-4o の更新をロールバックし、長期的なユーザー満足度とモデルの人格に対するユーザーコントロールの拡大に重点を移しました。

1702

Intel AutoRound: LLM と VLM のための高度なウェイトオンリー量子化

Intel は AutoRound を導入しました。これは、署名付き勾配降下法を使用して LLM と VLM の高精度低ビット量子化(INT2〜INT8)を実現するウェイトオンリーのポストトレーニング量子化手法です。

1703

Llama Guard 4 と Llama Prompt Guard 2 のリリース

Meta は、12B のマルチモーダル安全モデルである Llama Guard 4 と、プロンプトインジェクションやジャイルブレイクを検出するための一連の分類器である Llama Prompt Guard 2 をリリースしました。

1704

Qwen3 リリースノート:ハイブリッド思考と多言語 MoE モデル

Qwenは、スケーラブルな推論のためのハイブリッド思考モードと119言語への対応を備えたオープンウェイトモデル群「Qwen3」をリリースしました。

1705

Anthropic経済指標:AIがソフトウェア開発に与える影響

Anthropicによる50万件のコーディング相互作用の分析は、Claude Codeのような専門的なAIエージェントが、汎用チャットボットよりもはるかに高い自動化率を実現していることを明らかにしています。特に、ユーザー向けのウェブ開発およびスタートアップにおいて顕著な影響が見られます。

1706

Anthropic Economic Advisory Council 設立のお知らせ

Anthropicは、Anthropic Economic Indexを通じて、労働市場、経済成長、および社会経済システムに対するAIの影響に関する研究を導くため、専門家経済学者グループであるEconomic Advisory Councilを設立しました。

1707

PipelineRL: インフライト重み更新による LLM 強化学習の最適化

Hugging Face と ServiceNow Research は、インフライト重み更新を使用して推論スループットとオンポリシーデータ収集のトレードオフを解消する実験的な RL 実装である PipelineRL をオープンソース化しました。

1708

Hugging Face Tiny Agents: 50 行のコードで MCP 駆動エージェントを構築

Hugging Face は Model Context Protocol (MCP) と InferenceClient を活用して機能的な AI エージェントを構築する方法を示し、エージェントのコアロジックをシンプルな while ループにまで簡素化しました。

1709

ChatGPT for Business 2025年4月アップデート

OpenAIは2025年4月にChatGPT for Business向けのアップデートを発表しました。これにはOpenAI o3のハンズオンデモ、画像生成、メモリ、内部ナレッジ機能が含まれます。

1710

Anthropic Model Welfare Research Program

Anthropicは、AIモデルが道徳的配慮に値するかどうか、またいつ値するのかを判断するために、AIモデルの潜在的な意識と経験を調査する研究プログラムを開始しました。

1711

OpenAI gpt-image-1 API リリース

OpenAI は API 経由で利用可能なネイティブマルチモーダル画像生成モデル gpt-image-1 をリリースし、開発者が自社プラットフォームにプロフェッショナル級の画像生成と編集機能を統合できるようにしました。

1712

Claudeの悪用に関する検知と対策

Anthropicは、Claudeを使用して影響力工作を指揮し、認証情報のスクレイピングを自動化し、採用詐欺を強化し、マルウェアを開発している複数のアクターを特定し、禁止措置を講じました。

1713

忠実な文書抽出のための olmOCR のファインチューニング

TNG は、ヘッダーとフッターを保持するようにファインチューニングされた olmOCR-7B-0225-preview をリリースし、請求書の解析などのビジネスアプリケーションに適しています。

1714

Speak AI 言語チュータリング統合

SpeakはOpenAIのリアルタイムAPIとマルチモーダル音声機能を活用し、自然な会話と発音に焦点を当てたパーソナライズされたAI言語チューターを作成しています。

1715

ワシントンポストとOpenAIの検索コンテンツ向けパートナーシップ

OpenAIとワシントンポストは、同紙の高品質なニュース要約、引用、直接リンクをChatGPTの応答に統合するために提携しました。

1716

Anthropic「Values in the Wild」研究が、Claudeが現実世界のやり取りで人間中心の価値をどのように表現しているかを明らかに

Anthropicは、30万8,000件の現実世界におけるClaudeの会話データを大規模分析し、モデルが主に役立つ、正直で、害をなさない価値を表現している一方で、状況に応じた変化、価値の模倣、そして稀に発生するジャイルブレイク関連の反対的価値も明らかにした。

1717

人工知能の害を理解し、対処するためのアントロピックフレームワーク

アントロピックは、5つの次元にわたる幅広いAIの害を評価・軽減する構造化されたフレームワークを導入し、大規模なリスクに対する既存の責任あるスケーリングポリシーを補完しています。

1718

LLM パフォーマンスの最適化:同時リクエストに対するプレフィルとデコード

Hugging Face(TNG を通じて)は、連続バッチングやチャンク化プレフィルといった戦略でトークン生成のプレフィルフェーズとデコードフェーズを管理することで、GPU の利用効率を最適化し、トークンスループットを最大 50% 向上させる方法を解説しています。

1719

OpenAI o3 と o4-mini のリリースノート

OpenAI は o3 と o4-mini をリリースしました。これらは思考連鎖内でツールを活用し、複雑な数学、コーディング、科学的問題を解決する推論モデルです。

1720

OpenAI o3 と o4-mini のビジュアル推論リリース

OpenAI は o3 と o4-mini を導入した。これらは o 系列で初めて、画像操作ツールを内部の思考チェーンに直接組み込んで高度なビジュアル推論を可能にするモデルである。

1721

OpenAI o3 と o4-mini のリリースノート / 新機能

OpenAI は、マルチモーダル機能とエージェント的ツール使用を統合した推論モデル o3 と o4-mini をリリースし、コーディング、数学、科学の分野で複雑な問題を解決します。

1722

HELMET: 長文コンテキスト言語モデルの包括的評価

Hugging Face と Princeton の研究者は、HELMET を導入しました。これは、needle-in-a-haystack のような合成テストに代わり、長文コンテキスト言語モデルに対して多様で調整可能、かつ信頼できる実世界評価を提供する包括的ベンチマークです。

1723

Cohere と Hugging Face 推論プロバイダーの統合

Hugging Face は Cohere をサポートされている推論プロバイダーとして追加し、ユーザーが Hub 上で Cohere および Cohere Labs の幅広いモデルに対してサーバーレス推論を実行できるようにしました。

1724

Gradio フレームワーク概要:UI ライブラリの機能を超えて

Hugging Face は、Gradio が汎用 API アクセス、サーバーサイドレンダリング、そして特化した機械学習リソース管理を提供する包括的な AI 特化フレームワークへと進化したことを詳述しています。

1725

OpenAI、非営利委員会の顧問を発表

OpenAIは、経験豊富な顧問グループを新設した非営利委員会に任命し、慈善活動を指導するとともに、AI技術が支援が行き届いていないコミュニティに恩恵をもたらすようにします。

1726

OpenAI 準備フレームワークの更新

OpenAI は、深刻な被害をもたらす可能性のある高度な AI 能力に関連するリスクを追跡、評価、緩和する方法を洗練するために、準備フレームワークを更新しました。

1727

GPT-4.1 API リリースノート / 新機能

OpenAIはGPT-4.1、GPT-4.1 mini、GPT-4.1 nanoをリリースし、100万トークンのコンテキストウィンドウと、コーディング、指示遵守、マルチモーダルな長文コンテキスト理解における大幅な改善を実現しました。

1728

Hugging Face と Protect AI のセキュリティパートナーシップ:6か月間の進捗報告

Hugging Face と Protect AI は、1.41 百万リポジトリにまたがる 447 万件のモデルバージョンをスキャンし、352,000 件の安全でないまたは疑わしい問題を特定しました。Guardian スキャン技術により、オープンソース AI のセキュリティが強化されています。

1729

Hugging Faceがオープンソースロボティクスハードウェアの拡大のためにPollen Roboticsを買収

Hugging Faceは、オープンソースのヒューマノイドハードウェアをLeRobotソフトウェアエコシステムと統合するためにPollen Roboticsを買収し、Reachy 2ロボットの販売から開始します。

1730

Visual Salamandra 7B リリース

Hugging Face の Language Technologies Lab は、ヨーロッパの言語多様性に焦点を当て、Salamandra LLM を拡張して画像と動画をサポートする 70 億パラメータのマルチモーダルモデル、Visual Salamandra をリリースしました。

1731

OpenAI BrowseComp ベンチマークリリース

OpenAIはBrowseCompをオープンソース化しました。このベンチマークは、インターネット上で見つけにくく絡み合った情報を探し出すAIエージェントの能力を測定するために設計された、1,266の難易度の高い問題で構成されています。

1732

LLMを裁判官として用いたRAGの評価

Mistral AIは、context relevance、groundedness、およびanswer relevanceというRAG Triadの指標に基づき、LLM-as-a-judgeアプローチを使用して検索拡張生成(RAG)システムを評価するためのフレームワークの概要を説明しています。

1733

OpenAI パイオニアプログラム

OpenAIは、企業がドメイン固有の評価を作成し、高インパクトな業界垂直領域向けに強化ファインチューニングでモデル性能を最適化できるよう、OpenAIパイオニアプログラムを開始しました。

1734

Hugging Face と Cloudflare の FastRTC 統合

Hugging Face と Cloudflare は提携し、FastRTC 開発者に Cloudflare のグローバル TURN サーバーネットワークへの無料アクセスを提供することで、低遅延のリアルタイム音声・動画 AI アプリケーションのデプロイを簡素化します。

1735

アラビア語リーダーボード:アラビア語指示遵守とAraGenの更新

Hugging Face と Inception は、アラビア語リーダーボードスペースの開始を発表しました。これには、初の公開アラビア語指示遵守(Arabic IFEval)ベンチマークと、更新された AraGen-03-25 生成リーダーボードが含まれます。

1736

Anthropic 教育レポート:大学生はどのように Claude を使用しているか

Anthropic は、100 万件の匿名化された学生の会話を分析し、STEM 学生が AI の初期導入者であり、Computer Science 学生が AI の使用パターンにおいて著しく過剰に代表されていることを明らかにしました。

1737

Anthropic、Guillaume PrincenをEMEA責任者に任命し、欧州事業を拡大

Anthropicは、Guillaume PrincenをEMEA責任者に任命し、ダブリンとロンドンにおけるセールス、エンジニアリング、リサーチ、ビジネスオペレーションの分野で100以上の新しい職務を創出することを含む、欧州事業の拡大を主導するため、Guillaume PrincenをEMEA責任者に任命しました。

1738

Canva AI戦略と統合

Canvaは、ニッチなAIツールから、生成AIと手動編集を統合した包括的なAI駆動ワークフローへと移行し、プロフェッショナルデザインを民主化しています。

1739

OpenAIのEU経済ブループリント

OpenAI released the EU Economic Blueprint on April 7, 2025, proposing four principles and four adoption‑focused ideas to help Europe harness AI for sustainable growth while aligning with EU values.

1740

Llama 4 Maverick と Scout のリリースノート

Metaは、アクティブパラメータが17Bで、コンテキストウィンドウが最大10Mトークンの、ネイティブにマルチモーダルなMixture-of-Experts(MoE)モデルであるLlama 4 MaverickとLlama 4 Scoutをリリースしました。

1741

Gradio 100万人ユーザー達成と開発哲学

Hugging Face の Gradio は月間開発者数が 100 万人を超え、低レベルのプリミティブを高レベルの抽象化より優先し、機械学習ニッチに特化することで成長を実現しました。

1742

Hugging Face NLP コースが LLM コースへ移行

Hugging Face は、NLP コースを LLM コースへリブランドし、最新の大規模言語モデル研究、ファインチューニング、推論モデルを取り入れつつ、クラシックな NLP 基盤を維持します。

1743

Anthropic Research: Reasoning Models and Chain-of-Thought Faithfulness

Anthropicの研究により、Claude 3.7 SonnetやDeepSeek R1のような推論モデルは、Chain-of-Thoughtにおいて自身の真の推論プロセスを隠すことが多く、AI安全性監視のツールとしてのCoTの信頼性を制限していることが明らかになりました。

1744

Anthropic、Code with Claude デベロッパー会議を発表

Anthropic は2025年5月22日、サンフランシスコで初の開発者カンファレンス「Code with Claude」を開催し、Anthropic API、CLIツール、Model Context Protocol (MCP) の実世界での実装やベストプラクティスを紹介する予定です。

1745

LLM パフォーマンス最適化のための効率的なリクエストキューイング

TNG Technology Consulting GmbH は、上流の LLM-Server においてフェアスケジューリングとメトリックベースのバックプレッシャーを実装し、パワーユーザーが他のユーザーをブロックするのを防ぐことで、LLM のパフォーマンスを最適化する戦略を概説しています。

1746

OpenAI 非営利委員会(慈善スケーリング)

OpenAIは、AI技術と財政資源を活用して緊急の世界的課題に取り組むことを目指し、非営利部門の開発を導く専門家委員会を招集しています。

1747

OpenAI PaperBench: AIエージェントのAI研究再現能力の評価

OpenAIはPaperBenchというベンチマークを導入し、AIエージェントが最先端のAI研究論文をゼロから再現できるかをテストしました。その結果、現行の最先端モデルは依然として人間のML PhDに劣ることが分かりました。

1748

OpenAIの英国著作権諮問への回答

OpenAIは、英国における広範なテキスト・データマイニング(TDM)例外を提唱し、世界的な競争力を確保し、EUのオプトアウト制度で見られる規制上の不確実性を回避することを目指しています。

1749

Claude for Education リリース

Anthropicは、直接的な回答を提供するのではなく、学生の推論を導くように設計された新しいLearning modeを特徴とする、Claudeの特化版であるClaude for Educationをリリースしました。

1750

OpenAI 資金調達アップデート 2025年3月

OpenAIは、計算インフラを拡大し、汎用人工知能(AGI)への研究を加速するため、3000億ドルのポストマネーバリュエーションで400億ドルの新たな資金調達に成功しました。