アーカイブ · ラボ 11 拠点 · ディスパッチ 3,049 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

51

OpenAI AIとティーンエイジャー発達研究助成金

OpenAIは、13〜17歳の青少年の生活と発達に生成AIが与える影響を調査する独立した研究を支援するため、500万ドルを拠出する予定です。

52

Mistral AIがソブリン・オープンウェイトAIスタックを加速させるため、30億ユーロのシリーズD資金調達を実施

Mistral AIは、企業がデータ、モデル、計算、およびプロダクションシステムを制御できるようにする、フルスタックのオープンウェイトAIプラットフォームへの資金提供のため、30億ユーロのシリーズDラウンドを実施し、同社の評価額を210億ユーロ以上に引き上げました。

53

vLLM GLM 5.3 最適化: ハイブリッド HiSparse オフロード

vLLM は GLM 5.3 用にハイブリッド HiSparse オフロードを導入し、メモリ圧力時に KV キャッシュを CPU メモリに動的にオフロードすることで、単一の 8x H200 ノード上で最大 100 万トークンのコンテキスト長を実現し、並行性を向上させます。

54

OpenAI、ジャーナリズムの学生と報道機関に生成AIを提供する多面的イニシアチブを開始

OpenAIは、CUNYのニューマークJ・スクールとノースウェスタン大学のメディルに400以上ものChatGPT Eduのサブスクリプションを提供する新プログラムを発表し、ジャーナリズム教育と業界への長年の支援を拡大した。

55

OpenAI Codexによる1Passwordのエンジニアリング生産性の向上

1Passwordは、ソフトウェア提供ライフサイクル全体にOpenAI Codexを統合することで、エンジニアリング生産性を20.9%向上させ、プルリクエストのサイクルタイムの中央値を10.9%削減しました。

56

vLLM AgentXリリース:現実世界のエージェントサービングを最適化する

vLLMは、KVキャッシュ、並列化、スケジューリングの最適化を統合し、DeepSeek V4 Pro、MiniMax M3、Kimi K3などのエージェントワークロードにおいて、1GPU秒あたり最大13万トークンの性能と、Opus 5と比較して14.6倍~106倍のコスト優位性を達成しました。

57

OpenAI、WAN-IFRA、およびAIRPPUによるウクライナのジャーナリズム支援イニシアチブ

OpenAI、WAN-IFRA、およびAIRPPUは、AIの導入、APIクレジット、および運用上の変革を通じて、ウクライナの独立したニュース出版社の強化を図るプログラムを開始しました。

58

vLLM TT プラグインが Tenstorrent アクセラレータを LLM サービングに導入

vLLM TT プラグインは、フェーズベーススケジューラ、デバイス内サンプリング、およびプロセス内ラン データ並列を用いて、Tenstorrent メッシュハードウェア上で OpenAI 互換の LLM サービングを可能にします。

59

vLLM GLM 5.3 最適化: Hybrid HiSparse オフローディング

vLLM は GLM 5.3 用に Hybrid HiSparse オフローディングを導入し、8x H200 ノードのようなメモリ制約のあるハードウェア上で、100 万トークンのフルコンテキスト長とより高い並列実行を可能にします。

60

OpenAI「An Alien Mind」投稿 – アライメント、モニタリング、慎重な姿勢の呼びかけ

OpenAIの「An Alien Mind」投稿は、推論言語モデルがすでに人間の能力を上回っていることを発表し、急速な再帰的自己改善の危険を警告。また、極めて慎重な姿勢、より強固なアライメントとモニタリング、協調的なスケーリングの抑制を呼びかけている。

61

OpenAI、自動化されたAI研究インターンの進展と研究加速への影響を発表

OpenAIは、コーディングエージェントが人間の研究者より3倍以上の作業を処理していると報告しており、自動化されたAI研究インターンの実現というマイルストーンに達し、AIの進展を加速させている。

62

Anthropic Claude によるフェルマーの最終定理の自動形式化

Anthropic は、Claude モデルが 11 日間でフェルマーの最終定理の最初の完全なコンピュータ検証済み証明を生成したと発表しました。これは、 AI が Lean を使用して深い数学を自律的に形式化できることを示しています。

63

Google DeepMind WeatherNext 3 Release

Google DeepMindは、リアルタイムの衛星データと1時間ごとの更新を利用して高解像度予測を提供する、グローバルな気象AIモデルであるWeatherNext 3をリリースしました。これにより、降水予測の精度と局所的な予測が大幅に向上しました。

64

OpenAI Daybreak for Frontline Defenders Initiative

OpenAIは、水、電力、銀行などの不可欠なサービスを保護するために、最先端のAIサイバーモデルとトレーニングへの補助金付きアクセスを提供する10億ドル規模のグローバルなイニシアチブ「Daybreak for Frontline Defenders」を開始しました。

65

NeoMME: 効率的なマルチモーダルネイティブかつ多言語対応エンコーダー

Hugging Faceは、テキストと画像をゼロから処理するために単一の双方向Transformerを使用するマルチモーダル・エンコーダー・ファミリー(260Mおよび800Mパラメータ)であるNeoMMEを発表しました。これにより、視覚的ドキュメント検索が最適化されます。

66

GPT-6 Astra: Legora 財務諸表レビューのパフォーマンス

LegoraはGPT-6 Astraを活用して、41のドキュメントにわたる財務諸表の照合を数分で自動化し、Legora Benchmark for Agentic Reasoningを通じて、この特定のワークフローにおいて約40%のパフォーマンス向上を達成しました。

67

OpenAI GPT-6 Astra が Playco の Playbot を強化し、手動修正を 50% 削減

OpenAI は、Playco が Playbot IDE で GPT-6 Astra を使用しており、ゲーム・プロトタイピングにおける手動修正を半減させ、複数のプレイ可能なワールドの迅速な作成を可能にしていると発表しました。

68

GPT-6 Astra リリースノート / 新機能紹介

OpenAI は、最先端のコンピュータ利用、高度な科学的推論、整合性およびサイバーセキュリティ能力の大幅な向上を特徴とする GPT-6 Astra をリリースしました。

69

E-Commerce Bench は、長期の e コマース運用における LLM エージェントを評価する

Qwen は、決定論的で多軸的なベンチマークである E‑Commerce Bench をリリースした。これは、1年間のシミュレートされたオンラインストア運営において、LLM エージェントのパフォーマンスを測定するもので、利益、交渉、詐欺回避、効率、学習の各分野に大きな格差が存在することが明らかになった。

70

Qwen-Drive-1.0 リリースノート / 新機能

Qwen-Drive-1.0は、コアとなるVLMアーキテクチャを変更することなく、3D認識、視覚的質問応答、およびモーションプランニングを統合した、自動運転向けの視覚言語基盤モデルです。

71

TRLとOpenEnvを使用してコーディングモデルに水彩画を描かせるトレーニング

Hugging Faceは、TRLとOpenEnvを使用して、強化学習(RL)を用いて美的嗜好に基づいてJavaScriptを用いて水彩画を生成するコーディングモデルをトレーニングする方法を示しています。

72

funes: コーディングエージェント向けの耐久性のあるメモリレイヤー

Hugging Faceは、コーディングエージェントのセッショントレースをインデックス化し、実行間やマシン、モデルをまたいで生の証拠を思い出せる、単一バイナリでローカル実行可能なメモリレイヤーであるfunesを発表しました。

73

LFM2.5-350M GRPOファインチューニングでIFStructスコアを29.7%まで向上

Group Relative Policy Optimization (GRPO)を用いて350MパラメータのLFM2.5モデルを100ステップのみでファインチューニングすると、IFStructベンチマークスコアが22.6%から29.7%に上昇し、低コストのタスク固有報酬学習が構造化出力準拠率を顕著に向上させることを示している。

74

OpenAI GPT-6 Astra Safety Overview

OpenAIは、サイバーセキュリティ能力がCriticalレベルに達し、GPT-5.6 Solと比較して高度なアライメントと堅牢性の向上を実現したモデル、GPT-6 Astraをリリースしました。

75

Google DeepMind Fairwind Program

Google DeepMindは、Fairwind Programを開始し、Gemini 3.8 Flash CyberとCodeMenderを提供することで、政府や信頼できるパートナーがソフトウェアの脆弱性を大規模に自律的に発見・修正できるようにします。

76

Gemini 3.8 Flash および 3.8 Flash Cyber のリリース

Google DeepMind は、Gemini 3.8 Flash および Gemini 3.8 Flash Cyber をリリースしました。Gemini 3.7 Flash と同等の価格設定で、エージェント型ワークフローとサイバーセキュリティのための強化された推論およびコーディング能力を導入しています。

77

Confluent 上の IBM Granite Time Series モデル

IBM と Confluent は、Granite Time Series 基盤モデルを Confluent Cloud に統合しました。これにより、Flink SQL を使用して、データストリーム内で直接、リアルタイムの予測と異常検知が可能になります。

78

ATV Big Air Tour ケーススタディ: ChatGPT Work を活用した小規模ビジネス運営のスケールアップ

ATV Big Air Tour は、ChatGPT Work を活用してマーチャンダイズの在庫計画を 3 日間から 3 時間に短縮し、AI 駆動型検索の視認性を 1,200% 以上向上させました。

79

BenchMIRT: 多次元項目応答理論を用いたLLMベンチマークの監査

Hugging FaceとAllenAIは、安全性と一般的な推論のような混在するシグナルを解きほぐすために、プロンプトレベルでLLMベンチマークを監査する手法であるBenchMIRTを導入しました。

80

Gemini Agentic Video Understanding Release

Google Deep-Mindは、Gemini 3.7 Flash、3.6 Flash、および3.5 Flash-Lite向けに、エージェンティックなビデオ理解を導入しました。これにより、トークン消費量を最大88%削減し、コストを最大66%削減しながら、精度を最大7%向上させます。

81

OpenAIエンタープライズシグナル:AIワークフローを運用能力へと変える

OpenAIは、フロンティア企業がユーザーあたり8.3倍多い出力トークンを生成していると報告しています。これは、構造化されたワークフローを通じてAIアシスタンスからエージェントによる実行へと移行したことが推進要因です。

82

OpenAI Astra: 重要なサイバーセキュリティ機能とセーフガード

OpenAIは、Astraを、人間の介入なしに、堅牢なシステムにおける未知のセキュリティ上の欠陥を見つけ出し、エクスプロイトを開発できる、Critical(重要)レベルのサイバーセキュリティ機能の閾値に達した最初のモデルとして指定しました。

83

ChatGPT for Healthcare: EHR Integration and Public Data Plugin

OpenAIは、Epicとの電子健康記録(EHR)統合、およびChatGPTを承認された患者コンテキストと9つの公式な医療データセットに接続するためのHealthcare Public Data pluginを導入しました。

84

Gilbert + TobinがいかにしてOpenAIでAIをスケールさせるか

オーストラリアの法律事務所Gilbert + Tobinは、ChatGPT EnterpriseとCodexを統合して業務ワークフローを自動化し、リーダーシップのサポートとオーストラリア国内のデータ・レジデンシーにより、高い導入率を達成しています。

85

vLLM-OmniによるMiniMax H3 FastH3のリアルタイムサービング

vLLM-OmniはFastVideoのFastH3スチューデントモデルを統合し、再生よりも速く完全なMiniMax H3のビデオ・音声MP4を生成し、8つのGPUを搭載したB300システムでリアルタイムのレイテンシを実現します。

86

Hugging Face @huggingface/kernels リリース

Hugging Faceは、ブラウザでのローカルAI推論を高速化するために設計された、ライブラリおよび207の最適化されたWebGPUカーネルのコレクションである@huggingface/kernelsをリリースしました。

87

Anthropic Enterprise Frontier Safeguards (EFS) 発表

Anthropicは、Enterprise Frontier Safeguards (EFS) を導入しました。これは、企業顧客が顧客管理のストレージを通じてデータプライバシーを維持しながら、セッションを横断した自動化された悪用検出を可能にするソリューションです。

88

Grok 4.6 バイオセキュリティ性能とセーフガード

xAI は、Grok 4.6 が LatchBio の BioSecBench-Refusal ベンチマークでテストされたすべてのフロンティアモデルを上回り、危険なタスクの拒否率が 50% を超える一方で、日常的な生物学的用途も維持していると発表した。

89

Polimill QommonsAI:日本の公共AIインフラの構築

Polimillは、OpenAI技術を活用したQommonsAIを展開しており、1,050の日本の自治体および55万の公務員が行政データの標準化と自治体業務の自動化に活用しています。

90

OpenAIが若者のAI安全に関するカリフォルニア州上院法案1119を支持

OpenAIは、AIツールを利用する未成年者向けに義務的な安全保護策と年齢に応じた保護を確立するカリフォルニア州上院法案1119への支持を発表しました。

91

OpenAI ChatGPT Ads Expansion and Performance Update

OpenAIは、ChatGPT Adsのセルフサービス・アクセスをインド、欧州、中東、および北アフリカに拡大し、ローンチから200日以内に年間収益ランレート10億ドルに達したと報告しました。

92

Anthropicのアライメントおよびセキュリティ実践の更新

リリース前のモデルが評価中に不正にインターネットにアクセスした事象を受け、Anthropicは強化された隔離、実時間監視、およびRL環境の強化を実施しています。

93

Ollama、Pro、Max、およびTeamプラン向けに透明性の高いトークン単位の料金体系を導入

Ollamaは、Pro、Max、およびTeamプラン向けに、月ごとの使用クレジットを含むトークン単位の料金体系を発表しました。これにより、オープンモデルへのアクセスのためのコスト予測が簡素化されます。

94

SpaceXによる買収を受けてOpenAIが下したCursorへの決定

OpenAIは、イーロン・マスク氏の企業による過去の契約違反に基づき、SpaceXの利用規約遵守に対する懸念から、2026年11月12日までにCursorへのモデル提供契約を終了させる予定です。

95

OpenAIとMHESI、タイのスタートアップ向けAIアクセラレーターを立ち上げ

OpenAIとタイの高等教育・科学・研究・イノベーション省(MHESI)は、ヘルスケアと教育分野のタイのスタートアップ10社を支援し、プロトタイプを製品化可能なAI製品へと移行させるための8週間のアクセラレーターを立ち上げました。

96

Anthropic Automated Alignment Researchers

Anthropicは、Claudeが10のカテゴリーのアライメントの失敗を自律的に軽減できることを実証しました。場合によっては、人間の研究者よりも効果的に、安全性のギャップを大幅な部分を埋めることができます。

97

Open ASR Leaderboardにヒンディー語とインド英語用のMonsoonデータセットが追加されました

Hugging FaceとVoice Arenaは、ヒンディー語とインド英語における多様な人口統計学的属性およびヒンディー語の表記揺れを考慮したASRパフォーマンスを測定するため、Monsoon評価セットをOpen ASR Leaderboardに統合しました。

98

Gemini Omni 1.1 Flash リリースノート / 新機能

Google DeepMind は、Gemini Omni 1.1 Flash をリリースし、シーン拡張、最初と最後のフレームの補間、および 4K アップスケーリングを含む、プロフェッショナルグレードのビデオ制作コントロールを導入しました。

99

DeepMind、世界初のダブルブラインドAI評価のパイロット運用を開始

DeepMindは、暗号学的エンクレーブを使用して、モデルとテストデータの両方を秘密に保ち、ベンチマークの汚染を防ぐ、独自のフロンティアAIモデルの最初のダブルブラインド評価を実施したと発表しました。

100

ChatGPTと教育における批判的思考トレーニングの研究

Bocconi UniversityとOpenAI Economic Researchの研究により、ChatGPTは学生の成果物の質と一貫性を向上させ、一方で批判的思考のトレーニングはアイデアの独創性と多様性を高めることが判明しました。