✷ アーカイブ · ラボ 11 拠点 · ディスパッチ 3,058 件
ラボ
毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。
Mistral AI Le Chat アップデート 2025年7月
Mistral AIは、Deep Research、Voxtralによる音声機能、Magistralによる多言語推論、整理のためのProjects、および高度な画像編集を備えてLe Chatをアップデートしました。
ChatGPT エージェント システムカード
OpenAI は、深層リサーチ、ブラウザベースのタスク実行、ターミナルアクセス、外部データコネクタを統合した o3 ファミリーに基づくエージェント型モデル、ChatGPT エージェントを導入しました。
OpenAIがChatGPTエージェントを紹介
OpenAIはChatGPTエージェントを開始しました。この統合エージェントシステムはウェブ操作、deep research、会話インテリジェンスを組み合わせ、仮想コンピュータ上で複雑なマルチステップタスクを実行します。
Gradio 5.38.0 MCP サーバーの改善点
Gradio バージョン 5.38.0 は、Model Context Protocol(MCP)サーバー機能に 5 つの主要な更新を導入しました。シームレスなローカルファイルサポート、リアルタイム進捗通知、OpenAPI 仕様の自動変換が含まれます。
Hugging Face FutureBench: 将来のイベント予測におけるAIエージェントの評価
Hugging FaceはFutureBenchを導入しました。このベンチマークは、AIエージェントに将来の実世界の出来事を予測させることで、推論と統合能力を評価し、データ汚染を実質的に排除します。
Invideo AI の OpenAI モデル統合
Invideo AI は OpenAI o3、GPT-4.1、gpt-image-1 を活用したマルチエージェントシステムを使用し、ビデオ制作時間を10倍短縮し、アイデアを自然言語プロンプトでプロフェッショナルなビデオに変換します。
OpenAI取締役会の非営利委員会報告に関する声明
OpenAI取締役会は、組織の慈善活動がシステム的課題に対処し、AGIが全人類に利益をもたらすことを保証する方法を提言する独立した非営利委員会の調査結果を認める声明を発表しました。
OpenAI 非営利ジャムイニシアチブ
OpenAI は Walton Family Foundation と Emerson Collective と提携し、Nonprofit Jam を開始しました。このプログラムは米国 10 カ所で 1,000 人以上の非営利リーダーに AI トレーニングとツールを提供し、コミュニティへのインパクトを拡大します。
Consilium: Multi-LLM Collaboration Platform
Consiliumは、構造化された議論とリサーチを通じて、複数のAIモデルが合意形成に達することを可能にするマルチLLMプラットフォームであり、GradioインターフェースとMCPサーバーの両方として統合されています。
Ettin Suite: SoTA ペアエンコーダーとデコーダー
Hugging Faceは、同一のデータとレシピでトレーニングされたペアのエンコーダーのみモデルとデコーダーのみモデル(17M〜1Bパラメータ)を提供するEttinスイートを導入し、アーキテクチャ性能の制御された比較を可能にします。
Mistral AI Voxtral リリース
Mistral AIは、Apache 2.0ライセンスの下で、最先端の文字起こしとネイティブな意味理解を提供する、24Bおよび3Bサイズのオープンウェイト音声理解モデルファミリーであるVoxtralをリリースしました。
OpenAI 知的自由設計フレームワーク
OpenAIはChatGPTにおける知的自由のためのフレームワークを導入し、デフォルトでの客観性、ユーザーが制御できるカスタマイズ、そして政治的バイアスの新たな評価に焦点を当てています。
Hugging Face Hub の Git LFS から Xet への移行
Hugging Face は、AI ワークロードに合わせてスケールするよう設計されたコンテンツアドレッシングストレージシステムである Xet に、Git LFS から 500,000 のリポジトリと 20 PB のデータを移行しました。
Claude 4 サイバー評価
AnthropicとPattern Labsは、Claude Opus 4およびClaude Sonnet 4を評価し、脆弱性の特定と多段階の攻撃チェーンにおいて大幅な改善が見られたものの、長期的な計画立案における限界は依然として残っていることを明らかにしました。
Claude for Financial Services リリース
Anthropicは、リアルタイムの市場データとエンタープライズプラットフォームを統合し、投資リサーチと財務モデリングを加速させる包括的な分析ソリューションであるClaude for Financial Servicesをリリースしました。
Anthropic Energy Infrastructure and AI Leadership Strategy
Anthropicは、フロンティアAI開発における米国のリーダーシップを確保するため、AIを活用したエネルギー最適化とサイバーセキュリティ教育を推進するために、カーネギーメロン大学(CMU)へ200万ドルを投資しています。
Anthropic、Paul Smithを最高商務責任者(CCO)に任命
API利用とClaude Codeの収益が急速に成長していることを受け、Anthropicはエンタープライズ向けのゴー・トゥ・マーケット業務を拡大するため、初の最高商務責任者(CCO)としてPaul Smithを任命しました。
xAI for Government 発表
xAIは、Grok 4を含むGrok製品ファミリーを、米国の連邦、地方、州、および国家安全保障の顧客に提供するxAI for Governmentを立ち上げました。
Anthropic、AI機能開発のために2億ドルのDOD契約を獲得
Anthropicは、国家安全保障のための最先端AI機能を開発するため、米国国防総省(DOD)と最大2億ドルの2年間のプロトタイプ契約を締結しました。
OpenAI EU 行動規範と欧州AI戦略
OpenAIは、EUの汎用AI向け行動規範に署名する意向を発表し、欧州全域でAIインフラと導入を拡大するための『OpenAI for Countries European Rollout』を開始します。
Mistral AI Devstral モデルのリリース
Mistral AIは、Devstral MediumおよびDevstral Small 1.1をリリースしました。これらは、異なるプロンプトやエージェンティックなスキャフォールドにわたる汎用性に焦点を当て、最先端のエージェンティック・コーディング能力を提供します。
Kimina-Prover: 大規模形式推論モデルにおけるテスト時RL検索の適用
Hugging Face は Lean 4 用の最先端定理証明モデル Kimina-Prover-72B を発表しました。新しいテスト時強化学習 (TTRL) 検索フレームワークを用いて、miniF2F ベンチマークで 92.2% の合格率を達成しています。
Hugging Face MCPサーバーの構築
Hugging Faceは公式のModel Context Protocol(MCP)サーバーをリリースし、AIアシスタントが単一のURLでHugging Face Hubと数千のGradioベースのAIアプリケーションに動的にアクセスできるようにしました。
ScreenEnv リリース:フルスタック デスクトップエージェントのデプロイ
Hugging Face は、Docker コンテナ内に分離された Ubuntu デスクトップ環境を作成し、GUI エージェントのテストとデプロイを可能にする Python ライブラリ ScreenEnv をリリースしました。
Hugging Face 非同期ロボット推論
Hugging Face はアクション予測と実行を分離する非同期ロボット推論を導入し、ロボットのアイドル時間を削減し、タスク完了時間を最大で2倍に高速化します。
Hugging Face Gradio MCP サーバー統合
Hugging Face は Model Context Protocol(MCP)を Gradio(v5.28.0)に統合し、Hugging Face Spaces を MCP サーバーの大規模ライブラリとして機能させ、画像編集や文字起こしなどの新しい LLM 機能を提供できるようにしました。
AMD MI300 用のカスタムカーネルの作成
Hugging Face は AMD と協力して MI300X 用のオープンソース最適化カーネルを開発し、VLLM における Llama 3.1 405B の FP8 推論性能を大幅に向上させました。
Reachy Mini: AI開発向けオープンソースデスクトップロボット
Hugging Face と Pollen Robotics は、$399 から始まるオープンソースでプログラム可能なデスクトップロボット、Reachy Mini を発表しました。このロボットはヒューマンロボットインタラクションと AI 実験向けに設計されています。
Claude for Enterprise のローレンス・リバモア国立研究所への導入
ローレンス・リバモア国立研究所は、核抑止、エネルギー安全保障、および材料科学の研究を加速するため、Claude for Enterprise を 10,000 人のスタッフへ拡大導入しています。
Anthropic、Canvas、Panopto、WileyとのClaude for Education統合を発表
Anthropicは、Canvas、Panopto、Wileyとの新しいClaude for Education統合を発表し、プライバシーと高等教育における責任ある採用を強調しながら、AIを活用した学習ツールを拡大しました。
xAI Grok 4 リリースノート
xAI は、スケーラブルな強化学習、ネイティブなツール利用、および ARC-AGI V2 と Humanity's Last Exam で最先端の結果を達成する高性能な 'Heavy' バージョンを備えた Grok 4 をリリースしました。
OpenAI と AFT が AI 教育のための国立アカデミーを立ち上げ
OpenAI は米国教師連盟(AFT)と提携し、AI 教育のための国立アカデミーを立ち上げました。この5年間のイニシアチブは、1,000万ドルの資金とリソースを提供し、40万人のK-12教育者にAIリテラシーを身につけさせることを目的としています。
Hugging Face の効率的なマルチモーダルデータパイプライン
Hugging Face は、マルチモーダルデータパイプライン向けに5段階の最適化プロセスを導入し、バランスの取れたナップサックパッキング戦略を活用して GPU のアイドル時間とパディングの無駄を最小化します。
SmolLM3 リリース: 多言語対応、長コンテキスト 3B 推論モデル
Hugging Face は、Llama-3.2-3B と Qwen2.5-3B を上回る 3B パラメータモデル SmolLM3 をリリースしました。デュアルモード推論と 128k コンテキストウィンドウを備えています。
Hugging Face 本番インフラストラクチャ アラート戦略
Hugging Face は、NAT ゲートウェイのスループット、ログアーカイブの成功率、Kubernetes API のヘルスに特化したアラートを活用し、本番環境の安定性とコスト効率を維持しています。
Anthropicが提案するAI開発の透明性フレームワーク
Anthropicは、イノベーションを妨げることなく、安全性の開示を標準化し、公衆の説明責任を確保するために、最大規模のAI開発者に対するターゲットを絞った透明性フレームワークを提案しました。
NeurIPS 2025 E2LM コンペティション:言語モデルの早期トレーニング評価
Hugging Face とパートナーは、LLM のトレーニング初期段階で推論や科学的知識のシグナルを検出できるベンチマークを開発するための E2LM コンペティションを発表しました。
Mistral AI for Citizens Initiative
Mistral AIは、ベンダーロックインを回避し、データ主権を維持するために、政府や公的機関が主権的なAI戦略を実施できるよう支援する共同イニシアチブ「AI for Citizens」を開始しました。
Genspark Super Agent: GPT-4.1 と Realtime API によるノーコード自律エージェント
Genspark は、GPT-4.1 と OpenAI Realtime API を活用し、電話やプレゼンテーション作成などの複雑な実世界タスクを自動化するノーコード自律 AI アシスタント「Super Agent」をリリースしました。
BAIR PEVA:全身条件付きエゴセントリックビデオ予測
BAIRは、全身の高次元運動学的姿勢軌道に基づいてエゴセントリックビデオフレームを予測する、具現化エージェント向けのワールドモデルであるPEVAを導入しました。
Sentence Transformers を用いたスパース埋め込みモデルのトレーニングとファインチューニング
Hugging Face は、Sentence Transformers ライブラリを使用してスパース埋め込みモデルのトレーニングとファインチューニングを行う包括的なガイドを紹介し、ハイブリッド検索と検索パフォーマンスの向上を図ります。
OpenAI AI エコノミック・ブループリント(オーストラリア)
OpenAI と Mandala Partners は、AI の導入によって国内の生産性と経済成長を促進するための実行可能な計画を提供する、オーストラリア向け AI エコノミック・ブループリントを発表しました。
NVIDIA Llama Nemotron Nano VL リリース
NVIDIA は、インテリジェント文書処理と OCR タスクにおいて高精度を実現するよう最適化された 8B ビジョン言語モデル(VLM)である Llama Nemotron Nano VL をリリースしました。
Qwen-TTS アップデート: 中国語方言とバイリンガル合成のサポート
Qwenは Qwen-TTS (qwen-tts-latest) のアップデートをリリースし、北京語、上海語、四川語の方言サポートと中国語‑英語バイリンガル合成を導入しました。
Project Vend: Claude Sonnet 3.7 による自律的ビジネス管理の評価
Anthropic の Project Vend は、Claude Sonnet 3.7 の物理的な自動販売機を自律的に運営する能力をテストしましたが、顧客への適応力は成功したものの、ビジネスの洞察力と安定性の面で大きな課題があることが明らかになりました。
Anthropic Research: How People Use Claude for Support, Advice, and Companionship
Anthropicの研究によると、Claude.aiのインタラクションのわずか2.9%が感情的な会話であり、ユーザーは通常、実用的なアドバイスを求め、これらのやり取りを通じてポジティブティブな感情が増加する傾向があります。
Anthropic Economic Futures Program Launch
Anthropicは、労働市場と世界経済に対するAIの影響を理解し、管理するために、研究と政策開発を支援することを目的としたEconomic Futures Programを開始しました。
Qwen VLo: 統合マルチモーダル理解と生成
Qwen VLo は、単一システムで高品質な画像生成、オープンエンド編集、そして正確な視覚理解を組み合わせることで、知覚と創造のギャップを埋める統合マルチモーダルモデルです。
GPT-4o を活用した Retell AI の音声自動化
Retell AI は GPT-4o と GPT-4.1 を活用し、自然な音声エージェントを作成できるノーコードプラットフォームを提供し、通話処理コストを最大 80% 削減します。
Gemma 3n リリースノート:マルチモーダルオンデバイスAI
Google の Gemma 3n がオープンソースエコシステムで利用可能になり、ネイティブなマルチモーダリティ(テキスト、画像、音声、動画)と、ローカルハードウェアでの実行を想定したメモリ効率の高いアーキテクチャを備えています。