アーカイブ · ラボ 11 拠点 · ディスパッチ 3,049 件

ラボ

毎朝十数個の公式ブログを開いて回る必要はありません。OpenAI、Anthropic、DeepMind などの一次発表を、要点を抜き出した形で。

951

GPT-5.3-Codex リリースノート / 新機能

OpenAI は、GPT-5.2-Codex よりもパフォーマンス、推論、速度が向上したエージェント型コーディングモデル GPT-5.3-Codex をリリースしました。これにより、複雑で長時間にわたる技術タスクを自律的に実行できるようになりました。

952

Claude Opus 4.6: LLM-Discovered Zero-Day Vulnerabilities

AnthropicのClaude Opus 4.6は、人間のような研究者のようにコードを推論することで、十分にテストされたオープンソースのコードベースにおいて、高深刻度のゼロデイ脆弱性を発見できます。

953

Agentic Coding Evalsにおけるインフラノイズの定量的分析

Anthropicの研究により、Agenticコーディングベンチマークにおけるインフラリソース構成が、スコアのばらつきを最大6ポイントまで引き起こす可能性があることが明らかになった。これは、真のモデル能力の差を隠蔽または誤って模倣する要因となる可能性がある。

954

並列ClaudeエージェントチームによるCコンパイラの構築

Anthropicの研究者であるNicholas Carliniは、16個の並列なClaude Opus 4.6エージェントを使用して、Linux 6.9カーネルをコンパイル可能な10万行のRustベースのCコンパイラを自律的に構築しました。

955

Mistral AI Voxtral Transcribe 2 リリース

Mistral AIは、高効率なバッチ処理用のVoxtral Mini Transcribe V2と、超低遅延のライブ文字起こし用のVoxtral Realtimeを備えたVoxtral Transcribe 2をリリースしました。

956

OpenAI Codex アプリサーバーのアーキテクチャと統合

OpenAI は Codex アプリサーバーを導入しました。これは JSON‑RPC ベースのプロトコルとプロセスで、Codex エージェントハーネスを様々なクライアントに公開し、IDE、Web ランタイム、ターミナルインターフェース間で一貫したエージェント体験を実現します。

957

Hugging Face Community Evals

Hugging Face は Community Evals を導入しました。これは、Hub 上でモデルベンチマークスコアを直接報告・集約する分散型システムで、透明性と再現性の向上を図ります。

958

Anthropic Commits to Ad-Free Experience for Claude

Anthropic は、Claude が広告なしの環境を維持することで、AIアシスタントがユーザーの利益のみを最優先し、深い思考や作業に集中できる環境を保つことを約束しました。

959

H Company Holo2-235B-A22B プレビューリリース

H Companyは、Screenspot-ProとOSWorld Gベンチマークで最先端の性能を達成するUIローカリゼーションモデル、Holo2-235B-A22B Previewをリリースしました。

960

グローバルオープンソースAIエコシステムの未来:DeepSeekからAI+へ

Hugging Faceは、オープンソースが中国のAI組織にとって支配的な戦略となり、孤立したモデルのブレークスルーから、モデル、ハードウェア、インフラストラクチャのスケーラブルで統合されたエコシステムへとシフトした様子を分析しています。

961

テキストから画像へのモデルのトレーニング設計:アブレーションからの教訓

テキストから画像へのモデルのトレーニング設計に関する Hugging Face の投稿の提供されたソース資料は、429 Too Many Requests エラーのため利用できません。

962

OpenAI Sora フィード哲学

OpenAI は、Sora フィードの設計原則と安全フレームワークを詳細に示し、創造性重視のランキング、パーソナライズされた推奨、そして多層的な安全ガードレールに焦点を当てています。

963

Apple Xcode 26.3 Claude Agent SDK Integration

Apple Xcode 26.3はClaude Agent SDKを統合し、自律的なコーディングタスク、Xcode Previewsによる視覚的検証、およびIDE内でのプロジェクト全体の推論を可能にします。

964

Qwen3-Coder-Next リリース:高効率エージェント型コーディングモデル

Qwen3-Coder-Next はハイブリッドアテンションと MoE アーキテクチャに基づくオープンウェイトモデルで、SWE-Bench Verified で 70% 以上の成功率を達成し、10〜20 倍大きいモデルに匹敵する性能を提供します。

965

エンタープライズインテリジェンスのためのSnowflakeとOpenAIのパートナーシップ

OpenAIとSnowflakeは、GPT-5.2を含むOpenAIの最先端モデルをSnowflake AI Data Cloudに直接統合するため、2億ドルの契約を締結し、セキュアでデータに基づくAIエージェントやアプリケーションの作成を可能にします。

966

OpenAI Codex アプリリリース – macOS と Windows 用のマルチエージェント デスクトップインターフェース

OpenAI は macOS 用の Codex デスクトップアプリをリリースし(2026 年 3 月に Windows サポートが追加)、開発者が複数の AI エージェントを並行して実行・監視・協働させ、再利用可能なスキルで拡張し、繰り返し作業を自動化できる統合インターフェースを提供します。

967

xAI が SpaceX に買収される

2026 年 2 月 2 日に発表された通り、SpaceX は xAI を買収し、AI 研究所を航空宇宙企業へと統合しました。

968

Anthropic、科学的発見に向けてAllen InstituteおよびHHMIと提携

Anthropicは、特化型AIエージェントとマルチエージェント・システムを通じて、Claudeを最先端の生物学的研究に統合するため、Allen InstituteおよびHoward Hughes Medical Institute (HHMI) と提携しました。

969

Ollamaによる個人用AIコーディングアシスタントOpenClawのリリース

Ollamaは、WhatsApp、Telegram、Slack、Discord、iMessage、その他のメッセージングプラットフォームを、中央集約型のゲートウェイを介してAIコーディングエージェントに接続する、ローカル実行型の個人用AIアシスタントOpenClawを発表しました。これにより、プライベートでクロスプラットフォームなコード支援が可能になります。

970

作戦名「トローリング・ストーン」:ロシアに関連する影響力工作

OpenAIは、アルゼンチンにおけるロシアのカルト指導者に関する偽ニュースやコメントを生成する、ロシアに関連する組織的な影響力工作に使用された複数のChatGPTアカウントを禁止したことを明らかにしました。これは、アストロターフィング(世論工作)のためのAIの悪用を浮き彫りにしています。

971

AIを活用したロマンス詐欺に関するOpenAIのケーススタディ

OpenAIは、悪意のあるアクターがChatGPTを悪用してロマンス詐欺や投資詐欺を行う際に用いる「ping」「zing」「sting」という3段階のワークフローを特定しました。

972

OpenAI Silver Lining Playbook: 中国発の米国人を標的とした活動

OpenAIは、ChatGPTを使用して米国職員を標的としたソーシャルエンジニアリングメールを作成していた中国関連の活動を明らかにしました。これは、生成AIが外国諜報機関のリクルート活動に悪用される可能性があることを浮き彫りにしています。

973

Operation False Witness: OpenAIがAIを活用した被害回復詐欺を阻止

OpenAIは、カンボジアを拠点とする犯罪グループが、法律事務所や米国の当局になりすまして被害回復を装う詐欺を行うために使用していたChatGPTアカウントのグループを停止しました。

974

Operation Date Bait: OpenAIがAIを活用したロマンス詐欺ネットワークを阻止

OpenAIは、カンボジアで発生した可能性が高く、毎月数百人の被害者をターゲットにしていた半自動化されたロマンス詐欺およびタスク詐欺に関与していたChatGPTアカウントのクラスターとAPI顧客を禁止しました。

975

OpenAIのオペレーション「Fish Food」:ロシア発のコンテンツファームを停止

OpenAIは、ロシアの「Rybar」オペレーションに関連するChatGPTアカウントネットワークを停止しました。このネットワークは、AIが生成したテキストや動画を悪用してソーシャルメディア上で秘密裏に影響力工作を行っており、大規模言語モデルが偽情報工作に悪用されるリスクを浮き彫りにしました。

976

OpenAI Operation No Bell ケーススタディ

OpenAIは、サハラ以南のアフリカと米国を標的とした地政学的な偽情報を生成するために使用されていた、ロシアに関連するChatGPTアカウントを停止しました。

977

OpenAIケーススタディ:中国の法執行機関による「サイバー特別作戦」影響工作

OpenAIは、日本の首相や反体制派に対する隠密的な影響工作を計画・報告しようとした、中国の法執行機関に関連するChatGPTアカウントを停止したことを明らかにしました。これにより、AIを活用した大規模な「サイバー特別作戦」の取り組みが露呈しました。

978

Project Genie: Google DeepMind のインタラクティブなワールドモデルプロトタイプ

Google DeepMind は、Genie 3 を搭載した実験的研究プロトタイプである Project Genie を発表しました。このプロトタイプは、ユーザーがインタラクティブでリアルタイムに生成された環境を作成、探索、リミックスできるようにします。

979

OpenAI社内データエージェントの内部

OpenAIは、自然言語で600ペタバイト規模のデータを分析できる社内専用AIデータエージェントを開発しました。多層コンテキストシステムと自己学習型推論ループを活用し、従業員が複雑なデータ分析を迅速に行えるようにしています。

980

Daggr の紹介:視覚的検査で AI アプリをプログラム的に連結

Hugging Face は Daggr をリリースしました。これはオープンソースの Python ライブラリで、開発者が Gradio アプリ、機械学習モデル、カスタム関数をプログラム的に連結し、デバッグや状態管理のための自動生成ビジュアルキャンバスを備えたワークフローを構築できるようにします。

981

OpenAI、ChatGPTでGPT-4o、GPT-4.1、o4-miniを廃止

OpenAIは、利用がGPT-5.2へシフトしたため、2026年2月13日にChatGPTからGPT-4o、GPT-4.1、GPT-4.1 mini、OpenAI o4-miniを廃止します。

982

大成株式会社 ChatGPT Enterprise 実装

大成株式会社は、ChatGPT Enterprise を人材育成戦略の中核として導入し、人間の可能性を拡大し、建設業界における労働力の能力を再構築しています。

983

AIによる支援がコーディングスキルの形成に与える影響

Anthropicの研究により、AI支援はコーディングタスクを高速化できる一方で、手動コーディングと比較して、スキル習得度とデバッグ能力において統計的に有意な低下をもたらすことが明らかになりました。

984

Qwen3-ASR と Qwen3-ForcedAligner のリリース

Qwen は Qwen3-ASR(1.7B と 0.6B)と Qwen3-ForcedAligner-0.6B をオープンソース化し、Apache 2.0 ライセンスの下で最先端の多言語音声認識と非自己回帰タイムスタンプ予測を提供します。

985

OpenAI EU 経済ブループリント 2.0

OpenAIはEU Economic Blueprint 2.0を開始し、20,000のSMEを対象とした研修プログラム、若者安全助成金、そして政府パートナーシップの拡大を通じて、ヨーロッパのAI能力オーバーハングを解消します。

986

OpenAI EMEA ユース&ウェルビーイング助成金 2026

OpenAIは、ヨーロッパ・中東・アフリカ全域の若者の安全、ウェルビーイング、そして発展に関するAIに取り組むNGOや研究者を支援するため、€500,000のEMEAユース&ウェルビーイング助成金を開始しました。

987

Hugging Face Upskill: エキスパートの能力をエージェントスキルを通じて小型モデルへ転送

Hugging Face は `upskill` を導入しました。このツールは Claude Opus 4.5 などの高性能モデルを活用し、検証済みの「エージェントスキル」を生成して、CUDA カーネル開発といった複雑タスクにおける小型またはオープンソースモデルの性能とトークン効率を向上させます。

988

OpenAI AI エージェント リンク セーフティ

OpenAIは、独立したウェブインデックスを介して以前に公開済みとして検証されたURLのみを自動的に取得できるようにAIエージェントを制限することで、URLベースのデータ漏洩を防止するシステムを実装しました。

989

AI利用におけるエンパワーメント喪失パターンのAnthropicによる研究

Anthropicによる150万件のClaude.aiの会話の分析によれば、AIは稀ではあるものの、ユーザーの信念、価値観、および行動を歪めることで、ユーザーのエンパワーメントを喪失させる可能性があることが明らかになりました。特に、ユーザーが自発的に自律性を譲り渡してしまう場合に、そのリスクが高まります。

990

xAI Grok Imagine API リリース

xAIは、低レイテンシとコスト効率に重点を置いた、高品質なビデオ生成と精密なビデオ編集のための統合ビデオ・オーディオ生成モデルであるGrok Imagine APIをリリースしました。

991

ServiceNowがBuild AgentおよびAI PlatformのデフォルトモデルとしてClaudeを統合

ServiceNowは、エンタープライズワークフローを自動化し、内部生産性を向上させるために、Build AgentのデフォルトモデルおよびAI Platformの推奨モデルとしてClaudeを採用しました。

992

Mistral Vibe 2.0 リリースノート

Mistral AIは、カスタムサブエージェント、スラッシュコマンドスキル、および統合エージェントモードを導入した、Devstral 2 モデルファミリーを搭載したターミナルネイティブなコーディングエージェント、Mistral Vibe 2.0をリリースしました。

993

中国のオープンソースAIエコシステムにおけるアーキテクチャ選択:DeepSeek R1からハードウェアファースト、MoE主導の風景へ

DeepSeek R1のオープンソースリリースから1年後、中国のAIコミュニティは最大単一モデル性能の追求から、柔軟でコスト効果が高くハードウェアに配慮したAIシステムの構築へとシフトしました。Mixture‑of‑Experts(MoE)がデフォルトアーキテクチャとなり、リクエストごとにエキスパートの一部だけを活性化することで巨大モデルを手頃に運用できるようになりました。マルチモーダルレースが急速に拡大し、テキスト‑ツー‑イメージ、動画、音声、3‑D、エージェント向けのオープンリリースがそれぞれフルツールチェーンと共に提供されました。小型モデル(≤30 B)の人気が高まり、ローカルデプロイやファインチューニングが容易になり、大規模MoEモデルは教師ネットとして蒸留に利用されています。Apache 2.0 と MIT ライセンスが支配的となり、法的摩擦が除去され商用採用が加速しました。ハードウェアファーストの考え方が浸透し、リリースは国内チップ(Huawei Ascend、Cambricon、Kunlun)向けに量子化・推論・サービングスタックが調整され、トレーニングパイプラインもオープンに文書化されています。競争の鍵は、モデルサイズの大きさではなく、システム設計、デプロイ効率、オープンソースエコシステム統合に移行しています。

994

Alyah: アラビア語LLM向けエミラティ方言ベンチマーク

Hugging Face とパートナーは、エミラティ方言におけるアラビア語LLMの言語的・文化的能力を評価するために設計された、1,173 件のサンプルからなる手動キュレーションベンチマーク「Alyah」を導入しました。

995

OpenAI、ファッションの未来に向けてPVHとの提携を発表

OpenAIは、ファッションにおけるAI主導のイノベーションを模索するため、PVHとの提携を発表しました。これは、アパレル業界におけるAIの戦略的重要性を強調しています。

996

GPT-OSS Agentic RL 訓練: 実践的な振り返り

Hugging FaceとLinkedInの研究者は、GPT-OSSモデルに対して安定したエージェント強化学習を可能にするために必要なエンジニアリングの修正を詳しく説明し、MoEルーティング、注意シンク、およびメモリ効率に焦点を当てました。

997

OpenAI Prism リリース

OpenAIは、GPT-5.2で動作する無料のAIネイティブLaTeXワークスペース「Prism」を発表しました。これにより、科学的執筆、共同作業、推論を単一の環境に統合できます。

998

TRUSTBANK Choice AI:マルチエージェントアーキテクチャでふるさと納税をパーソナライズ

TRUSTBANKは、OpenAIのGPT-4.1シリーズをマルチエージェントAIシステムを通じてFurusato Choiceプラットフォームに統合し、日本のふるさと納税プログラムで税金納付者が760,000以上の返礼品を探しやすくしています。

999

Anthropicと英国政府によるGOV.UK AIアシスタントのためのパートナーシップ

Anthropicは、英国の科学・イノベーション・技術省と提携し、GOV.UKにClaudeを活用したAIアシスタントを導入します。初期段階では就労サービスに重点を置きます。

1000

Claude Code ベストプラクティスガイド

Anthropicは、コンテキストウィンドウの管理と自律的な検証に焦点を当てた、エージェント型コーディング環境であるClaude Codeを最適化するための包括的なベストプラクティスセットを提供しています。