VAKRA ベンチマーク分析: エージェントの推論、ツール使用、および失敗モード
Hugging Faceは、8,000以上のAPIとドキュメントソースにわたる構成的推論においてAIエージェントを評価する、ツールに基づいた実行可能なスイートであるVAKRAベンチマークを発表しました。これにより、ツール選択、マルチホップ推論、およびポリシー遵守における広範な失敗が明らかになりました。
OpenAI Agents SDK アップデート
OpenAIは、Agents SDKの機能をアップデートし、モデルネイティブなハーネスとネイティブサンドボックス実行を導入し、本番環境におけるエージェントの信頼性とパフォーマンスを向上させました。
HCompany HoloTab リリース
HCompanyはHolo3モデルによって駆動されるChrome拡張機能であるHoloTabをリリースしました。これにより、ユーザーは自然言語の説明または記録されたルーチンを通じてウェブタスクを自動化できるようになります。
Qwen3.6-35B-A3B リリースノート
Qwen は、総パラメータ数 350 億、アクティブパラメータ数 30 億のオープンソース・ミクスチャー・オブ・エキスパーツモデル Qwen3.6-35B-A3B をリリースしました。このモデルは、エージェント型コーディングとマルチモーダル推論において、より大きなデンスモデルに匹敵する性能を発揮します。
OpenAIはTrusted Access for Cyberを拡大し、防御的サイバーセキュリティ向けにGPT‑5.4‑Cyberをリリース
OpenAIはTrusted Access for Cyberプログラムを数千人の認証済み防御者に拡大し、防御的サイバーセキュリティ作業向けに設計された、ファインチューニングされたより許容的なモデルGPT‑5.4‑Cyberをリリースしました。
vLLM Korea Meetup 2026 ラップアップ
ソウルでの vLLM Korea Meetup 2026 は、vLLM が統合推論インフラストラクチャへと進化したことを強調し、コミュニティの成長、ハードウェア統合の進展、本番スタックの機能、オープンソースおよびエンタープライズ トラック全体にわたる実際のデプロイメント戦略を紹介しました。
Gemini Robotics-ER 1.6 リリースノート / 新機能
Google DeepMind は、空間推論、マルチビュー理解、計器読み取りを強化し、自律ロボティクスタスク向けの推論優先モデル Gemini Robotics-ER 1.6 をリリースしました。
Cloudflare Agent Cloud と OpenAI の統合
Cloudflare Agent Cloud は現在、GPT-5.4 と Codex を含む OpenAI フロンティア モデルと統合され、企業がエッジでスケーラブルかつ本番稼働可能な AI エージェントをデプロイできるようになりました。
カスタマーサクセスチーム向けChatGPT
OpenAIは、散在する顧客コンテキストを構造化されたアクションプランとコミュニケーションに統合することで運用オーバーヘッドを削減するため、カスタマーサクセスチームがChatGPTを使用できるガイドを紹介しました。
OpenAIにおけるAIの応用
OpenAIは、ChatGPTやCodexなどのダイレクトアクセス製品および開発者向け統合のためのOpenAI APIによるコンポーザブルなビルディングブロックを通じて、AI機能を提供します。
ChatGPTを使ったデータ分析 – OpenAI Academy
OpenAI Academyは、チャットインターフェースおよびExcelまたはGoogle Sheets内で直接ChatGPTを使ったデータ分析の方法を示すガイドをリリースし、データのアップロード、質問、ビジュアルの生成、信頼性の高い結果の確保のための手順を示しています。
オペレーションチーム向けChatGPT
OpenAIは、オペレーションチームが '常時稼働するチーフ・オブ・スタッフ' としてChatGPTを活用し、調整の摩擦を減らし、オペレーションワークフローを標準化するガイドを公開しました。
OpenAI AI fundamentals overview
OpenAIのAI fundamentalsページでは、AIとは何か、大規模言語モデルの仕組み、推論モデルと非推論モデルの違い、そして初心者が適切なツールを選ぶ方法について説明しています。
ファイナンスチーム向けChatGPT
OpenAIのファイナンスチーム向けChatGPTは、2026年4月10日に発表され、ファイナンスプロフェッショナルがAIを活用して報告、予測、コミュニケーションを効率化しつつ判断を保つ方法を示しています。
マネージャーのためのChatGPT:ピープルマネジメントのワークフローを最適化する
OpenAIは、マネージャーがChatGPTを使用して反復的な事務作業を自動化し、重要なピープルマネジメントの会話により良く備えるためのガイドとリソースセットを導入しました。
ChatGPTで画像を作成する: AI画像生成ガイド
OpenAIは、自然言語のプロンプトと反復的な編集を通じて、プロダクションレベルの画像を生成・リファインするための包括的なガイドを提供しています。
ChatGPTによるOpenAIリサーチ:検索とディープリサーチの機能
OpenAIは、ChatGPT向けに検索とディープリサーチという2つの異なるウェブ統合手法を導入し、迅速な事実取得からエージェント的な多段階技術分析まで対応できるようにしました。
ChatGPTによるブレインストーミング:構造化された思考パートナーシップのフレームワーク
OpenAIは、ChatGPTを構造化された思考パートナーとして活用し、オプションセットを拡張し、アイデアに構造を付加し、広範から狭義へのワークフローを通じて計画を圧力テストする方法に関するガイドを提供しています。
OpenAI Academy 金融サービスリソース
OpenAIは、OpenAI Academyを通じて、銀行、資産運用会社、保険会社が規制された金融環境でAIを評価、導入、スケールするための専用リソースセットを公開しました。
ChatGPTでのファイル操作
OpenAIは、ユーザーがChatGPTの会話内で直接ファイルをアップロードして分析、編集、コンテンツ生成を行う方法と、サードパーティアプリとの統合について詳しく説明しています。
OpenAI スキル:再利用可能なプロセスとツールベースの自動化のフレームワーク
OpenAI は「スキル」を導入し、マーケティング、セールス、エンジニアリング、法務など多様なビジネス部門で再利用可能なプロセス、ツールベース、慣例標準化された自動化を実現するフレームワークを提供しています。
Axios開発者ツール侵害に対するOpenAIの対応
サードパーティの Axios ライブラリに対するサプライチェーン攻撃で GitHub Actions ワークフローが侵害されたことを受け、OpenAI は macOS のコード署名証明書をローテーションしました。ユーザーデータの窃取やソフトウェアの侵害の証拠は見つかっていません。
OpenAI Academy: セールスチーム向けChatGPT
OpenAIは、セールスチームがChatGPTを活用してアカウント調査を加速し、アウトリーチをパーソナライズし、内部の案件管理を調整するためのガイドを公開しました。
ChatGPTのパーソナライズ: カスタム指示とメモリ
OpenAIのChatGPTパーソナライズガイドは、カスタム指示とメモリがユーザーにChatGPTの動作を調整させ、より一貫した協調的なやり取りを可能にする方法を示しています。
ChatGPT 研究ガイド
OpenAI は、ChatGPT を活用して研究プロセスを加速するためのガイドを公開し、迅速な方向付けのための Search と、複数ステップの調査のための Deep Research の 2 つの異なるアプローチを紹介しています。
マーケティングチーム向けChatGPT:ガイドとユースケース
OpenAI は、マーケティングチームがキャンペーン計画、コンテンツ作成、パフォーマンス分析に ChatGPT を活用し、業務スピードと戦略的フォーカスを高めるための包括的ガイドを公開しました。
OpenAI の責任ある安全な AI 利用に関するガイドライン
OpenAI は ChatGPT の使用に関するベストプラクティスを公開し、人間による監視、透明性、そして重要な専門的助言に対する専門家レビューの必要性を強調しています。
ChatGPTで執筆する:OpenAI Academy ガイド
OpenAI Academy は、Plan‑Draft‑Revise‑Package ワークフローとターゲットを絞ったプロンプト戦略を通じて、ChatGPT を活用した職場執筆の効率化フレームワークを導入しました。
ChatGPT での Projects の使用
OpenAI は ChatGPT に Projects を導入しました。チャット、ファイル、指示を統合し、長期的な作業のための永続的なコンテキストを維持する専用のワークスペースです。
カスタム GPT の活用方法:目的別に設計された ChatGPT バージョンのガイド
OpenAI のカスタム GPT を使用すると、ユーザーは目的別に設計された ChatGPT のバージョンを、カスタマイズされた指示、アップロードされたナレッジ、統合ツールを組み合わせて作成し、繰り返し可能なワークフローを自動化できます。
OpenAI ヘルスケア プロンプトテンプレート
OpenAI は、診断テストの選択、鑑別診断の作成、評価と計画の策定、診療記録の文書化、患者へのカウンセリング、ケア移行の調整、ガイドラインの要約、臨床参照情報の取得など、臨床タスク向けの空欄埋めプロンプトテンプレートを提供するヘルスケアページを公開しました。
CyberAgent AI統合:ChatGPT Enterprise と Codex の活用
CyberAgentは、ChatGPT Enterprise と Codex をビジネス運用に統合し、ボランティア的な採用文化とエンタープライズレベルのセキュリティにより、AIツールの月間アクティブユーザー率を93%に達成しました。
Sentence Transformers v5.4: マルチモーダル埋め込みとリランカー モデル
Sentence Transformers v5.4 は、テキスト、画像、オーディオ、ビデオのエンコードと比較のためのマルチモーダル埋め込みおよびリランカー モデルを導入します。
Waypoint-1.5 リリースノート
Hugging Face と Overworld は、Waypoint-1.5 をリリースしました。これは、コンシューマー GPU 上でローカルで実行可能な高忠実度のインタラクティブな生成環境を可能にするリアルタイムビデオワールドモデルです。
OpenAI エンタープライズ AI 戦略と Frontier プラットフォーム
OpenAIは、OpenAI Frontierを企業全体のエージェント向け統合インテリジェンスレイヤーとして導入し、従業員のワークフロー向け統合AIスーパーアプリを開発することにより、AIの実験からエンタープライズ導入への移行を進めています。
OpenAI 子供安全ブループリント
OpenAIは、法律の近代化、プロバイダーの報告体制の改善、AIシステムにおける安全設計(Safety-by-Design)対策の実装を通じて、米国の子供保護フレームワークを強化するための政策ブループリントを導入しました。
Safetensors が PyTorch Foundation に参加
Safetensors は、ベンダーニュートラルなガバナンスとコミュニティ主導の開発を確保するため、PyTorch Foundation および Linux Foundation の下で基盤ホスト型プロジェクトへ移行しました。
vLLM Prefill-Decode の MORI-IO による分散化
vLLM は AMD の MORI-IO コネクタを使用して、単一ノードの 8 GPU MI300X 環境で Prefill-Decode の分散化を実装し、Inter-Token Latency のスパイクを排除することで、スループットを 2.5 倍に向上させました。
OpenAI セーフティフェローシッププログラムのお知らせ
OpenAIは、外部研究者が2026年9月14日から2027年2月5日までの期間にAIの安全性とアラインメントに関する高インパクトな研究を行うためのプログラムであるOpenAI Safetyフェローシップを開始しました。
Gemma 4 リリースノート:高度知能オープンモデル(推論とエージェント向け)
Google DeepMind は、Apache 2.0 ライセンスの下で提供されるオープンモデルのファミリーである Gemma 4 をリリースしました。このモデルは高度な推論、エージェントワークフロー、そしてデバイス上での効率的なデプロイを目的としています。
OpenAI、TBPNを取得 – 戦略的メディア統合と編集独立性
OpenAIは、AIに焦点を当てた会話で知られるメディアプラットフォームTBPNの取得を発表し、OpenAIのStrategy組織内に編集独立性を組み込み、TBPNのコミュニケーション専門知識を活用することを目的としています。
OpenAI Codex のチーム向け柔軟な価格設定
OpenAI は、ChatGPT Business および Enterprise ワークスペースにおける Codex 専用シートの従量課金制価格を導入し、チームの導入やパイロットプログラムのハードルを下げました。
Gemma 4 on vLLM: 高度な推論とマルチモーダル機能
vLLMは、GoogleのオープンモデルファミリーであるGemma 4に対するDay 0サポートを導入しました。高度な推論、マルチモーダル入力、そしてTPU、GPU、XPUにわたる幅広いハードウェア互換性を備えています。
Gemma 4 リリース:オンデバイス対応のオープンソース・マルチモーダルモデル
Google DeepMind による新しいオープンソース・マルチモーダル・ファミリーである Gemma 4 が、画像、音声、ビデオのサポート、最大 256K のコンテキスト、および transformers、llama.cpp、MLX、Rust、WebGPU との Day-0 互換性を備えて Hugging Face でリリースされました。
サンダカン・セントラル・マーケット看板の縦書きテキスト(2024年) – “2006”
2024年のサンダカン・セントラル・マーケットのメイン看板右側にある縦書きテキストは「2006」となっています。
Falcon Perception と Falcon OCR のリリース
Hugging Face と TII は、オープンボキャブラリのグラウンディング向け 0.6B パラメータの早期融合トランスフォーマーである Falcon Perception と、高スループットの文書理解を実現する 0.3B パラメータのモデルである Falcon OCR を発表しました。
Gradient Labs 銀行向け AI アカウントマネージャー
Gradient Labs は、OpenAI の GPT-5.4 mini と nano モデルを搭載した AI エージェントを導入し、銀行顧客に複雑でコンプライアンスを遵守した金融手続きを処理できる専任の AI アカウントマネージャーを提供しています。
Gradio Server: カスタムフロントエンドと Gradio バックエンドの統合
Hugging Face は gradio.Server を導入しました。これは FastAPI の拡張で、開発者が任意のカスタムフロントエンドフレームワークを使用できるようにしつつ、Gradio のキューイング、API インフラストラクチャ、ZeroGPU サポートを保持します。
Granite 4.0 3B Vision リリースノート / 新機能
IBMは、エンタープライズ文書理解向けに最適化されたコンパクトなマルチモーダルモデル Granite 4.0 3B Vision をリリースしました。このモデルは、高精度なテーブル抽出、チャート推論、キー・バリュー・ペア抽出を特徴としています。
OpenAI の資金調達とインフラ戦略の最新情報
OpenAI は、計算インフラを拡大し統合 AI スーパアプリを開発するため、事後評価額 8,520 億ドルで 1,220 億ドルのコミット資本を調達しました。