Indeed AI 整合更新
關於 Indeed 如何利用 AI 進化求職的公告之來源資料目前因伺服器錯誤而無法取得。
Qwen3-Max-Thinking 發布說明
Qwen 已發布 Qwen3-Max-Thinking,這是一款旗艦推理模型,具備自適應工具使用與多輪測試時縮放策略,以與 GPT-5.2-Thinking 與 Claude-Opus-4.5 競爭。
OpenAI Codex CLI 代理循環技術概述
OpenAI 說明了 Codex CLI 的代理循環架構,詳細闡述其如何透過提示快取與壓縮來管理模型推論、提示建構與上下文視窗的最佳化。
將 PostgreSQL 擴展以支援 8 億 ChatGPT 用戶
OpenAI 透過使用單主節點架構、近 50 個讀取副本以及積極的工作負載優化,將 PostgreSQL 擴展至支援 8 億用戶與每秒數百萬次查詢。
ChatGPT 企業採用模式與 GPT-5 整合
OpenAI 報告稱,ChatGPT 正在各行業自下而上地被採用,GPT-5 引入即時路由器,以自動化企業工作流程中先進功能的使用。
Praktika AI 語言學習架構
Praktika 使用由 GPT-5.2 與 GPT-5 Pro 驅動的多代理系統,透過即時對話式 AI 提供個人化、適應性的語言教學。
Qwen3-TTS 版本說明:開源語音設計、克隆與生成
Qwen 已開源 Qwen3-TTS 系列,提供 0.6B 與 1.7B 兩種規模的模型,支援高保真語音克隆、以自然語言進行語音設計,以及跨 10 種語言的超低延遲串流語音生成。
Higgsfield AI 影片平台與 OpenAI 模型的整合
Higgsfield 是一個生成式媒體平台,利用 GPT-4.1、GPT-5 與 Sora 2,將產品連結和簡單想法轉化為具電影感、以社群為先的短影片。
AssetOpsBench:彌合 AI 代理基準與工業現實之間的差距
Hugging Face 與 IBM Research 推出 AssetOpsBench,一個旨在評估工業資產生命週期管理中多代理 AI 系統的綜合基準,聚焦於安全關鍵的失效模式與運營限制。
OpenAI 終結能力過剩報告與倡議
OpenAI 已發布關於 AI 能力過剩的研究,並擴大其 OpenAI for Countries 計畫,協助各國政府將 AI 融入教育、健康與公共服務,以防止經濟分化。
OpenAI Education for Countries 計畫啟動
OpenAI 推出 Education for Countries 計畫,該計畫與政府與大學合作,將 ChatGPT Edu、GPT‑5.2 等 AI 工具嵌入 K‑12 與高等教育系統,旨在縮小能力過剩(capability overhang)並為學生在 AI 驅動的職場做好準備。
OpenAI Horizon 1000:推動 AI 在基層醫療的發展
OpenAI 與蓋茨基金會已啟動 Horizon 1000,這是一項 5,000 萬美元的計畫,旨在於 2028 年前將 AI 能力整合至非洲各國的 1,000 家基層醫療診所,起始於盧旺達。
OpenAI Stargate 社群計畫公告
OpenAI 宣布了其 Stargate 社群計畫,承諾自行資助能源、減少用水,並在擴展 AI 基礎設施以達成 2029 年 10 GW 目標的同時創造在地工作機會。
DeepSeek時刻一年後:中國開源AI生態系統的崛起
Hugging Face 分析 DeepSeek R1 的發布如何催化中國向開源 AI 的巨大轉變,導致高性能開源模型激增,現在主導全球下載指標。
ServiceNow 與 OpenAI 合作推動可執行的企業 AI
ServiceNow 與 OpenAI 合作,將 GPT-5.2 及多模態功能整合至其 AI 平台,使企業能在 IT、財務與人力資源領域自動化複雜工作流程。
差分 Transformer V2
提供給 Differential Transformer V2 的來源材料因 429 Too Many Requests 錯誤而無法使用,且未檢索到任何技術內容。
OpenAI 針對 ChatGPT 的年齡預測
OpenAI 正在於 ChatGPT 消費者方案上部署年齡預測模型,以自動為可能未滿 18 歲的使用者套用青少年安全防護措施。
Waypoint-1: 即時互動視頻擴散模型來自 Overworld
Overworld 已發布 Waypoint-1,這是一個在 10,000 小時遊戲畫面上訓練的即時互動視頻擴散模型,可透過文字、滑鼠和鍵盤實現零延遲世界互動。
OpenAI 商業模式與運算規模策略
OpenAI 已實施一種隨智慧價值而擴展的商業模式,透過多元化的運算組合與多層次貨幣化,從 2023 年到 2025 年實現了十倍的營收增長。
D4RT:動態 4D 重建與追蹤
Google DeepMind 推出 D4RT,一個統一的 AI 模型,用於 4D 場景重建與追蹤,其效率比以往方法提升最高可達 300 倍。
ChatGPT Go 全球發布
OpenAI 已將 ChatGPT Go(一個每月 8 美元的低成本訂閱方案,僅在美國提供)擴展至所有可用市場,以提升對 GPT-5.2 Instant 的全球存取。
OpenAI 廣告策略與 ChatGPT Go 擴展
OpenAI 正將每月 8 美元的 ChatGPT Go 訂閱層級擴展至美國及所有可用市場,並將在免費與 Go 層級開始測試廣告,以提升 AI 的可及性。
OpenAI 對 Merge Labs 的投資
OpenAI 正參與 Merge Labs 的種子輪投資,該研究實驗室致力於開發高頻寬腦機介面(BCI),以橋接生物與人工智慧。
OpenAI 倡議以國內製造強化美國 AI 供應鏈
OpenAI 已發布一項提案請求(RFP),以識別並促進關鍵 AI 基礎設施元件的美國本土製造,包括資料中心硬體、消費電子和機器人。
Hugging Face 開放回應推論標準
Hugging Face 推出了 Open Responses,一項基於 Responses API 的開放推論標準,旨在取代 Chat Completion 格式,以支援代理式 AI 工作流程。
OpenAI 與 Cerebras 低延遲推論合作夥伴關係
OpenAI 正與 Cerebras 合作,將專為 AI 設計的系統整合到其推論堆疊中,以加速 AI 模型回應並實現即時 AI 互動。
Veo 3.1 發行說明:增強的 Ingredients to Video 與 4K 升級
Google DeepMind 已發布 Veo 3.1,推出改進的身分與物件一致性以支援影像轉影片生成、原生直向影片支援,以及升級至 1080p 與 4K 解析度。
Zenken 案例研究:利用 ChatGPT Enterprise 擴展銷售與營運
Zenken 已整合 ChatGPT Enterprise 以自動化知識工作,實現了每年 5,000 萬日元的外包成本節省,且最終提案批准率提升了 30%。
以資訊驅動的影像系統設計
BAIR 的研究人員開發了一個框架,利用互資訊來評估與優化影像系統,使得在不需要特定任務解碼器的情況下即可設計高效能硬體。
OpenAI 與軟銀集團與 SB Energy 的合作夥伴關係
OpenAI 與軟銀集團各自投資 5 億美元於 SB Energy,以加速 AI 數據中心園區與能源基礎設施的開發,包括德克薩斯州米拉姆縣的 1.2 GW 站點。
Datadog 整合 OpenAI Codex 以進行系統層級程式碼審查
Datadog 已將 OpenAI Codex 部署給超過 1,000 名工程師,用於在程式碼審查中識別系統性風險與跨服務相依性,成功偵測出 22% 的歷史事故,這些事故是人工審查者未發現的。
OpenAI 醫療保健發佈
OpenAI 已推出 OpenAI 醫療保健,這是一套符合 HIPAA 規範的工具,包括 ChatGPT for Healthcare 和 OpenAI API,旨在減輕臨床醫師的行政負擔並提升護理一致性。
Netomi 將代理系統擴展至企業規模 – 從 OpenAI 獲得的經驗教訓
Netomi 宣布推出生產級代理平台,結合了用於低延遲工具使用的 GPT-4.1 與用於深度多步驟規劃的 GPT-5.2,提供低於 3 秒的響應時間、98% 的意圖準確度,以及企業級規模的內建治理功能。
Qwen3-VL-Embedding 與 Qwen3-VL-Reranker 發布
Qwen 已發布 Qwen3-VL-Embedding 與 Qwen3-VL-Reranker,這是一系列針對文字、圖像、螢幕截圖與影片進行高精度跨模態檢索的多模態模型。
Tolan 如何使用 GPT-5.1 建構語音優先 AI
Tolan 使用 GPT-5.1 和自訂的即時情境管理系統,創建了一個低延遲、語音優先的 AI 伴侶,具備持久記憶與一致的人格。
ChatGPT Health 發行說明
OpenAI 已推出 ChatGPT Health,一個專門且安全的體驗,整合個人醫療記錄與健康應用程式資料,協助使用者在不取代臨床護理的情況下瀏覽健康資訊。
NVIDIA Cosmos Reason 2 版本說明 / 新功能
NVIDIA 已發布 Cosmos Reason 2,一款為實體 AI 設計的開放式推理視覺語言模型,並在 Physical AI Bench 與 Physical Reasoning 排行榜上名列前茅。
Falcon-H1-Arabic 發行說明
Hugging Face 宣布了 Falcon-H1-Arabic,這是一個由三個混合 Mamba-Transformer 模型(3B、7B 和 34B)組成的系列,於阿拉伯語自然語言處理領域創下了新的最先進基準,並將上下文窗口擴展至最高 256K 令牌。
NVIDIA DGX Spark 與 Reachy Mini 整合指南
NVIDIA 已推出一個框架,透過結合 DGX Spark 硬體、Reachy Mini 機器人及 NeMo Agent Toolkit,使用開放的推理與視覺模型來打造真實世界的 AI 代理。
OpenAI Grove 第二期公告
OpenAI 已開放 OpenAI Grove 第二期的申請,該計畫旨在支援尚未有構想的技術人才打造 AI 驅動的公司。
Qwen-Image-2512 發行說明 / 新功能
Qwen-Image-2512 是 Qwen-Image 文本到圖像模型的十二月更新,顯著提升了人物寫實度、自然細節渲染以及複雜文字版面配置的準確性。
Google DeepMind 2025 年度回顧:Gemini 3、Gemma、AI 產品、科學與安全突破
Google DeepMind 宣布了 2025 年的突破,涵蓋 Gemini 3 模型、開源 Gemma、AI 驅動產品、生成式媒體、科學 AI、量子運算、安全框架及全球協作,標誌著 AI 從工具向公用事業的轉型。
AprielGuard:現代大型語言模型系統的安全與對抗魯棒性護欄
Hugging Face 與 ServiceNow AI 推出了 AprielGuard,一款 8 億參數的安全防護模型,旨在於單獨提示、多輪對話與代理工作流程中偵測 16 種安全風險類別以及各種對抗攻擊。
Qwen-Image-Edit-2511 發行說明
Qwen-Image-Edit-2511 是一個更新的圖像編輯模型,提升了角色一致性,整合了社群 LoRA,並增強了幾何推理與工業設計能力。
Qwen3‑TTS‑VD‑Flash 與 Qwen3‑TTS‑VC‑Flash 發布:可控語音設計與快速多語言語音克隆
Qwen 推出 Qwen3‑TTS‑VD‑Flash 用於自然語言語音設計,並推出 Qwen3‑TTS‑VC‑Flash 用於 3 秒多語言語音克隆,兩者在可控性與準確性上均超越領先的 TTS 系統。
ChatGPT Atlas: 加強瀏覽器代理防禦提示注入
OpenAI 已使用經過 RL 訓練的自動化攻擊者實施主動快速響應迴路,以在野外被利用之前發現並緩解 ChatGPT Atlas 中的提示注入漏洞。
OpenAI 客戶增長與企業採用
OpenAI 已突破一百萬家企業客戶,75% 的使用者報告能完成先前無法完成的任務。
Qwen-Image-Layered:層次分解以實現內在可編輯性
Qwen-Image-Layered 是一個新模型,能將圖像分解為多個 RGBA 層,允許獨立操作圖像組件而不影響其他內容。
OpenAI 評估思考鏈可監測性
OpenAI 引入了一個框架與 13 項評估,用以衡量「可監測性」——即從模型內部推理預測其行為的能力——發現監測思考鏈遠比僅監測輸出更為有效。
OpenAI Model Spec 更新: 未滿18歲(U18)原則
OpenAI 已更新其 Model Spec,加入未滿18歲(U18)原則,為 ChatGPT 建立適合年齡的行為指引,以優先考慮13至17歲使用者的青少年安全與現實世界支援。