Gemini 3.1 Flash‑Lite 發布:快速、低成本的高容量工作負載 AI
Google DeepMind 推出 Gemini 3.1 Flash‑Lite,一款針對高容量工作負載的快速、成本效益 AI 模型,價格為每百萬輸入 token $0.25、每百萬輸出 token $1.50。
GPT-5.3 Instant 發佈說明
OpenAI 已發布 GPT-5.3 Instant,這款模型旨在提供更快的回應速度、改進的網路搜尋情境化,以及更流暢的對話流程。
GPT-5.3 Instant 版本發布:更流暢、更精確的日常對話
OpenAI 宣佈了 GPT‑5.3 Instant,此次更新讓日常的 ChatGPT 對話更流暢、更精確,且不易出現不必要的拒絕或過度謹慎的語言。
OpenAI 與戰爭部門的協議
OpenAI 已與戰爭部簽訂協議,於機密環境中部署先進 AI 系統,採用僅雲端架構與嚴格的安全防護措施。
OpenAI 與 Amazon 戰略合作夥伴關係
OpenAI 與 Amazon 宣佈了一項為期多年的戰略合作夥伴關係,內容包括對 OpenAI 的 500 億美元投資以及在 Amazon Bedrock 上共同打造 Stateful Runtime Environment。
Amazon Bedrock 中代理的有狀態執行環境
OpenAI 與 Amazon 合作在 Amazon Bedrock 推出有狀態執行環境,為 AI 代理提供原生的 AWS 基礎設施,使其在多步驟生產工作流程中保持狀態、可靠性與治理。
OpenAI 與 Microsoft 關於合作持續性的聯合聲明
OpenAI 與 Microsoft 已確認,儘管 OpenAI 獲得新資金並與其他雲端供應商(包括 Amazon)建立合作關係,但雙方的策略合作仍保持不變。
OpenAI 為所有人擴展 AI 的宣佈
OpenAI 已獲得來自 SoftBank、NVIDIA 與 Amazon 的 1,100 億美元新投資,估值為 7,300 億美元(投前),以擴展計算基礎設施與全球 AI 分發。
OpenAI 心理健康安全更新與訴訟狀態
OpenAI 正在為成年使用者推出受信任聯絡人功能,並加強模型對情緒困擾的偵測,同時處理加州心理健康相關法律程序的合併事宜。
vLLM AMD ROCm 注意力後端最佳化
vLLM 為 AMD ROCm 引入了最佳化的注意力後端,在 Instinct MI300X、MI325X 與 MI355X GPU 上,為 MHA 模型提供最高 4.4 倍的吞吐量提升,為 MLA 模型提供最高 1.5 倍的提升。
Nano Banana 2 發布:以 Flash 速度的專業級圖像生成
Google DeepMind 宣布 Nano Banana 2,這是一款結合 Nano Banana Pro 先進功能與 Gemini Flash 超低延遲的圖像生成模型,能即時在 Google 產品中提供高品質、以知識為基礎的圖像。
OpenAI 與 PNNL 合作加速聯邦許可
OpenAI 與太平洋西北國家實驗室(PNNL)合作,評估使用程式編碼代理人以加速《國家環境政策法》(NEPA)聯邦許可流程,顯示可望將起草時間減少約 15%。
OpenAI Codex 與 Figma 整合:無縫的程式碼到設計工作流程
OpenAI 與 Figma 推出了由 Figma MCP 伺服器驅動的程式碼到設計整合,使用者可在 Codex 程式碼生成與 Figma 設計畫布之間無縫切換。
vLLM 多 LoRA 服務於 MoE 模型
vLLM 0.15.0 版引入了針對混合專家(MoE)模型的優化多 LoRA 服務,讓多個微調適配器能共享單一 GPU,以降低閒置計算資源。
Transformer 中的專家混合(MoEs)
Hugging Face 已重新設計 transformers 函式庫,使混合專家(MoEs)成為一等公民,透過全新的權重載入重構、可插拔的專家後端,以及原生的專家平行化。
OpenAI 破壞 AI 惡意使用的報告 2026年2月
OpenAI 發布了一份威脅報告,詳細說明威脅行動者如何將 AI 模型與社群媒體、網站等傳統工具結合,以執行惡意活動。
OpenAI 任命 Arvind KC 為首席人才官
OpenAI 任命 Arvind KC 為首席人才官,負責領導組織成長並制定 AI 驅動工作轉型的模型。
OpenAI 停止 SWE-bench Verified 評估
OpenAI 已停止報告 SWE-bench Verified 分數,因為缺陷測試案例與訓練資料污染使該基準無法可靠衡量前沿模型的程式編寫能力。
OpenAI 前沿聯盟合作夥伴公告
OpenAI 已推出前沿聯盟,與麥肯錫、波士頓諮詢集團、BCG X、埃森哲及凱捷合作,協助企業部署與擴展使用前沿平台的 AI 同事。
OpenAI 首次證明提交
OpenAI 已提交首次證明研究級數學挑戰的證明嘗試,內部模型可能已解決至少十題中的五題。
使用 Unsloth 與 Hugging Face Jobs 訓練 AI 模型
Hugging Face 已將 Unsloth 與 Hugging Face Jobs 整合,實現快速且低成本的 LLM 微調,特別針對如 LiquidAI/LFM2.5-1.2B-Instruct 等小型模型進行優化。
GGML 與 llama.cpp 加入 Hugging Face
GGML,llama.cpp 的創作者,已加入 Hugging Face,提供永續資源以支援本地 AI 推論,並簡化 Transformers 套件與本地模型部署之間的整合。
Gemini 3.1 Pro 版本說明
Google DeepMind 推出 Gemini 3.1 Pro,一款在複雜任務上推理能力大幅提升的新模型,現已透過 Gemini API、Vertex AI、Gemini 應用程式與 Notebook LM 提供預覽版。
OpenAI 對 The Alignment Project 的資助
OpenAI 宣布向 The Alignment Project 提供 750 萬美元的資助,該基金由英國 AI 安全研究所(UK AISI)設立,旨在擴大獨立的 AI 對齊與安全研究。
OpenAI 印度倡議
OpenAI 已推出「OpenAI for India」全國性計畫,與塔塔集團及其他機構合作,建立主權 AI 基礎設施、加速企業採用,並在全國推廣 AI 技能提升。
IBM 與加州大學柏克萊分校使用 IT-Bench 與 MAST 診斷企業代理失敗
IBM 研究院與加州大學柏克萊分校推出 MAST(多代理系統失敗分類法)以診斷企業 IT 代理失敗的原因,發現前沿模型受到孤立的驗證錯誤影響,而開源模型則面臨連鎖的系統性崩潰。
Gemini 音樂生成與 Lyria 3
Google DeepMind 已將 Lyria 3 生成式音樂模型整合至 Gemini 應用程式,使用者可透過文字提示或圖像與影片上傳,創作 30 秒的 AI 生成音軌。
Gradio 6 gr.HTML:一次性 Web 應用程式開發
Gradio 6 引入了增強的 gr.HTML 支援,提供自訂模板、範圍化 CSS 與 JavaScript 互動性,使得能在單一 Python 檔案中建立複雜的 Web 元件。
OpenAI 推出 EVMbench
OpenAI 與 Paradigm 已發布 EVMbench,這是一項用於評估 AI 代理偵測、修補與利用高嚴重性智慧合約漏洞能力的基準測試。
Google DeepMind AI 國家夥伴關係:印度擴展
Google DeepMind 正在與印度政府機構及院校建立新夥伴關係,以擴大科學、教育、農業與能源安全領域前沿 AI 模型的使用機會。
Qwen 3.5‑397B‑A17B 釋出:混合線性注意力 MoE 模型,具備 1 M 令牌上下文與最先進的多模態效能
Qwen 3.5‑397B‑A17B 是一個 397 0 億參數的多模態模型,每個令牌僅啟用 170 億參數,在語言、程式碼、推理與視覺任務上達到最先進的表現,同時比前代快至 19 倍。
GPT-5.2 在理論物理學中導出新結果
OpenAI 宣布,GPT-5.2 Pro 以及一個支援版的 GPT-5.2 被用來推導出關於半共線區域中非零膠子樹振幅的理論物理新結果。
ChatGPT 鎖定模式與提升風險標籤
OpenAI 推出了鎖定模式與提升風險標籤,以減輕提示注入攻擊並為使用者提供更大的資料外洩風險控制。
OpenAI 透過混合信用系統擴展對 Codex 與 Sora 的存取
OpenAI 實作了一個即時存取引擎,結合速率限制與可購買的信用系統,以防止 Codex 與 Sora 使用者遭遇硬性中斷。
OpenAI GABRIEL:利用 GPT 擴展社會科學研究規模
OpenAI 已發布 GABRIEL,一個開源的 Python 工具包,利用 GPT 將非結構化的文字與影像轉換為社會科學研究的量化測量。
Hugging Face CUDA 核函數代理技能
Hugging Face 推出了一項代理技能,使得像 Claude 和 Codex 這樣的程式編寫代理能夠編寫、基準測試並整合可投入生產的 CUDA 核函數,適用於 transformers 與 diffusers 函式庫。
Gemini 3 Deep Think 更新
Google DeepMind 已更新 Gemini 3 Deep Think,這是一種在數學、物理與化學奧林匹克中達到金牌等級表現的專門推理模式,且現已透過 Gemini API 向特定使用者開放。
GPT-5.3-Codex-Spark 發行說明
OpenAI 已發布 GPT-5.3-Codex-Spark,一款小型、低延遲模型,針對即時程式碼協作進行優化,並在 Cerebras 硬體上每秒可產生超過 1,000 個 token。
OpenEnv: 在真實環境中評估使用工具的代理程式
Hugging Face 與 Meta 推出了 OpenEnv,這是一個開源框架,透過針對真實系統與 Calendar Gym 等生產級環境來評估 AI 代理程式,以彌合研究與生產可靠性之間的差距。
OpenAI Harness Engineering:利用 Codex 實現零手寫程式碼開發
OpenAI 使用 Codex 開發了一款內部軟體產品,全部程式碼皆由 AI 生成,未有任何手寫程式碼,藉由從手動編碼轉向環境設計與代理人協調,將開發時間縮短約 10 倍。
Qwen-Image-2.0 發布:專業資訊圖表與寫實渲染
Qwen-Image-2.0 是一個統一的圖像生成與編輯模型,支援 1k 令牌指令以製作專業資訊圖表,並具備原生 2K 解析度以實現高保真寫實渲染。
Gemini Deep Think 讓自主研究遍及數學、物理與電腦科學
Gemini Deep Think 為自主與協作型代理人提供動力,使其能解決研究層級的數學、物理與電腦科學問題,產出可發表的成果並解決未解的猜想。
OpenAI 將 ChatGPT 整合至 GenAI.mil 以供戰爭部使用
OpenAI 正將 ChatGPT 的自定義版本部署至 GenAI.mil,為 300 萬名戰爭部人員提供安全、非機密的生成式 AI 能力,以進行行政與作戰支援。
Transformers.js v4 發行說明 / 新功能
Hugging Face 已發布 Transformers.js v4,推出全新重寫的 C++ WebGPU 執行環境,以在瀏覽器與伺服器端執行環境中實現硬體加速,並同時提供獨立的 tokenizers 函式庫。
OpenAI 本地化方法與 OpenAI for Countries 計畫
OpenAI 透過 OpenAI for Countries 計畫推出了一個本地化 AI 系統框架,允許各國在遵守全球安全紅線的同時,將前沿模型調整至在地語言、法律與文化規範。
SyGra 2.0.0 Studio 發佈
SyGra 2.0.0 引入了 Studio,這是一個用於設計和執行合成數據生成工作流的視覺化互動式環境,無需手動編輯 YAML 檔案。
GPT-5 降低細胞自由蛋白質合成的成本
OpenAI 與 Ginkgo Bioworks 在閉環自主實驗室系統中使用 GPT-5,將細胞自由蛋白質合成成本降低了 40%,試劑成本降低了 57%。
OpenAI 可信存取於網路安全
OpenAI 推出「可信存取於網路安全」計畫,這是一個基於身份的框架,為安全專業人員提供優先使用 GPT-5.3-Codex 的權限,以加速網路防禦與漏洞修補。
OpenAI Frontier 平台發布
OpenAI 推出了 Frontier,一個端到端平台,旨在協助企業建置、部署與管理具備共享業務情境、安全執行環境與整合治理的 AI 代理。
GPT-5.3-Codex 版本說明 / 新功能
OpenAI 已發布 GPT-5.3-Codex,一款具備代理能力的程式碼模型,在效能、推理與速度上優於 GPT-5.2-Codex,使其能自主執行複雜且長時間的技術任務。