OpenAI 政策與政治倡導立場
OpenAI 已澄清,它不資助政治行動委員會或候選人,並堅持認為 AI 政策應該由廣泛的利益相關者聯盟塑造,而非單一組織。
JetBrains Mellum2 發布
JetBrains 已宣布發布 Mellum2,一個 12B 的 Mixture-of-Experts(MoE)模型,然而提供的來源資料是一個錯誤頁面,未包含任何技術細節。
超越LLM:為什麼可擴展的企業AI採用依賴於代理邏輯
由於提供的來源材料因 429 Too Many Requests 錯誤而無法取得,因此不包含任何關於代理邏輯或企業AI採用的技術內容。
OpenAI Stargate:密西根州的「穀倉」資料中心
OpenAI 已在密西根州薩林開工建設 1GW 的「The Barn」資料中心園區,作為其 Stargate 計畫的一部分,以擴大 AI 基礎設施並支援美國再工業化。
OpenAI Frontier Models 和 Codex 現在已在 AWS 上提供
OpenAI 已將其 frontier models 和 Codex 整合到 AWS,使企業能夠使用現有的 AWS 安全、合規和帳單工作流程部署 OpenAI 能力。
Qwen3.7-Plus 版本說明 / 新功能
Qwen3.7-Plus 是一個多模態代理模型,將視覺與語言統合,能在 GUI 與 CLI 環境中運作,以應對複雜的軟體工程與生產力自動化任務。
vLLM 在 DGX Spark 上:架構、設定與本地評估
vLLM 為 NVIDIA DGX Spark 提供高效能的本地推論端點,透過統一記憶體架構與相容 OpenAI 的 API,使得部署大型 NVFP4 模型(如 Nemotron-3-Super)成為可能。
OpenAI 打斷「資料中心潮流」影響行動
OpenAI 封禁了一批與中國有關聯的帳號,這些帳號利用 ChatGPT 產生社群媒體內容與作業計畫,旨在影響美國受眾對 AI 電力需求的看法,並騷擾中國異議人士。
OpenAI 破壞與中國大陸相關的「科技與關稅」影響行動
OpenAI 封禁了一批由中國大陸相關行動者使用的 ChatGPT 帳號,這些帳號用於產生親中敘事、批評美國科技政策,並透過虛假資料外洩指控企圖抹黑 OpenAI。
Braintrust 整合 OpenAI Codex
Braintrust 使用 OpenAI Codex 將客戶的功能需求在數分鐘內轉換為可運作的程式碼預覽,顯著加速了開發回饋迴圈。
波士頓兒童醫院 AI 整合與罕見疾病診斷
波士頓兒童醫院已整合企業 AI 層,以優化營運並診斷超過 40 種先前未解決的罕見疾病。
Qwen-VLA:統一視覺-語言-行動建模以實現具身智慧
Qwen-VLA 是一個通用的視覺-語言-行動模型,將機器人操作、視覺-語言導航以及跨具身控制統一於單一的通用策略模型中。
OpenAI Rosalind 生物防禦與 GPT-Rosalind 擴展
OpenAI 已啟動 Rosalind 生物防禦計畫,並擴展對政府和盟友夥伴的 GPT-Rosalind 受信任訪問,以加速生物防禦與大流行備援工具的開發。
OpenAI 分享用於前沿 AI 模型可靠第三方評估的指南
OpenAI 發布了一份共享指南,解釋第三方評估者應如何選擇 harness、誘發能力並檢查有效性,以對前沿 AI 模型進行可靠的評估。
PyTorch 性能分析:torch.profiler 初學者指南
Hugging Face 提供了完整的指南,說明如何使用 torch.profiler 來辨識瓶頸、了解 CPU-GPU 分派鏈,並分析 torch.compile 對 kernel 執行的影響。
Endava 的 Agentic 組織策略 與 OpenAI Codex
Endava 透過使用 OpenAI Codex 將資深架構專業知識編碼,並將軟體交付生命週期從週數壓縮至天數,從而過渡成為具代理能力的組織。
使用 vLLM、Speculators 與 LLM Compressor 進行 Laguna XS.2 推論優化
Poolside 與 Red Hat AI 透過 vLLM 整合、DFlash 投機解碼與 LLM Compressor 量化,針對代理編碼任務優化了 Laguna XS.2 33B-A3B MoE 模型。
vLLM Semantic Router 多模態路由與視覺編碼器強化
vLLM 已在 Semantic Router (VSR) 中引入了多模態路由,使系統能夠將視覺證據作為請求層級策略決策的一等公民信號,同時解決了 Rust/Candle 與 PyTorch 路徑之間關鍵的實作漂移問題。
Speculators v0.5.0 發行說明 / 新功能
Speculators v0.5.0 引入 DFlash 演算法支援,用於單通過草稿 token 生成,透過 vLLM 原生隱藏狀態提取統一線上與離線訓練,並更新文件。
vLLM 原生 RL API 發布
vLLM 已引入原生權重同步 API 並改進異步 RL 支援,以標準化訓練與推理之間的權重傳輸,並消除大規模 DPEP 部署中的死鎖。
OpenAI 前沿治理框架
OpenAI 推出了前沿治理框架,以使其安全與保安實踐符合新興的法律要求,例如《歐盟人工智慧法案》以及加州《前沿人工智慧透明法案》。
Cisco 與 OpenAI Codex 企業整合
Cisco 將 OpenAI 的 Codex 整合到其生產工程工作流程中,將功能開發時間從數個季度縮短至數週,並實現缺陷解決吞吐量提高 10-15 倍。
使用 Codex 建構自我改進的稅務代理
OpenAI 與 Thrive Holdings 開發了 Tax AI,這是一個為 Crete 會計師設計的自我改進代理,利用 Codex 驅動的迴圈來自動化複雜的稅務申報,準確度最高可達 97%。
Reachy Mini 本地語音後端整合
Hugging Face 已為 Reachy Mini 發布了一個本地語音轉語音管線,使機器人能夠使用級聯的 VAD、STT、LLM 和 TTS 堆疊完全在本地處理對話。
OpenAI 2026 年選舉資訊與防護措施
OpenAI 已宣布針對 2026 年選舉週期的一套全面防護措施,重點放在可靠資訊的呈現、網路基礎設施防禦、內容來源追蹤以及防止模型偏見。
Warp Open Agentic Development 與 Oz 編排平台
Warp 正使用 GPT-5.5 及其 Oz 編排平台實作 Open Agentic Development,以將軟體工程轉向由人類監督的代理艦隊。
TRL 中的 Delta Weight Sync 實現極低頻寬的兆級參數模型訓練
Hugging Face 宣佈在 TRL 中推出 Delta Weight Sync 功能,該功能通過 Hugging Face Buckets 僅傳輸稀疏的權重變化,將非同步 RL 訓練中的權重同步頻寬降低了 100 倍以上,從而實現了無需共享集群的解耦訓練。
EAGLE 3.1 版本說明:提升推測解碼的韌性與效率
EAGLE 3.1 引入架構改進以解決注意力漂移,在長上下文工作負載中將可接受長度提升至兩倍,並透過 vLLM 與 TorchSpec 整合顯著提升吞吐量。
Hugging Face AI Agent 術語表:定義 Harness、Scaffold 與 Agent 架構
Hugging Face 為 AI Agent 提供了一套標準化詞彙,將 Agent 定義為模型 (model)、用於執行的 harness 以及用於定義行為的 scaffolding 的結合體。
OpenAI、Grupo Folha 與 Grupo UOL 戰略內容合作夥伴關係
OpenAI 與巴西的 Grupo Folha 和 Grupo UOL 達成合作,將高品質巴西新聞整合至 ChatGPT,為全球 9 億週活躍用戶提供有根據且標註來源的報導。
OpenAI 分析: AI 作為小型企業的首位僱員
OpenAI 報告指出,美國四百萬用戶在 2026 年 3 月使用 ChatGPT 支援小型企業運營,減少行政負擔並降低創業的固定成本。
Virgin Atlantic 軟體開發與 OpenAI Codex
Virgin Atlantic 利用 OpenAI Codex 推出全新行動應用程式,實現零 P1 缺陷,並將遺留程式碼基礎規模縮減至最高 80%。
OpenAI Codex 獲評 2026 Gartner 魔力象限企業 AI 程式碼代理領導者
OpenAI 被認定為 Gartner 魔力象限企業 AI 程式碼代理的領導者,彰顯了 Codex 的規模與治理能力。
Google DeepMind 亞太區加速器計畫
Google DeepMind 在亞太地區推出了「AI for the Planet」加速器計畫,協助新創公司、研究團隊與非營利組織擴展前沿 AI 解決方案,以應對環境風險。
AdventHealth 與 OpenAI:擴展 AI 以減少臨床行政負擔
AdventHealth 正部署 ChatGPT for Healthcare,以自動化耗時的文件撰寫和臨床工作流程,收回臨床醫師的時間以擴展患者護理容量。
Qwen3.7-Max 代理模型發布
Qwen 發布了 Qwen3.7-Max,一款專注於代理的基礎模型,擅長程式碼編寫、辦公自動化以及超長時程自主任務,現已透過阿里雲 Model Studio 提供。
Codex with GPT-5.5 加速了 Ramp 的代碼審查
Ramp 工程師使用 Codex with GPT-5.5 在幾分鐘內獲得實質性的 pull-request 反饋,而非耗費數小時,並藉此構建如 On-Call Assistant 之類的內部代理型工具。
OpenAI 教育國家計畫項目更新
OpenAI 正在擴大其 Education for Countries 計畫,以納入新加坡,並擴大研究驅動的 AI 部署,覆蓋其首批夥伴國家,透過具代理能力的 AI 改善學習成果。
OpenAI 模型推翻平面單位距離猜想
一個 OpenAI 通用推理模型自主地透過發現相對於正方形網格構造的多項式改進,推翻了離散幾何學中一個 80 年舊的猜想。
OpenAI for Singapore 合作夥伴公告
OpenAI 已推出『OpenAI for Singapore』,這是與數位發展與資訊部合作的 S$3 億計畫,旨在設立應用人工智慧實驗室並培育當地人工智慧人才。
OlmoEarth v1.1 版本說明 / 新功能
Hugging Face 與 AllenAI 已發布 OlmoEarth v1.1,這是一系列地球觀測模型,可將計算成本降低最高達 3倍,同時保持與 v1 相近的性能。
OpenAI 內容來源更新
OpenAI 正在實施一個多層次的來源系統,使用 C2PA 符合性、Google SynthID 浮水印以及新的公開驗證工具,以提升 AI 生成內容訊號的透明度與耐久性。
Qwen3.5-LiveTranslate-Flash 版本說明
Qwen3.5-LiveTranslate-Flash 是基於 Qwen3.5-Omni 的同聲傳譯模型,提供即時、多模態的翻譯,支援 60 種語言,具備超低延遲與語音克隆功能。
Ettin Reranker 系列 v1 版本說明
Hugging Face 發布了 Ettin Reranker 系列,六款參數從 17M 到 1B 的 CrossEncoder 重新排序模型,從 mxbai-rerank-large-v2 蒸餾而成,達到最先進的檢索重新排序品質與速度。
Google DeepMind:快速推進基因線索以逆轉細胞老化
Google DeepMind 的 Co-Scientist AI 正透過識別新穎基因因子,加速細胞老化研究,並將資料分析時間從六個月縮短至數天。
PaddleOCR 3.5 版本說明 / 新功能
PaddleOCR 3.5 引入 Hugging Face Transformers 作為支援的推論後端,讓 OCR 與文件解析模型能更順暢地整合到基於 PyTorch 的工作流程中。
OpenAI 與 Dell Technologies 合作以部署企業級 Codex
OpenAI 與 Dell Technologies 已合作,透過 Dell AI Data Platform 與 Dell AI Factory,在混合及內部部署的企業環境中啟用 Codex 的部署。
vLLM x Novita AI: PegaFlow 用於生產級外部 KV Cache
vLLM 與 Novita AI 宣布推出 PegaFlow,這是一個外部 KV cache 服務,它將 KV cache 與 vLLM worker 解耦,實現了更快的啟動速度、透過快取共享獲得更高的吞吐量,以及基於 RDMA 的跨節點存取。
Project Genie Street View 整合
Google DeepMind 已將 Google Street View 影像整合至 Project Genie,使通用世界模型能夠為 AI 代理和使用者生成互動且具體的真實世界環境。
Gemini Omni Flash 發布
Google DeepMind 已推出 Gemini Omni Flash,這是一種原生多模態模型,能夠從文字、圖像、音訊和影片輸入的組合生成和編輯高品質影片。