851

GPT-5-Codex 發布與安全附錄

OpenAI 已發布 GPT-5-Codex,這是針對代理式編程進行強化學習訓練、在真實任務上優化的 GPT-5 版本。

852

OpenAI 與美國 CAISI 及英國 AISI 的安全合作

OpenAI 已與美國人工智慧標準與創新中心(CAISI)以及英國人工智慧安全研究所(UK AISI)合作,進行針對代理式 AI 與生物安全防護措施的深入紅隊測試與漏洞測試。

853

Writer Palmyra-mini 系列發布

Writer 已發布 Palmyra-mini 系列,這是一組輕量級開源模型(參數量介於 1.5B 至 1.7B),包括一個基礎模型以及兩個針對邏輯與數學優化的專門推理變體。

854

OpenAI 與微軟合作夥伴關係更新

OpenAI 與微軟已簽署一份非約束性諒解備忘錄,進入合作的下一階段,重點在於 AI 工具的交付與安全。

855

OpenAI 非營利組織與公共利益公司(PBC)結構演變

OpenAI 正在演變其結構,使其非營利實體控制公共利益公司(PBC),並持有超過 1,000 億美元的股權,以資助其確保 AGI 造福全人類的使命。

856

Transformers 4.40 性能升級:OpenAI GPT‑OSS 零建構核心、MXFP4 量化、平行化與更快載入

Hugging Face 為 OpenAI 的 GPT‑OSS 模型在 transformers 套件中加入了零建構核心、MXFP4 4 位元量化、張量與專家平行化、動態滑動視窗快取、持續批次處理以及更快的模型載入,顯著提升了效率與可擴展性。

857

使用 Together AI 微調 Hugging Face Hub 的大型語言模型

Together AI 與 Hugging Face 已整合平台,讓開發者能使用 Together AI 的基礎設施微調 Hugging Face Hub 上任何相容的 LLM。

858

Jupyter Agents:訓練 LLM 以筆記本推理

Hugging Face 推出了一條用於產生高品質合成資料與最佳化腳手架的流水線,將像 Qwen3-4B 這樣的小型 LLM 轉變為最先進的資料科學代理。

859

SafetyKit Risk Agents powered by OpenAI Models

SafetyKit 利用 GPT-5、GPT-4.1 和其他 OpenAI 模型,以超過 95% 的準確度對 100% 的客戶內容進行欺詐和違規活動的自動化檢測。

860

mmBERT:ModernBERT 走向多語言化

Hugging Face 推出 mmBERT,一個在 3 兆以上 token、涵蓋 1,800 多種語言的超大規模多語言編碼模型,於效能與推論速度上均優於 XLM-R。

861

OpenAI 以人為本 AI 基金

OpenAI 已開放申請 5,000 萬美元基金,提供無限制補助金給美國非營利組織,以推動 AI 素養、社區創新與經濟機會。

862

OpenAI 研究:為何語言模型會產生幻覺

OpenAI 主張,語言模型產生幻覺是因為標準的訓練與評估程序傾向獎勵猜測而非承認不確定性,而非源於神祕的錯誤。

863

OpenAI for Greece 合作夥伴關係啟動教育試點與 AI 加速器

OpenAI 宣佈了 ‘OpenAI for Greece’ 合作夥伴關係,於中學啟動 ChatGPT Edu 試點並設立希臘 AI 加速器以促進本地 AI 初創企業,標誌著在希臘教育與創新領域嵌入先進 AI 的重要一步。

864

OpenAI 透過 AI 計畫擴大經濟機會

OpenAI 宣布了 OpenAI Jobs Platform 與 OpenAI Certifications,協助員工提升 AI 流利度並與雇主接軌,目標在 2030 年前認證 1,000 萬名美國人。

865

EmbeddingGemma 300M 版本說明

Google 發布了 EmbeddingGemma,一款 308M 參數的多語言嵌入模型,在 500M 以下模型的 MTEB 基準測試中名列前茅,且針對裝置端使用進行了優化。

866

SandboxAQ SAIR 資料集發布

SandboxAQ 已發布 SAIR,這是目前最大規模的共摺疊 3D 蛋白質‑配體結構資料集,配有實驗測得的 IC50 標籤,提供超過 500 萬個 AI 生成的結構,以加速 AI 驅動的藥物發現。

867

OpenAI 收購 Statsig 並任命 Vijaye Raji 為應用程式部門的首席技術官

OpenAI 收購了實驗平台 Statsig,並任命其創辦人兼執行長 Vijaye Raji 為應用程式部門的首席技術官,負責領導 ChatGPT 與 Codex 的產品工程。

868

OpenAI 更新 ChatGPT 安全與福祉倡議

OpenAI 正在推行為期 120 天的計畫,以提升 ChatGPT 在精神健康危機中的回應,並在醫療專家網路的指導下為青少年推出家長控制功能。

869

Hugging Face ZeroGPU 前置編譯指南

Hugging Face 為 ZeroGPU Spaces 引入前置編譯(AoT),透過消除即時編譯開銷,使 Flux、Wan、LTX 等生成模型的速度提升 1.3 倍至 1.8 倍。

870

word2vec學習了什麼:特徵學習的閉式理論

BAIR研究人員提出了一個可預測的理論,證明word2vec的學習可簡化為無權重最小二乘矩陣分解,學得的表示實質上是對特定目標矩陣進行主成分分析(PCA)的結果。

871

OpenAI gpt-realtime 與 Realtime API 正式上線

OpenAI 已發布 gpt-realtime,一款高效能語音對語音模型,並正式開放 Realtime API,支援圖像輸入、遠端 MCP 伺服器與 SIP 電話呼叫。

872

OpenAI 支持非營利組織與社區創新基金

OpenAI 正在開放申請一項 5,000 萬美元的基金,向美國境內的 501(c)(3) 非營利組織與社區組織提供無限制的補助金,以促進以 AI 為驅動的公共利益創新。

873

OpenAI 集體對齊與模型規範更新

OpenAI 推出了一項集體對齊研究計畫,將超過 1,000 名全球參與者的公共偏好納入其模型規範,以確保 AI 的預設行為能反映多元的人類價值觀。

874

OpenAI 與 Anthropic 共同安全評估發現

OpenAI 與 Anthropic 公布了聯合安全評估結果,顯示 Claude 4 系列在指令層級上表現優異,而 OpenAI 的推理模型在越獄抵抗上領先,兩個實驗室皆強調跨實驗室合作對 AI 對齊的價值。

875

OpenAI 心理健康與危機介入安全措施

OpenAI 詳細說明了其在 ChatGPT 中管理心理健康危機的分層安全機制,包括 GPT-5 提升的回應準確性以及直接整合緊急服務的計畫。

876

OpenAI Learning Accelerator 印度發佈

OpenAI 已在印度推出 Learning Accelerator,透過策略性機構合作,為數百萬教育工作者與學生提供 AI 研究、培訓以及 ChatGPT 授權。

877

OpenAI 與 Retro Biosciences:以 GPT-4b micro 加速生命科學

OpenAI 與 Retro Biosciences 開發了 GPT-4b micro,一個專門用於蛋白質工程的模型,重新設計了 Yamanaka 因子,使幹細胞重編程的表達水平比野生型對照提升超過 50 倍。

878

Blue J 使用 GPT-4.1 擴展稅務研究

Blue J 利用 GPT-4.1 與專有的 RAG 系統,自動化美國、加拿大與英國的複雜稅務研究,將不同意率降低至每 700 個回應中不足 1 個。

879

NVIDIA Nemotron 後訓練資料集 v2 與 Nemotron Nano 2 9B 發布

NVIDIA 發布了包含 600 萬樣本的多語言推理資料集以及 Nemotron Nano 2 9B 模型,該模型採用混合 Transformer-Mamba 架構,以優化推理成本與吞吐量。

880

MIXI ChatGPT Enterprise 部署

MIXI 在 45 天內於全公司部署了 ChatGPT Enterprise,使部分專案的工作時數減少超過 90%,並讓員工創建了超過 1,600 個自訂 GPT。

881

使用 Claude 與 Hugging Face 產生圖像

Hugging Face 透過 Model Context Protocol (MCP) 伺服器,將 AI 連接至 Hugging Face Spaces,從而在 Claude 中啟用圖像生成。

882

Qwen-Image-Edit 版本說明

Qwen-Image-Edit 是一個 20B 參數的影像編輯模型,透過結合 Qwen2.5-VL 與 VAE Encoder,實現精確的語意與外觀編輯,並支援雙語文字修改。

883

Hugging Face 研究用 MCP:將 AI 連接至研究工具

Hugging Face 推出 Research Tracker MCP,使 AI 代理能透過模型上下文協定(Model Context Protocol)整合 arXiv、GitHub 與 Hugging Face,自動化研究發現。

884

TITLE: Hugging Face kernel-builder:建構與擴展生產級 CUDA 核心的指南

SUMMARY: Hugging Face 推出 kernel-builder 函式庫,以簡化透過 Hugging Face Hub 開發、多架構編譯與發佈生產級 CUDA 核心的流程。

885

DoorDash AI 實施策略

DoorDash 正在利用 AI 讓非工程師也能參與技術創作,並為員工發展與績效管理提供個性化服務。

886

Kimina-Prover-RL 發佈

Hugging Face 發佈了 Kimina-Prover-RL,這是一個用於 Lean 4 形式化定理證明的開源 RL 訓練流水線以及兩個 SOTA 模型(0.6B 和 1.7B)。

887

Arm 與 ExecuTorch 0.7:將生成式 AI 擴展至數十億設備

Arm 與 ExecuTorch 0.7 beta 透過 KleidiAI 提供自動 AI 加速,利用 SDOT 指令將 Llama 3.2 等大型語言模型帶到數十億現有的 Arm 裝置上。

888

Arm Neural Super Sampling (NSS) 發布

Arm 已發布 Neural Super Sampling (NSS),這是一種 AI 驅動的升頻解決方案,旨在降低 GPU 工作負載並在行動裝置上實現高解析度渲染。

889

FilBench:評估大型語言模型在菲律賓語言的能力

Hugging Face 推出了 FilBench,一套全面的評估套件,旨在評估大型語言模型在塔加洛語、菲律賓語與宿務語的流暢度、語言能力與文化知識。

890

TextQuests:評估大型語言模型在文字冒險遊戲中的代理推理能力

Hugging Face 推出 TextQuests,一個使用 25 款經典 Infocom 互動小說遊戲的基準測試,用以評估大型語言模型代理的長上下文推理與探索能力。

891

Basis 以 OpenAI GPT-5 與 o3 擴展會計自動化

Basis 使用由 OpenAI GPT-5、GPT-4.1 與 o3 模型驅動的多代理架構,自動化複雜的會計工作流程,為會計事務所節省最高 30% 的時間。

892

OpenAI 提案:加州協調式 AI 法規

OpenAI 已呼籲州長 Gavin Newsom 使加州的 AI 法規與國家及全球標準保持一致,以防止州級法規支離破碎,阻礙創新與美國競爭力。

893

Hugging Face AI Sheets 發布

Hugging Face 推出了 AI Sheets,一款開源的無程式碼工具,用於使用開放式 AI 模型構建、轉換與豐富資料集。

894

Accelerate ND-Parallel:高效多 GPU 訓練指南

Hugging Face 已將 ND-Parallelism 整合至 Accelerate 與 Axolotl,使用者得以結合資料、完全分片資料、張量與上下文平行化策略,優化大型模型的多 GPU 訓練。

895

OpenAI GPT-5 發布說明

OpenAI 已發布 GPT-5,一個整合推理、代理與高階數學能力的統一模型,以提升企業運營的準確性、速度與問題解決能力。

896

GPT-5 開發者發佈說明

OpenAI 已推出三種規格的 GPT-5(gpt-5、gpt-5-mini 與 gpt-5-nano),在程式編寫、代理工具呼叫與長上下文檢索方面提供最先進的效能。

897

GPT-5 編碼與設計能力

OpenAI 宣布了 GPT-5,重點在於提升編碼與設計的能力,然而公告中未提供具體的技術細節。

898

OpenAI GPT-5 創意寫作能力

OpenAI 宣布了 GPT-5 的新創意寫作能力,擴展了模型生成高品質敘事與藝術文本的能力。

899

醫學研究與 GPT-5

OpenAI 已宣布將 GPT-5 應用於醫學研究,擴大模型在專業科學領域的效用。

900

TRL 中的 Vision Language Model Alignment

Hugging Face 已擴展 TRL 函式庫以支援視覺語言模型 (VLMs) 的進階對齊方法,包括 MPO、GRPO 和 GSPO,同時提供原生 SFT 支援以及 vLLM 整合。