1151

OpenAI 數據居留在歐洲與全球擴展

OpenAI 已在歐洲推出數據居留選項,並將這些功能擴展至全球,以協助組織滿足本地數據主權與合規需求。

1152

OpenAI 與加州州立大學系統部署 ChatGPT Edu

OpenAI 與加州州立大學(CSU)系統已啟動至今最大規模的 ChatGPT 部署,為 23 個校園的超過 520,000 名學生和教職員提供 ChatGPT Edu 的存取權。

1153

DABStep: 多步驟推理的數據代理基準

Hugging Face 與 Adyen 已推出 DABStep,這是一個包含超過 450 個真實世界數據分析任務的基準,揭示當前最先進的 AI 代理在複雜推理任務上的準確率僅為 16%。

1154

pi0 和 pi0-FAST:視覺-語言-動作模型,適用於一般機器人控制

Hugging Face 已將由 Physical Intelligence 開發的通用視覺-語言-動作 (VLA) 模型 pi0 和 pi0-FAST 整合到 LeRobot 儲存庫,以實現跨多種具體形態的多樣化機器人控制。

1155

使用 ChatGPT 進行指甲藝術設計

持證指甲技師 Tabytha Scott 使用 ChatGPT 作為創意夥伴,將無限的設計點子縮減為可執行的指甲藝術概念。

1156

Hugging Face 開源 DeepResearch

Hugging Face 已開源一個框架,以重現 OpenAI 的 Deep Research 能力,在 GAIA 基準測試中使用程式碼原生代理方法達成 55.15% 的分數。

1157

使用 ChatGPT 進行專業釣魚指導

OpenAI 說明一位專業釣魚者如何使用 ChatGPT 制定有針對性的釣魚計畫,並加速運動初學者的學習曲線。

1158

使用 ChatGPT GPTs 建構自訂數學導師

Phil Birchenall 使用自訂 GPT 創建了一個個人化、狗狗主題的數學導師,幫助他的女兒提升數學技能並通過了她的 SATs 考試。

1159

OpenAI 深度研究用於複雜產業趨勢

OpenAI 已推出深度研究,這是一種旨在自動化分析複雜產業趨勢的工具,以提升專業研究人員的個人能力。

1160

OpenAI 深度研究

OpenAI 已推出深度研究,這是一項在 ChatGPT 中由 o3 模型版本提供動力的代理能力,能夠自主進行多步驟網路研究,以產出全面的分析師級別報告。

1161

Open-R1 更新 #1:複製 DeepSeek-R1 訓練與合成數據

Hugging Face 提供了 Open-R1 專案的第一份進度更新,詳細介紹了 DeepSeek-R1 評估分數的重現、GRPO 整合至 TRL 的情況,以及擴展合成推理數據生成的策略。

1162

OpenAI 打擊 AI 協助的浪漫誘騙與養豬詐騙

OpenAI 已封禁一批由柬埔寨基地的網路使用的 ChatGPT 帳號,該網路利用 AI 自動化翻譯與人物設定,以進行浪漫與投資詐騙。

1163

OpenAI 破壞「Sponsored Discontent」影響行動

OpenAI 已封禁與一個被稱為「Sponsored Discontent」的中國影響行動相關的帳號,該行動利用 ChatGPT 產生針對美國與一名中國異議人士的批評內容,最終在拉丁美洲主流媒體植入長篇文章。

1164

OpenAI 使用 AI 破壞與北韓相關的網路威脅行動者

OpenAI 已封禁與北韓相關的威脅行動者帳號,包括 VELVET CHOLLIMA 與 STARDUST CHOLLIMA,這些行動者使用 AI 進行程式編寫協助、除錯以及社交工程研究。

1165

OpenAI 使用 ChatGPT 破壞伊朗影響力網絡

OpenAI 已封鎖五個被伊朗相關影響力行動 STORM-2035 與 IUVM 用於在多語言與多平台上產生親伊朗與親哈馬斯內容的 ChatGPT 帳號。

1166

OpenAI 打擊針對加納選舉的隱蔽影響行動

OpenAI 封禁了一批由名為 DigitSol 的商業實體使用的 ChatGPT 帳號,這些帳號在加納總統選舉期間為隱蔽影響行動產生支持 Bawumia、反對 Mahama 的內容。

1167

OpenAI 破壞 AI 輔助任務詐騙網路

OpenAI 已封禁一批由柬埔寨基地的網路使用的 ChatGPT 帳號,該網路透過 AI 驅動的翻譯與社交工程協助「任務詐騙」。

1168

OpenAI 打擊 AI 輔助的欺詐就業計畫

OpenAI 封禁了數十個用於欺詐就業計畫的帳號,該計畫利用 AI 製造求職申請、進行面試以及執行工作任務,與被歸因於北韓國家行動的 TTP 相符。

1169

OpenAI 行動 同儕審查:破壞 AI 輔助的監控規劃

OpenAI 封禁了一批可能源自中國的 ChatGPT 帳號,這些帳號利用 AI 協助研究政治人物、分析抗議文件以及開發監控工具。

1170

OpenAI o3-mini 系統卡

OpenAI 發布了 o3-mini 系統卡,詳細說明大規模強化學習和思維鏈推理如何使模型在安全性能上達到最先進水準,並在 Preparedness Framework 下獲得中等風險分類。

1171

OpenAI o3-mini 發佈說明 / 新功能介紹

OpenAI 已發佈 o3-mini,這是一款針對 STEM 優化的高成本效益推理模型,在數學、程式設計與科學方面的性能可與 o1 媲美,同時具備更低的延遲與更廣泛的開發者功能。

1172

Mini-R1: 透過 GRPO 和倒數遊戲重現 DeepSeek-R1 推理

Hugging Face 展示了如何透過在 Countdown Game 上使用 Group Relative Policy Optimization (GRPO) 訓練 Qwen2.5-3B 模型來重現 DeepSeek-R1 的 'aha moment'(自我修正與推理)。

1173

Hugging Face 藝術 AI 工具通訊第 1 期

Hugging Face 推出了每月一次的通訊,詳細介紹開源創意 AI 的現狀,重點介紹 2024 年向擴散 Transformer 的轉型,以及高品質開源影片與音訊模型的出現。

1174

OpenAI 與美國國家實驗室合作夥伴關係

OpenAI 已與美國國家實驗室建立合作關係,在 Venado 超級電腦上部署推理模型,以加速科學研究並強化國家安全。

1175

如何在 AWS 上部署與微調 DeepSeek R1 模型

Hugging Face 展示了如何使用 Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、Amazon SageMaker AI(GPU 與 Neuron 實例)以及搭配 Hugging Face Neuron Deep Learning AMI 的 EC2 Neuron,在 AWS 上部署與微調 DeepSeek R1 及其蒸餾版本。

1176

Qwen2.5-Max 發布說明

Qwen 已發布 Qwen2.5-Max,一種在超過 20 兆個標記上預訓練的大規模混合專家 (MoE) 模型,可透過 API 和 Qwen Chat 使用。

1177

Open-R1: 完全開放的 DeepSeek-R1 重現

Hugging Face 已啟動 Open-R1 項目,以系統地重建 DeepSeek-R1 的數據和訓練管道,旨在為開源社區提供缺失的推理模型數據和程式碼。

1178

Hugging Face 推理提供者整合

Hugging Face 已將四個無伺服器推理提供者——fal、Replicate、SambaNova 和 Together AI——直接整合到 Hub 中,以提供統一、以模型為中心的無伺服器推理。

1179

Diffusers 中開放視訊生成模型的現狀

Hugging Face 提供開放視訊生成模型的全面概述,並介紹了一套 Diffusers 優化方案,可將 HunyuanVideo 等模型的顯存需求從 60GB 減少至約 6.5GB。

1180

Qwen2.5-1M 發布:開源 7B 與 14B 模型,支援 1M‑Token 上下文並基於 vLLM 的推理框架

Qwen 發布開源的 Qwen2.5‑7B‑Instruct‑1M 與 Qwen2.5‑14B‑Instruct‑1M 模型,支援多達 1 百萬 token 的上下文,並附帶一個經過優化的基於 vLLM 的推理框架,該框架可使預填充速度提升 3×–7×,同時保持與 GPT‑4o‑mini 相當的短任務表現。

1181

Qwen2.5-VL 版本說明

Qwen 已發布 Qwen2.5-VL,這是一種旗艦視覺語言模型,提供 3B、7B 和 72B 三種規模,引入了先進的視覺代理能力、長視頻理解和結構化文檔解析。

1182

smolagents 視覺支援更新

Hugging Face 已為 smolagents 添加了原生視覺支援,使得在代理管道中可以使用視覺語言模型(VLMs)來執行如自主網頁瀏覽等任務。

1183

OpenAI Operator 研究預覽

OpenAI 已推出 Operator,這是一種由 Computer-Using Agent (CUA) 模型驅動的 AI 代理研究預覽,能夠獨立導航網頁瀏覽器以執行如填寫表單和訂購雜貨等任務。

1184

OpenAI Computer-Using Agent (CUA) 與 Operator 研究預覽

OpenAI 已推出 Computer-Using Agent (CUA),該模型能透過螢幕、滑鼠和鍵盤的通用介面與 GUI 互動以執行數位任務,現在可透過 Operator 以研究預覽形式使用。

1185

OpenAI Operator 系統卡

OpenAI 已推出 Operator,一種 Computer-Using Agent (CUA) 模型的研究預覽版,能與圖形使用者介面 (GUI) 互動,代表使用者執行任務,並以多層次安全框架支援,以降低如提示注入和模型錯誤等風險。

1186

NVIDIA KVPress:長上下文 LLMs 的 KV 壓縮工具箱

NVIDIA 已發布 KVPress,這是一個 Python 工具箱,實現了最先進的 KV 快取壓縮技術,以減少長上下文大型語言模型的記憶體佔用並提升解碼速度。

1187

SmolVLM 256M 與 500M 發布說明

Hugging Face 推出 SmolVLM-256M 與 SmolVLM-500M,提供高效能的視覺語言模型,在參數數量顯著減少的情況下仍能保持強大的多模態性能。

1188

Bertelsmann 與 OpenAI 合作進行企業級 AI 整合

Bertelsmann 正在將 OpenAI 技術和 ChatGPT Enterprise 整合到其全球媒體、服務和教育品牌中,以大規模提升創造力、生產力和產品開發。

1189

用推理時間運算換取對抗性穩健性

OpenAI 研究表明,在 o1-preview 和 o1-mini 等推理模型中增加推理時間運算能提升其對多種對抗性攻擊的穩健性。

1190

Hugging Face 與 FriendliAI 合作進行模型部署

Hugging Face 已將 FriendliAI 的推理基礎設施整合到 Hugging Face Hub,啟用一鍵部署生成式 AI 模型到高效能端點。

1191

OpenAI Stargate 基礎設施 倡議

OpenAI 正尋求與美國本土的數據中心基礎設施公司合作,以開發其下一代 AI 系統所需的實體容量。

1192

OpenAI 宣布 The Stargate Project

OpenAI 與其合作夥伴已啟動 The Stargate Project,一項 5000 億美元的計畫,旨在在美国建立龐大的 AI 基礎設施,以支援 AGI 的發展。

1193

Hugging Face 組織部落格文章功能

Hugging Face 現在允許已訂閱 Enterprise Hub 的組織直接在其組織個人資料頁發布部落格文章。

1194

Qwen 用於 MoE LLM 訓練的 Global-Batch 負載平衡

Qwen 引入了一種 global-batch 負載平衡損失,透過在整個 global batch 而非單個 micro-batches 上計算平衡,來提升 MoE 模型的性能並實現專家專業化。

1195

Hugging Face Text Generation Inference (TGI) 多後端支援

Hugging Face 已為 Text Generation Inference (TGI) 引入多後端架構,允許使用者透過統一前端利用如 TensorRT-LLM 和 vLLM 等各種執行引擎部署 LLM。

1196

Hugging Face Transformers timm 整合

Hugging Face 已推出 TimmWrapper,使得 PyTorch Image Models (timm) 庫中的任何模型都能在 transformers 生態系統中無縫用於推理、量化和微調。

1197

OpenAI 新聞產業合作夥伴與 Axios 擴張

OpenAI 已宣布與 Axios 建立新的內容合作夥伴關係,並擴大對地方新聞的資金支持,同時詳細說明近 20 家媒體組織如何整合 AI 以簡化製作、提升使用者參與度並優化業務運營。

1198

使用 Sentence Transformers 訓練速度快 400 倍的靜態嵌入模型

Hugging Face 推出了一種訓練靜態嵌入模型的方法,這些模型在 CPU 上的運行速度快 100x–400x,同時能保留如 all‑mpnet‑base‑v2 等模型至少 85% 的品質,並發布了兩個模型(static‑retrieval‑mrl‑en‑v1 和 static‑similarity‑mrl‑multilingual‑v1)以及訓練腳本和評估結果。

1199

Adebayo Ogunlesi 加入 OpenAI 董事會

Adebayo Ogunlesi,Global Infrastructure Partners 首席執行官兼 BlackRock 高級董事總經理,已加入 OpenAI 董事會,以提供基礎設施投資與全球市場策略方面的專業知識。

1200

Qwen2.5-Math-PRM 與 ProcessBench 發布

Qwen 發布了 Qwen2.5-Math-PRM-7B 和 72B,這些是最先進的 Process Reward Model,旨在識別數學問題解決過程中的中間推理錯誤,並附帶 ProcessBench,一個新的步驟級評估基準。