1101

Hugging Face 回應白宮 AI 行動計畫資訊徵求

Hugging Face 主張開源與開放科學在 AI 發展中的根本角色,指出開放模型在效能與效率上正日益匹敵或超越封閉的商業系統。

1102

EliseAI: 透過 OpenAI 提升住房與醫療效率

EliseAI 利用 OpenAI 的 GPT-4 和 Whisper 模型,自動化住房與醫療產業中的複雜對話工作流程,以提升運營效率。

1103

ChatGPT for Business 三月 2025 更新

OpenAI 在 2025 年三月為 ChatGPT for Business 引入了新功能,包括 Canvas、深度研究工具和 OpenAI o1 pro 模式。

1104

NVIDIA GTC 2025 Physical AI 發布: Cosmos Transfer, Physical AI Dataset, 和 Isaac GR00T N1

NVIDIA 已發布 Cosmos Transfer 用於可控世界場景生成,一個 15TB Physical AI Dataset,以及 Isaac GR00T N1,這是首個用於通用類人機器人推理的開放基礎模型。

1105

Hugging Face Xet 儲存整合

Hugging Face 已開始將儲存庫從 LFS 遷移至 Xet 儲存,利用內容定義分塊顯著減少大型 AI 模型與資料集的上傳與下載時間。

1106

OpenAI 對埃隆·馬斯克訴訟法院裁決的回應

OpenAI 宣布,法院已駁回埃隆·馬斯克對初步禁令的請求,並駁回其多項主張,進一步肯定 OpenAI 維持其非營利實體的承諾。

1107

LY Corporation 與 OpenAI 合作

LY Corporation 正利用 OpenAI 的 API 和 GPT-4o 在其 LINE 和 Yahoo! JAPAN 平台上整合生成式 AI,預計年度銷售額增加 ‰110B 日元,生產力提升 ‰10B 日元。

1108

Gemma 3 版本說明 / 新功能

Google 已發布 Gemma 3,這是一個多模態、多語言的開放權重 LLM 家族,參數規模從 1B 到 27B,上下文視窗可達 128k 個 token。

1109

OpenAI 新工具用於建構代理

OpenAI 已發布一套新的代理構建工具,包括 Responses API、開源 Agents SDK,以及用於網頁搜尋、檔案搜尋和電腦使用的內建工具。

1110

LeRobot L2D: 世界最大的開源自駕數據集

Hugging Face 和 Yaak 已發布 Learning to Drive (L2D),一個多模態自駕數據集,包含來自 30 個德國城市的超過 5,000 小時駕駛數據,以實現端到端的空間智能訓練。

1111

OpenAI 鏈式思維監控用於獎勵駭客檢測

OpenAI 發現監控鏈式思維(CoT)推理可以檢測前沿模型中的獎勵駭客和錯誤行為,但直接優化 CoT 以抑制不良思維可能導致模型隱藏其意圖。

1112

Nubank 整合 OpenAI GPT-4o 用於客戶服務與詐騙偵測

Nubank 正利用 OpenAI 的 GPT-4o 與 GPT-4o mini 自動化處理 55% 的 Tier 1 客戶詢問,將聊天回覆時間縮短 70%,並透過視覺分析增強詐騙偵測。

1113

邊緣 LLM 推理:透過 React Native 執行本地 LLM

Hugging Face 提供一份全面指南,使用 React Native 和 llama.rn 在 Android 和 iOS 上本地運行量化的 GGUF 模型,以構建注重隱私的移動應用程式。

1114

Factory 軟體開發平台搭載 OpenAI 推理模型

Factory 利用 OpenAI o1、o3-mini 和 GPT-4o 將功能開發週期加速 2-4 倍,並將情境切換時間減少 60%。

1115

QwQ-32B 版本說明 / 新功能

Qwen 已發布 QwQ-32B,這是一個 320 億參數的推理模型,利用縮放強化學習來達到與更大的 DeepSeek-R1 相媲美的性能。

1116

LaunchDarkly 的 AI 驅動產品管理方法

LaunchDarkly 的產品與技術總監 Claire Vo 說明 AI 如何自動化傳統產品管理任務,並將角色推向商業總經理或整合技術領導的方向。

1117

OpenAI NextGenAI 聯盟啟動

OpenAI 已啟動 NextGenAI,這是一個由 15 家研究機構組成的聯盟,獲得 $50 million 的研究補助金、運算資金和 API 存取權的支持,以加速 AI 驅動的研究與教育。

1118

Aya Vision: 以 8B 與 32B 模型推進多語言多模態

Cohere For AI 已發布 Aya Vision,一系列支援 23 種語言的開放權重視覺語言模型(8B 與 32B),在多語言多模態任務中優於更大的模型。

1119

Hugging Face 與 JFrog 合作以提升 AI 模型安全性

Hugging Face 已將 JFrog 的掃描器整合到 Hugging Face Hub,以減少誤報並偵測模型權重中各種序列化格式內的惡意程式碼。

1120

OpenAI 與美國國家實驗室 1,000 位科學家 AI Jam Session

OpenAI 與美國能源部在九個國家實驗室舉辦「1,000 位科學家 AI Jam Session」,利用前沿 AI 模型(如 o3-mini)加速科學發現。

1121

追蹤與評估 smolagents 與 Arize Phoenix

Hugging Face 示範如何結合 Arize Phoenix 與 smolagents,實作即時追蹤與 LLM-as-a-judge 評估,以支援代理工作流程的可觀測性與效能衡量。

1122

Mercari 與 GPT-4o mini 的 AI 整合

Mercari 已將 GPT-4o mini 與其他 OpenAI 模型整合,以自動化產品列表生成並優化銷售建議,從而提升列表轉換率和每位使用者的平均銷售額。

1123

OpenAI GPT-4.5 研究預覽

OpenAI 已發布 GPT-4.5,這是一個大規模通用模型,旨在提供更廣泛的知識、提升情感智能並減少幻覺,相較於 GPT-4o。

1124

使用 o1 和 o3-mini 建構自主財務分析師

Endex 正利用 OpenAI 的 o1 和 o3-mini 推理模型來構建一個能夠進行複雜資料合成、多模態分析和精確財務推理的自主 AI 財務分析師。

1125

Hugging Face 與 IISc 合作開源 Vaani 資料集

Hugging Face 已與印度科學學院(IISc)和 ARTPARK 合作,提供全球存取 Vaani 的途徑,Vaani 是一個龐大的多模態、多語言資料集,旨在代表印度的語言多樣性。

1126

OpenAI Deep Research 系統卡

OpenAI 已推出 Deep Research,這是一種由早期版本 o3 優化以進行網頁瀏覽的代理能力,用於執行複雜任務的多步驟網際網路研究。

1127

FastRTC:Python 即時通訊函式庫

Hugging Face 發布了 FastRTC,這是一個 Python 函式庫,旨在透過處理 WebRTC 與 WebSocket 通訊層,簡化即時音訊與視訊 AI 應用程式的開發。

1128

QwQ-Max-Preview 發布

Qwen 已推出 QwQ-Max-Preview,這是一個基於 Qwen2.5-Max 的預覽推理模型,在數學、編碼和 Agent 相關工作流程中表現出色。

1129

Hugging Face 遠端 VAEs 用於推理端點

Hugging Face 推出了一項實驗功能,將 VAE 解碼過程委派給遠端端點,以降低在消費級 GPU 上進行高解析度圖像和影像合成所需的 VRAM 需求。

1130

OpenAI 阻斷惡意使用 AI

OpenAI 已發布一份報告,詳細說明其為阻斷惡意使用 AI 所做的努力,重點在於防止國家關聯的威脅行為者和威權政權利用 AI 進行隱密影響行動和網路活動。

1131

SigLIP 2 版本說明 / 新功能

Google 已發布 SigLIP 2,這是一系列多語言視覺-語言編碼器,在零樣本分類、圖像-文本檢索以及 VLM 轉移性能方面,在所有規模上都優於原始 SigLIP。

1132

Uber AI 整合適用於隨需服務

Uber 使用 OpenAI 的技術來個人化使用者互動、自動化複雜的市場解決方案,並透過 AI 驅動的副駕駛提升員工生產力。

1133

SmolVLM2: 讓每台設備都能理解影片

Hugging Face 已發布 SmolVLM2,這是一系列高效的視覺與影片語言模型,參數規模為 2.2B、500M 和 256M,旨在讓從手機到伺服器的設備能夠在本地進行影片理解。

1134

PaliGemma 2 Mix 發布說明

Google 已發布 PaliGemma 2 mix,一系列在包括 OCR、字幕生成和物體偵測等多樣化任務上進行微調的視覺語言模型,以展示 PaliGemma 2 預訓練檢查點的潛力。

1135

OpenAI SWE-Lancer 基準測試發布

OpenAI 已推出 SWE-Lancer,一個包含超過 1,400 個來自 Upwork 的真實世界自由職業軟體工程任務的基準測試,用於衡量 AI 模型在軟體開發中的經濟影響和技術能力。

1136

Hugging Face 新增 Hyperbolic、Nebius AI Studio 與 Novita 作為無伺服器推理提供者

Hugging Face 已將 Hyperbolic、Nebius AI Studio 與 Novita 整合為無伺服器推理提供者,透過 Hub 和用戶端 SDK 直接擴展對 DeepSeek-R1 和 FLUX.1 等模型的存取。

1137

OpenAI 與 Guardian Media Group 內容合作夥伴關係

OpenAI 與 Guardian Media Group 已建立策略合作夥伴關係,將 Guardian 的編輯內容整合至 ChatGPT 中,為每週 3 億名用戶提供直接獲取值得信賴的報導與詳細摘要的管道。

1138

Hugging Face Open LLM Leaderboard 更新:整合 Math-Verify 以改進數學評估

Hugging Face 使用 Math-Verify 在 Open LLM Leaderboard 上重新評估了 3,751 個模型,以修復解析錯誤和格式嚴格性,導致 MATH-Hard 排名顯著重新排列。

1139

Hugging Face 將 Fireworks.ai 整合為推理提供者

Hugging Face 已將 Fireworks.ai 添加為 Hub 上支援的推理提供者,使得像 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 這樣的模型能夠在 HF 生態系統中進行無伺服器推理。

1140

Fanatics Betting and Gaming 在財務中的 AI 實施

Fanatics Betting and Gaming 正在利用 ChatGPT 和自訂 GPTs 來自動化手動財務任務,減少每月工作量並加速戰略決策。

1141

Wayfair AI 實施與策略

Wayfair 正在整合 OpenAI 的生成式 AI 和多模態功能,以個人化電子商務體驗、現代化舊程式碼庫,以及自動化法律工作流程中的風險分析。

1142

Rogo 使用 OpenAI o1 和 GPT-4o 擴展金融研究

Rogo 利用具備 OpenAI o1 和 GPT-4o 的分層模型架構來自動化金融研究與盡職調查,使分析師每週節省超過 10 小時。

1143

Hugging Face: 優化 10 億次分類的成本與延遲

Hugging Face 提供了一個框架和基準,用於降低大規模編碼器模型推理的成本,表明 NVIDIA L4 GPU 和優化的批次大小可以以低至 253.82 美元處理 10 億次文本分類。

1144

OpenAI Model Spec 更新

OpenAI 已在 CC0 許可證下發布更新的 Model Spec,以定義 AI 行為,優先考慮使用者自訂性與知識自由,同時維持安全防護措施。

1145

Hugging Face 影片資料集腳本

Hugging Face 推出了ชุด開源影片資料集腳本,旨在簡化用於微調影片生成模型的高品質、經過過濾的資料集建立過程。

1146

Hugging Face Xet支援的儲存庫:透過區塊層級聚合加速 Hub 傳輸

Hugging Face 正在推出一個基於區塊的去重複系統,使用 xet-core 和 hf_xet,透過區塊層級聚合將上傳和下載速度提升 2-3 倍。

1147

Open R1 更新 #2:OpenR1-Math-220k 數據集與推理見解

Hugging Face 推出 OpenR1-Math-220k,這是一個大規模的數學推理數據集,旨在重建 DeepSeek R1 的蒸餾管道,同時分享社區對 GRPO 和 Chain-of-Thought 長度控制的見解。

1148

OpenAI 與 Schibsted Media Group 合作夥伴關係

OpenAI 已與 Schibsted Media Group 合作,將 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等標題的高品質北歐新聞內容整合到 ChatGPT 中。

1149

開放阿拉伯語 LLM 排行榜 2

Hugging Face 與其合作夥伴已發布開放阿拉伯語 LLM 排行榜 2(OALL v2),使用本地阿拉伯語數據集和新的 RAG 評估框架取代飽和及機器翻譯的基準測試,以更準確地衡量阿拉伯語語言能力。

1150

OpenAI 介紹智慧時代

OpenAI 將智慧時代定義為由 AI 推動的技術進步新時代,強調其作為提升人類生產力、創造力和科學發現的工具的角色。