6551

OpenAI Deep Research 系統卡

OpenAI 已推出 Deep Research,這是一種由早期版本 o3 優化以進行網頁瀏覽的代理能力,用於執行複雜任務的多步驟網際網路研究。

6552

FastRTC:Python 即時通訊函式庫

Hugging Face 發布了 FastRTC,這是一個 Python 函式庫,旨在透過處理 WebRTC 與 WebSocket 通訊層,簡化即時音訊與視訊 AI 應用程式的開發。

6553

QwQ-Max-Preview 發布

Qwen 已推出 QwQ-Max-Preview,這是一個基於 Qwen2.5-Max 的預覽推理模型,在數學、編碼和 Agent 相關工作流程中表現出色。

6554

Hugging Face 遠端 VAEs 用於推理端點

Hugging Face 推出了一項實驗功能,將 VAE 解碼過程委派給遠端端點,以降低在消費級 GPU 上進行高解析度圖像和影像合成所需的 VRAM 需求。

6555

OpenAI 阻斷惡意使用 AI

OpenAI 已發布一份報告,詳細說明其為阻斷惡意使用 AI 所做的努力,重點在於防止國家關聯的威脅行為者和威權政權利用 AI 進行隱密影響行動和網路活動。

6556

SigLIP 2 版本說明 / 新功能

Google 已發布 SigLIP 2,這是一系列多語言視覺-語言編碼器,在零樣本分類、圖像-文本檢索以及 VLM 轉移性能方面,在所有規模上都優於原始 SigLIP。

6557

Uber AI 整合適用於隨需服務

Uber 使用 OpenAI 的技術來個人化使用者互動、自動化複雜的市場解決方案,並透過 AI 驅動的副駕駛提升員工生產力。

6558

SmolVLM2: 讓每台設備都能理解影片

Hugging Face 已發布 SmolVLM2,這是一系列高效的視覺與影片語言模型,參數規模為 2.2B、500M 和 256M,旨在讓從手機到伺服器的設備能夠在本地進行影片理解。

6559

PaliGemma 2 Mix 發布說明

Google 已發布 PaliGemma 2 mix,一系列在包括 OCR、字幕生成和物體偵測等多樣化任務上進行微調的視覺語言模型,以展示 PaliGemma 2 預訓練檢查點的潛力。

6560

OpenAI SWE-Lancer 基準測試發布

OpenAI 已推出 SWE-Lancer,一個包含超過 1,400 個來自 Upwork 的真實世界自由職業軟體工程任務的基準測試,用於衡量 AI 模型在軟體開發中的經濟影響和技術能力。

6561

Hugging Face 新增 Hyperbolic、Nebius AI Studio 與 Novita 作為無伺服器推理提供者

Hugging Face 已將 Hyperbolic、Nebius AI Studio 與 Novita 整合為無伺服器推理提供者,透過 Hub 和用戶端 SDK 直接擴展對 DeepSeek-R1 和 FLUX.1 等模型的存取。

6562

OpenAI 與 Guardian Media Group 內容合作夥伴關係

OpenAI 與 Guardian Media Group 已建立策略合作夥伴關係,將 Guardian 的編輯內容整合至 ChatGPT 中,為每週 3 億名用戶提供直接獲取值得信賴的報導與詳細摘要的管道。

6563

Hugging Face Open LLM Leaderboard 更新:整合 Math-Verify 以改進數學評估

Hugging Face 使用 Math-Verify 在 Open LLM Leaderboard 上重新評估了 3,751 個模型,以修復解析錯誤和格式嚴格性,導致 MATH-Hard 排名顯著重新排列。

6564

Hugging Face 將 Fireworks.ai 整合為推理提供者

Hugging Face 已將 Fireworks.ai 添加為 Hub 上支援的推理提供者,使得像 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 這樣的模型能夠在 HF 生態系統中進行無伺服器推理。

6565

Fanatics Betting and Gaming 在財務中的 AI 實施

Fanatics Betting and Gaming 正在利用 ChatGPT 和自訂 GPTs 來自動化手動財務任務,減少每月工作量並加速戰略決策。

6566

Wayfair AI 實施與策略

Wayfair 正在整合 OpenAI 的生成式 AI 和多模態功能,以個人化電子商務體驗、現代化舊程式碼庫,以及自動化法律工作流程中的風險分析。

6567

Rogo 使用 OpenAI o1 和 GPT-4o 擴展金融研究

Rogo 利用具備 OpenAI o1 和 GPT-4o 的分層模型架構來自動化金融研究與盡職調查,使分析師每週節省超過 10 小時。

6568

Hugging Face: 優化 10 億次分類的成本與延遲

Hugging Face 提供了一個框架和基準,用於降低大規模編碼器模型推理的成本,表明 NVIDIA L4 GPU 和優化的批次大小可以以低至 253.82 美元處理 10 億次文本分類。

6569

OpenAI Model Spec 更新

OpenAI 已在 CC0 許可證下發布更新的 Model Spec,以定義 AI 行為,優先考慮使用者自訂性與知識自由,同時維持安全防護措施。

6570

Hugging Face 影片資料集腳本

Hugging Face 推出了ชุด開源影片資料集腳本,旨在簡化用於微調影片生成模型的高品質、經過過濾的資料集建立過程。

6571

Hugging Face Xet支援的儲存庫:透過區塊層級聚合加速 Hub 傳輸

Hugging Face 正在推出一個基於區塊的去重複系統,使用 xet-core 和 hf_xet,透過區塊層級聚合將上傳和下載速度提升 2-3 倍。

6572

Open R1 更新 #2:OpenR1-Math-220k 數據集與推理見解

Hugging Face 推出 OpenR1-Math-220k,這是一個大規模的數學推理數據集,旨在重建 DeepSeek R1 的蒸餾管道,同時分享社區對 GRPO 和 Chain-of-Thought 長度控制的見解。

6573

OpenAI 與 Schibsted Media Group 合作夥伴關係

OpenAI 已與 Schibsted Media Group 合作,將 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等標題的高品質北歐新聞內容整合到 ChatGPT 中。

6574

開放阿拉伯語 LLM 排行榜 2

Hugging Face 與其合作夥伴已發布開放阿拉伯語 LLM 排行榜 2(OALL v2),使用本地阿拉伯語數據集和新的 RAG 評估框架取代飽和及機器翻譯的基準測試,以更準確地衡量阿拉伯語語言能力。

6575

OpenAI 介紹智慧時代

OpenAI 將智慧時代定義為由 AI 推動的技術進步新時代,強調其作為提升人類生產力、創造力和科學發現的工具的角色。

6576

OpenAI 數據居留在歐洲與全球擴展

OpenAI 已在歐洲推出數據居留選項,並將這些功能擴展至全球,以協助組織滿足本地數據主權與合規需求。

6577

OpenAI 與加州州立大學系統部署 ChatGPT Edu

OpenAI 與加州州立大學(CSU)系統已啟動至今最大規模的 ChatGPT 部署,為 23 個校園的超過 520,000 名學生和教職員提供 ChatGPT Edu 的存取權。

6578

DABStep: 多步驟推理的數據代理基準

Hugging Face 與 Adyen 已推出 DABStep,這是一個包含超過 450 個真實世界數據分析任務的基準,揭示當前最先進的 AI 代理在複雜推理任務上的準確率僅為 16%。

6579

pi0 和 pi0-FAST:視覺-語言-動作模型,適用於一般機器人控制

Hugging Face 已將由 Physical Intelligence 開發的通用視覺-語言-動作 (VLA) 模型 pi0 和 pi0-FAST 整合到 LeRobot 儲存庫,以實現跨多種具體形態的多樣化機器人控制。

6580

使用 ChatGPT 進行指甲藝術設計

持證指甲技師 Tabytha Scott 使用 ChatGPT 作為創意夥伴,將無限的設計點子縮減為可執行的指甲藝術概念。

6581

Hugging Face 開源 DeepResearch

Hugging Face 已開源一個框架,以重現 OpenAI 的 Deep Research 能力,在 GAIA 基準測試中使用程式碼原生代理方法達成 55.15% 的分數。

6582

使用 ChatGPT 進行專業釣魚指導

OpenAI 說明一位專業釣魚者如何使用 ChatGPT 制定有針對性的釣魚計畫,並加速運動初學者的學習曲線。

6583

使用 ChatGPT GPTs 建構自訂數學導師

Phil Birchenall 使用自訂 GPT 創建了一個個人化、狗狗主題的數學導師,幫助他的女兒提升數學技能並通過了她的 SATs 考試。

6584

OpenAI 深度研究用於複雜產業趨勢

OpenAI 已推出深度研究,這是一種旨在自動化分析複雜產業趨勢的工具,以提升專業研究人員的個人能力。

6585

OpenAI 深度研究

OpenAI 已推出深度研究,這是一項在 ChatGPT 中由 o3 模型版本提供動力的代理能力,能夠自主進行多步驟網路研究,以產出全面的分析師級別報告。

6586

Open-R1 更新 #1:複製 DeepSeek-R1 訓練與合成數據

Hugging Face 提供了 Open-R1 專案的第一份進度更新,詳細介紹了 DeepSeek-R1 評估分數的重現、GRPO 整合至 TRL 的情況,以及擴展合成推理數據生成的策略。

6587

OpenAI 打擊 AI 協助的浪漫誘騙與養豬詐騙

OpenAI 已封禁一批由柬埔寨基地的網路使用的 ChatGPT 帳號,該網路利用 AI 自動化翻譯與人物設定,以進行浪漫與投資詐騙。

6588

OpenAI 破壞「Sponsored Discontent」影響行動

OpenAI 已封禁與一個被稱為「Sponsored Discontent」的中國影響行動相關的帳號,該行動利用 ChatGPT 產生針對美國與一名中國異議人士的批評內容,最終在拉丁美洲主流媒體植入長篇文章。

6589

OpenAI 使用 AI 破壞與北韓相關的網路威脅行動者

OpenAI 已封禁與北韓相關的威脅行動者帳號,包括 VELVET CHOLLIMA 與 STARDUST CHOLLIMA,這些行動者使用 AI 進行程式編寫協助、除錯以及社交工程研究。

6590

OpenAI 使用 ChatGPT 破壞伊朗影響力網絡

OpenAI 已封鎖五個被伊朗相關影響力行動 STORM-2035 與 IUVM 用於在多語言與多平台上產生親伊朗與親哈馬斯內容的 ChatGPT 帳號。

6591

OpenAI 打擊針對加納選舉的隱蔽影響行動

OpenAI 封禁了一批由名為 DigitSol 的商業實體使用的 ChatGPT 帳號,這些帳號在加納總統選舉期間為隱蔽影響行動產生支持 Bawumia、反對 Mahama 的內容。

6592

OpenAI 破壞 AI 輔助任務詐騙網路

OpenAI 已封禁一批由柬埔寨基地的網路使用的 ChatGPT 帳號,該網路透過 AI 驅動的翻譯與社交工程協助「任務詐騙」。

6593

OpenAI 打擊 AI 輔助的欺詐就業計畫

OpenAI 封禁了數十個用於欺詐就業計畫的帳號,該計畫利用 AI 製造求職申請、進行面試以及執行工作任務,與被歸因於北韓國家行動的 TTP 相符。

6594

OpenAI 行動 同儕審查:破壞 AI 輔助的監控規劃

OpenAI 封禁了一批可能源自中國的 ChatGPT 帳號,這些帳號利用 AI 協助研究政治人物、分析抗議文件以及開發監控工具。

6595

OpenAI o3-mini 系統卡

OpenAI 發布了 o3-mini 系統卡,詳細說明大規模強化學習和思維鏈推理如何使模型在安全性能上達到最先進水準,並在 Preparedness Framework 下獲得中等風險分類。

6596

OpenAI o3-mini 發佈說明 / 新功能介紹

OpenAI 已發佈 o3-mini,這是一款針對 STEM 優化的高成本效益推理模型,在數學、程式設計與科學方面的性能可與 o1 媲美,同時具備更低的延遲與更廣泛的開發者功能。

6597

Mini-R1: 透過 GRPO 和倒數遊戲重現 DeepSeek-R1 推理

Hugging Face 展示了如何透過在 Countdown Game 上使用 Group Relative Policy Optimization (GRPO) 訓練 Qwen2.5-3B 模型來重現 DeepSeek-R1 的 'aha moment'(自我修正與推理)。

6598

Hugging Face 藝術 AI 工具通訊第 1 期

Hugging Face 推出了每月一次的通訊,詳細介紹開源創意 AI 的現狀,重點介紹 2024 年向擴散 Transformer 的轉型,以及高品質開源影片與音訊模型的出現。

6599

OpenAI 與美國國家實驗室合作夥伴關係

OpenAI 已與美國國家實驗室建立合作關係,在 Venado 超級電腦上部署推理模型,以加速科學研究並強化國家安全。

6600

如何在 AWS 上部署與微調 DeepSeek R1 模型

Hugging Face 展示了如何使用 Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、Amazon SageMaker AI(GPU 與 Neuron 實例)以及搭配 Hugging Face Neuron Deep Learning AMI 的 EC2 Neuron,在 AWS 上部署與微調 DeepSeek R1 及其蒸餾版本。