6601

OpenAI 打擊 AI 協助的浪漫誘騙與養豬詐騙

OpenAI 已封禁一批由柬埔寨基地的網路使用的 ChatGPT 帳號,該網路利用 AI 自動化翻譯與人物設定,以進行浪漫與投資詐騙。

6602

OpenAI 破壞「Sponsored Discontent」影響行動

OpenAI 已封禁與一個被稱為「Sponsored Discontent」的中國影響行動相關的帳號,該行動利用 ChatGPT 產生針對美國與一名中國異議人士的批評內容,最終在拉丁美洲主流媒體植入長篇文章。

6603

OpenAI 使用 AI 破壞與北韓相關的網路威脅行動者

OpenAI 已封禁與北韓相關的威脅行動者帳號,包括 VELVET CHOLLIMA 與 STARDUST CHOLLIMA,這些行動者使用 AI 進行程式編寫協助、除錯以及社交工程研究。

6604

OpenAI 使用 ChatGPT 破壞伊朗影響力網絡

OpenAI 已封鎖五個被伊朗相關影響力行動 STORM-2035 與 IUVM 用於在多語言與多平台上產生親伊朗與親哈馬斯內容的 ChatGPT 帳號。

6605

OpenAI 打擊針對加納選舉的隱蔽影響行動

OpenAI 封禁了一批由名為 DigitSol 的商業實體使用的 ChatGPT 帳號,這些帳號在加納總統選舉期間為隱蔽影響行動產生支持 Bawumia、反對 Mahama 的內容。

6606

OpenAI 破壞 AI 輔助任務詐騙網路

OpenAI 已封禁一批由柬埔寨基地的網路使用的 ChatGPT 帳號,該網路透過 AI 驅動的翻譯與社交工程協助「任務詐騙」。

6607

OpenAI 打擊 AI 輔助的欺詐就業計畫

OpenAI 封禁了數十個用於欺詐就業計畫的帳號,該計畫利用 AI 製造求職申請、進行面試以及執行工作任務,與被歸因於北韓國家行動的 TTP 相符。

6608

OpenAI 行動 同儕審查:破壞 AI 輔助的監控規劃

OpenAI 封禁了一批可能源自中國的 ChatGPT 帳號,這些帳號利用 AI 協助研究政治人物、分析抗議文件以及開發監控工具。

6609

OpenAI o3-mini 系統卡

OpenAI 發布了 o3-mini 系統卡,詳細說明大規模強化學習和思維鏈推理如何使模型在安全性能上達到最先進水準,並在 Preparedness Framework 下獲得中等風險分類。

6610

OpenAI o3-mini 發佈說明 / 新功能介紹

OpenAI 已發佈 o3-mini,這是一款針對 STEM 優化的高成本效益推理模型,在數學、程式設計與科學方面的性能可與 o1 媲美,同時具備更低的延遲與更廣泛的開發者功能。

6611

Mini-R1: 透過 GRPO 和倒數遊戲重現 DeepSeek-R1 推理

Hugging Face 展示了如何透過在 Countdown Game 上使用 Group Relative Policy Optimization (GRPO) 訓練 Qwen2.5-3B 模型來重現 DeepSeek-R1 的 'aha moment'(自我修正與推理)。

6612

Hugging Face 藝術 AI 工具通訊第 1 期

Hugging Face 推出了每月一次的通訊,詳細介紹開源創意 AI 的現狀,重點介紹 2024 年向擴散 Transformer 的轉型,以及高品質開源影片與音訊模型的出現。

6613

OpenAI 與美國國家實驗室合作夥伴關係

OpenAI 已與美國國家實驗室建立合作關係,在 Venado 超級電腦上部署推理模型,以加速科學研究並強化國家安全。

6614

如何在 AWS 上部署與微調 DeepSeek R1 模型

Hugging Face 展示了如何使用 Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、Amazon SageMaker AI(GPU 與 Neuron 實例)以及搭配 Hugging Face Neuron Deep Learning AMI 的 EC2 Neuron,在 AWS 上部署與微調 DeepSeek R1 及其蒸餾版本。

6615

Qwen2.5-Max 發布說明

Qwen 已發布 Qwen2.5-Max,一種在超過 20 兆個標記上預訓練的大規模混合專家 (MoE) 模型,可透過 API 和 Qwen Chat 使用。

6616

Open-R1: 完全開放的 DeepSeek-R1 重現

Hugging Face 已啟動 Open-R1 項目,以系統地重建 DeepSeek-R1 的數據和訓練管道,旨在為開源社區提供缺失的推理模型數據和程式碼。

6617

Hugging Face 推理提供者整合

Hugging Face 已將四個無伺服器推理提供者——fal、Replicate、SambaNova 和 Together AI——直接整合到 Hub 中,以提供統一、以模型為中心的無伺服器推理。

6618

Diffusers 中開放視訊生成模型的現狀

Hugging Face 提供開放視訊生成模型的全面概述,並介紹了一套 Diffusers 優化方案,可將 HunyuanVideo 等模型的顯存需求從 60GB 減少至約 6.5GB。

6619

Qwen2.5-1M 發布:開源 7B 與 14B 模型,支援 1M‑Token 上下文並基於 vLLM 的推理框架

Qwen 發布開源的 Qwen2.5‑7B‑Instruct‑1M 與 Qwen2.5‑14B‑Instruct‑1M 模型,支援多達 1 百萬 token 的上下文,並附帶一個經過優化的基於 vLLM 的推理框架,該框架可使預填充速度提升 3×–7×,同時保持與 GPT‑4o‑mini 相當的短任務表現。

6620

Qwen2.5-VL 版本說明

Qwen 已發布 Qwen2.5-VL,這是一種旗艦視覺語言模型,提供 3B、7B 和 72B 三種規模,引入了先進的視覺代理能力、長視頻理解和結構化文檔解析。

6621

smolagents 視覺支援更新

Hugging Face 已為 smolagents 添加了原生視覺支援,使得在代理管道中可以使用視覺語言模型(VLMs)來執行如自主網頁瀏覽等任務。

6622

OpenAI Operator 研究預覽

OpenAI 已推出 Operator,這是一種由 Computer-Using Agent (CUA) 模型驅動的 AI 代理研究預覽,能夠獨立導航網頁瀏覽器以執行如填寫表單和訂購雜貨等任務。

6623

OpenAI Computer-Using Agent (CUA) 與 Operator 研究預覽

OpenAI 已推出 Computer-Using Agent (CUA),該模型能透過螢幕、滑鼠和鍵盤的通用介面與 GUI 互動以執行數位任務,現在可透過 Operator 以研究預覽形式使用。

6624

OpenAI Operator 系統卡

OpenAI 已推出 Operator,一種 Computer-Using Agent (CUA) 模型的研究預覽版,能與圖形使用者介面 (GUI) 互動,代表使用者執行任務,並以多層次安全框架支援,以降低如提示注入和模型錯誤等風險。

6625

NVIDIA KVPress:長上下文 LLMs 的 KV 壓縮工具箱

NVIDIA 已發布 KVPress,這是一個 Python 工具箱,實現了最先進的 KV 快取壓縮技術,以減少長上下文大型語言模型的記憶體佔用並提升解碼速度。

6626

SmolVLM 256M 與 500M 發布說明

Hugging Face 推出 SmolVLM-256M 與 SmolVLM-500M,提供高效能的視覺語言模型,在參數數量顯著減少的情況下仍能保持強大的多模態性能。

6627

Bertelsmann 與 OpenAI 合作進行企業級 AI 整合

Bertelsmann 正在將 OpenAI 技術和 ChatGPT Enterprise 整合到其全球媒體、服務和教育品牌中,以大規模提升創造力、生產力和產品開發。

6628

用推理時間運算換取對抗性穩健性

OpenAI 研究表明,在 o1-preview 和 o1-mini 等推理模型中增加推理時間運算能提升其對多種對抗性攻擊的穩健性。

6629

Hugging Face 與 FriendliAI 合作進行模型部署

Hugging Face 已將 FriendliAI 的推理基礎設施整合到 Hugging Face Hub,啟用一鍵部署生成式 AI 模型到高效能端點。

6630

OpenAI Stargate 基礎設施 倡議

OpenAI 正尋求與美國本土的數據中心基礎設施公司合作,以開發其下一代 AI 系統所需的實體容量。

6631

OpenAI 宣布 The Stargate Project

OpenAI 與其合作夥伴已啟動 The Stargate Project,一項 5000 億美元的計畫,旨在在美国建立龐大的 AI 基礎設施,以支援 AGI 的發展。

6632

Hugging Face 組織部落格文章功能

Hugging Face 現在允許已訂閱 Enterprise Hub 的組織直接在其組織個人資料頁發布部落格文章。

6633

Qwen 用於 MoE LLM 訓練的 Global-Batch 負載平衡

Qwen 引入了一種 global-batch 負載平衡損失,透過在整個 global batch 而非單個 micro-batches 上計算平衡,來提升 MoE 模型的性能並實現專家專業化。

6634

Hugging Face Text Generation Inference (TGI) 多後端支援

Hugging Face 已為 Text Generation Inference (TGI) 引入多後端架構,允許使用者透過統一前端利用如 TensorRT-LLM 和 vLLM 等各種執行引擎部署 LLM。

6635

Hugging Face Transformers timm 整合

Hugging Face 已推出 TimmWrapper,使得 PyTorch Image Models (timm) 庫中的任何模型都能在 transformers 生態系統中無縫用於推理、量化和微調。

6636

OpenAI 新聞產業合作夥伴與 Axios 擴張

OpenAI 已宣布與 Axios 建立新的內容合作夥伴關係,並擴大對地方新聞的資金支持,同時詳細說明近 20 家媒體組織如何整合 AI 以簡化製作、提升使用者參與度並優化業務運營。

6637

使用 Sentence Transformers 訓練速度快 400 倍的靜態嵌入模型

Hugging Face 推出了一種訓練靜態嵌入模型的方法,這些模型在 CPU 上的運行速度快 100x–400x,同時能保留如 all‑mpnet‑base‑v2 等模型至少 85% 的品質,並發布了兩個模型(static‑retrieval‑mrl‑en‑v1 和 static‑similarity‑mrl‑multilingual‑v1)以及訓練腳本和評估結果。

6638

Adebayo Ogunlesi 加入 OpenAI 董事會

Adebayo Ogunlesi,Global Infrastructure Partners 首席執行官兼 BlackRock 高級董事總經理,已加入 OpenAI 董事會,以提供基礎設施投資與全球市場策略方面的專業知識。

6639

Qwen2.5-Math-PRM 與 ProcessBench 發布

Qwen 發布了 Qwen2.5-Math-PRM-7B 和 72B,這些是最先進的 Process Reward Model,旨在識別數學問題解決過程中的中間推理錯誤,並附帶 ProcessBench,一個新的步驟級評估基準。

6640

Hugging Face AI 代理人倫理與框架分析

Hugging Face 提供了一個全面的框架來理解 AI 代理人,主張風險隨著自主性增加而上升,並建議不要開發完全自主的 AI 代理人。

6641

Hugging Face 發布 vdr-2b-multi-v1 多語言視覺文檔檢索模型

Hugging Face 已推出 vdr-2b-multi-v1,一種多語言嵌入模型,用於視覺文檔檢索,透過將頁面截圖編碼為密集向量,使得無需 OCR 即可搜索複雜文檔。

6642

Hugging Face Open LLM Leaderboard:CO₂ 排放與模型性能分析

Hugging Face 揭露,由於簡潔度提高和指令遵循能力的增強,社群微調模型通常比官方版本展現出更高的碳效率。

6643

Hugging Face smolagents 發布

Hugging Face 已推出 smolagents,一個輕量級庫,使 LLMs 能透過以可執行程式碼而非 JSON 的形式撰寫動作來執行複雜任務,從而提升組合性和通用性。

6644

OpenAI 公司結構演變

OpenAI 計畫將其營利部門轉變為特拉華州公共利益公司,以更好地吸引資本並維持其非營利使命,確保通用人工智慧(AGI)造福全人類。

6645

QVQ-72B-Preview 發布

Qwen 已發布 QVQ-72B-Preview,這是一個基於 Qwen2-VL-72B 的開放權重多模態推理模型,在 MMMU 基準測試中達到 70.3 分。

6646

在 PyTorch 中視覺化並理解 GPU 記憶體 – Hugging Face Blog 摘要

Hugging Face 的部落格文章解釋了如何使用 torch.cuda.memory 工具在 PyTorch 中視覺化 GPU 記憶體使用情況,分解了模型訓練期間的記憶體組成,並提供了估算總記憶體需求的公式。

6647

NVIDIA LogitsProcessorZoo:使用模組化 Logits 處理器控制語言模型生成

NVIDIA 的 LogitsProcessorZoo 為 Hugging Face Transformers 提供模組化 Logits 處理器,讓開發者可以控制生成長度、強制包含短語、引用提示內容,並將輸出限制為多選題選項。

6648

審議式對齊:推理使語言模型更安全

OpenAI 提出審議式對齊,這是一種訓練範式,教導 o‑series 模型對顯式安全規格進行推理,從而提升安全性,並相較於先前模型減少欠拒絕與過度拒絕。

6649

Big Bench Audio 發布

Artificial Analysis 已發布 Big Bench Audio,這是一個包含 1,000 個音訊問題的資料集,旨在評估音訊語言模型的推理能力,揭示了文字與語音推理之間的顯著效能差距。

6650

ModernBERT 發布說明

Hugging Face、Answer.AI 與 LightOn 已發布 ModernBERT,這是一個最先進的僅編碼器模型家族,提升了 BERT 的速度、準確度以及將上下文長度擴展至 8,192 個標記。