OpenAI 破壞 STORM-2035 伊朗影響行動
OpenAI 封禁了伊朗來源的行動者(稱為 Storm-2035)所使用的 ChatGPT 帳號,該帳號用於生成針對美國選舉及其他全球政治議題的欺騙性長篇文章與社群媒體評論。
OpenAI 破壞盧旺達選舉政治評論網路
OpenAI 封禁了在盧旺達使用的 ChatGPT 帳號網路,該網路用於生成黨派選舉內容,並試圖透過大量評論垃圾訊息操縱 X 趨勢。
OpenAI Tort 報告:阻止濫用舉報活動
OpenAI 封禁了參與「Tort Report」的帳號,該行動屬於類別 1 的影響作業,利用 AI 生成針對 Facebook 與 YouTube 上獨立越南媒體的通用舉報。
OpenAI 打斷「腐敗評論」影響行動
OpenAI 封禁了一批用於在 X 上生成英語評論、針對反腐基金會及阿列克謝·納瓦爾尼(Alexei Navalny)關係人的 API 活動。
將頂點著色網格轉換為貼圖網格
Hugging Face 推出了一種方法和 InstantTexture 函式庫,用於將頂點著色的 3D 網格轉換為 UV 映射的貼圖網格,以提升應用程式相容性。
OpenAI 審核 API 更新:omni-moderation-latest 模型發布
OpenAI 已發布 omni-moderation-latest,一個基於 GPT-4o 的多模態審核模型,提升了文字與影像的有害內容偵測準確度,尤其在非英語語言上表現更佳。
明尼蘇達州企業翻譯辦公室 ChatGPT 整合
明尼蘇達州企業翻譯辦公室已整合 ChatGPT,以加速政府翻譯服務,將交付時間從數週縮短至 48 小時以下,且每月節省超過 10 萬美元。
OpenAI 與 GEDI 的意大利新聞內容策略夥伴關係
OpenAI 與 GEDI 合作,將來自《La Repubblica》和《La Stampa》等出版物的高品質意大利語新聞內容整合至 ChatGPT 與 SearchGPT。
Llama 3.2 發行說明:多模態視覺與裝置端小型語言模型
Meta 已發布 Llama 3.2,推出 11B 與 90B 兩種規模的多模態視覺功能,以及針對裝置端部署優化的輕量級 1B 與 3B 純文字模型。
Mercado Libre Verdi AI 開發平台發布
Mercado Libre 推出 Verdi,一個基於 GPT‑4o 的 AI 開發平台,讓其開發者打造安全且自主的 LLM 應用,首個案例為處理 10% 爭議的 AI 客服調解。
Hugging Face 每日論文功能指南
Hugging Face 的每日論文頁面提供了一個由社群策展的 AI 研究中心,具備作者認領、論文提交以及研究人員與開發者之間直接互動的工具。
FineVideo 資料集發布
Hugging Face 已發布 FineVideo,一個高品質的開放影片資料集,包含 43,000 部影片(3,400 小時),具備豐富且結構化的標註,用於影片理解與生成式 AI 訓練。
使用 Optimum-Intel 與 OpenVINO GenAI 優化與部署 Hugging Face 模型
Hugging Face 與 Intel 提供了一個簡化的工作流程,利用 Optimum-Intel 與 OpenVINO GenAI 在 Intel 硬體上優化與部署 Transformers 模型,特別針對邊緣與客戶端的 C++ 與 Python 環境。
Genmab「AI Everywhere」推廣:企業級 ChatGPT 擴展與 100 多個客製化 GPT 用於生技
Genmab 將 ChatGPT Enterprise 擴展至超過 2,000 名員工,並部署了 100 多個客製化 GPT,使每位使用者每週節省 3.5 小時,並加速生技研究與文件撰寫。
Qwen2.5 版本說明:全新基礎模型、Coder 與 Math 模型
Qwen 已發布 Qwen2.5,這是一套完整的開放權重密集解碼器僅模型,涵蓋通用大型語言模型、專門的 Coder 與 Math 變體,以及更新的 Qwen2-VL-72B。
Qwen2.5 LLM 系列發布
Qwen 宣佈了 Qwen2.5 系列——開源的僅解碼器 LLM,參數從 0.5B 到 72B,能力是 Qwen2 的兩倍,並加入了更大的 18 兆 token 資料集,在知識、程式碼、數學與對齊方面取得重大提升,且支援 128K token 的上下文窗口。
Qwen2.5-Coder 版本說明
Qwen 已發布 Qwen2.5-Coder,一系列在 5.5 兆 token 上訓練的開源程式碼模型,在程式碼生成、推理與數學方面優於更大的模型。
Qwen2.5-Math 版本說明
Qwen 已發布 Qwen2.5-Math,一系列支援雙語推理與工具整合推理(TIR)的開源數學大型語言模型,於複雜數學基準測試上超越領先的封閉源模型。
微調 LLM 至 1.58 位元:使用 BitNet 的極端量化
Hugging Face 展示了現有的 LLM(例如 Llama 3 8B)可以透過動態暖身量化策略微調至 1.58 位元三元精度,顯著降低記憶體與能源需求,同時保持強勁的效能。
Arco Educação 與 OpenAI 合作提升巴西教學
Arco Educação 正與 OpenAI 合作,實施基於 GPT-4 的工具,特別是「教師助理」,以減輕行政負擔,並為巴西多元學習需求的學生打造個人化課程計畫。
Hugging Face 資料集 SQL 主控台
Hugging Face 推出了基於瀏覽器的 SQL 主控台,使用 DuckDB WASM 作為引擎,使用者可以直接在 Hub 上查詢、篩選與轉換資料集,無需後端依賴。
OpenAI 安全與保安實踐更新
OpenAI 已成立一個獨立的董事會監督委員會,以治理模型開發與部署的關鍵安全與保安措施。
HuggingChat 社群工具發布
Hugging Face 在 HuggingChat 上推出了社群工具,讓使用者能將任何公開的 Hugging Face Space 整合為 LLM 可直接在聊天介面中使用的工具。
Accelerate 1.0.0 釋出候選版公告
Accelerate 1.0.0 釋出候選版加入 FP8、DeepSpeed 多模型、torch.compile 以及全新資料載入器/管線功能,同時穩定大規模訓練與推論的 API。
OpenAI o1-preview 版本說明 / 新功能
OpenAI 已發布 o1-preview 與 o1-mini,這是一系列新型推理模型,透過延長思考時間來解決科學、程式設計與數學等複雜問題。
OpenAI 學習以 LLM 進行推理
OpenAI 透過對複雜密碼解碼任務的詳細步驟說明,展示其最新模型的推理能力,說明解決該問題所需的逐步邏輯推進。
OpenAI o1-mini 發布說明
OpenAI 已發布 o1-mini,一款針對 STEM 任務進行成本效益優化的推理模型,提供比 o1-preview 更低的延遲與成本,同時在數學與程式設計方面保持高效能。
OpenAI o1 貢獻
OpenAI 已公布一份完整的內部與外部貢獻者名單,這些人員開發了 OpenAI o1 模型,並詳細說明了組織角色與安全領導層在其創建過程中的參與。
使用 OpenAI o1 進行程式設計
OpenAI o1 透過先進的推理能力,使使用者能夠編寫更複雜且更一致的程式碼,從而提升軟體開發效率。
OpenAI o1 與量子物理
OpenAI o1 是一個新系列的 AI 模型,旨在透過花更多時間思考的推理過程,解決科學、程式設計與數學中更具挑戰性的問題。
OpenAI o1 與經濟學
OpenAI o1 是一系列新型 AI 模型,旨在透過在回應前花更多時間思考,來推理科學、程式設計、數學與經濟學等複雜任務。
解碼遺傳學與 OpenAI o1
OpenAI o1 是一系列全新的 AI 模型,旨在於科學、程式設計與數學領域進行複雜推理,為像 Catherine Brownstein 這樣的遺傳學家提供管理基因組龐大複雜性的工具。
Ada 客戶服務自動化與 GPT-4
Ada 重新構建了其 AI 原生的客戶服務平台,使用 GPT-4,使解決率從 30% 翻倍至最高 60%(頂尖客戶更可超過 80%)。
Hugging Face 與 TruffleHog 秘密掃描合作夥伴關係
Hugging Face 與 Truffle Security 合作,將 TruffleHog 的秘密掃描功能整合至其自動化管線,並提供原生掃描器,讓使用者能主動掃描自己的帳戶資料。
Qwen2-VL 發布:開源 2B/7B 視覺語言模型與 72B API,具備最先進的圖像、影片與多語言能力
Qwen 發布了 Qwen2-VL,一個全新的視覺語言模型系列(2B、7B 開源、72B API),在圖像、文件、多語言以及長影片理解方面達到最先進的表現,同時支援視覺代理功能。
LeRobotDataset 影片編碼格式減少機器人資料集大小並加速訓練
Hugging Face 發布了 LeRobotDataset 影片編碼格式,將機器人視覺資料縮減至原始大小約 14 %,同時保持載入速度與訓練效能不變。
亞利桑那州立大學整合 ChatGPT Edu 以實現個人化教育
亞利桑那州立大學已在超過 200 個專案中部署 ChatGPT Edu,以個人化學習、推進研究,並提升 181,000 名學生的營運效率。
Hugging Face 部落格文章突顯五個被低估的 Hub 工具與免費語意搜尋案例
Hugging Face 宣布了五個被低估的 Hub 工具——ZeroGPU、多程序 Docker、Gradio API、webhooks 與 Nomic Atlas,並示範如何將它們結合成一個免費、可自動更新的 Reddit 資料語意搜尋應用。
Hugging Face 訓練效率:使用 Flash Attention 2 的打包
Hugging Face 引入了具備邊界感知的指令微調樣本打包,搭配 Flash Attention 2 使用時,可提升至 2 倍的訓練吞吐量並降低 20% 的峰值記憶體使用量。
OpenAI 與 Condé Nast 內容整合合作夥伴關係
OpenAI 與 Condé Nast 合作,將 Vogue、The New Yorker 等品牌的內容整合至 ChatGPT 與 SearchGPT 原型,以提升資訊發現與來源標註。
Upwork OpenAI 整合與 AI 為先策略
Upwork 已轉向以 OpenAI 為核心的生態系統,將 GPT-4o 與 GPT-3.5 整合至其市場功能、內部詐騙偵測以及透過 ChatGPT Enterprise 提升企業生產力。
OpenAI 推出 GPT‑4o 微調,提供免費代幣配額並宣布平台日落
OpenAI 推出 GPT‑4o 微調功能,使開發者能以最少資料自訂模型,並提供至 9 月 23 日的免費訓練代幣,同時宣布平台將於 2026 年 5 月 8 日後對新使用者關閉。
在 Google Cloud Vertex AI 上部署 Meta Llama 3.1 405B
Hugging Face 提供了一份指南,說明如何使用 Text Generation Inference (TGI) 與 A3 系列機器,在 Google Cloud Vertex AI 上以程式方式部署 Meta Llama 3.1 405B 的 FP8 量化版本。
OpenAI 破壞伊朗影響行動 Storm-2035
OpenAI 已封禁一批被伊朗影響行動 Storm-2035 用於在 2024 年美國大選及其他全球事件中生成政治內容的 ChatGPT 帳號。
Indeed 情境工作匹配與 OpenAI
Indeed 整合了 OpenAI 的 GPT 模型,為職位推薦提供個人化說明,從而使已開始的求職申請量提升了 20%,下游成功率提升了 13%。
OpenAI 與大都會藝術博物館合作:喚醒沉睡的美人
OpenAI 與大都會藝術博物館服裝學院合作,打造了一個 AI 驅動的聊天體驗,讓參觀者能夠與歷史人物 Natalie Potter 互動,該體驗基於精選的歷史資料集。
Hugging Face Infini-Attention 再現分析
Hugging Face 嘗試再現 Infini-Attention 的結果顯示,雖然門控收斂可以得到改善,但隨著記憶壓縮程度提升,方法的效能會下降,且仍不如 Ring Attention、YaRN 或 RoPE scaling 可靠。
OpenAI SWE-bench Verified 發布:人工驗證的基準提升軟體工程評估
OpenAI 發布了 SWE‑bench Verified,這是一個經過人工驗證的 500 個樣本子集,取自 SWE‑bench 軟體工程基準,去除了模糊的問題與不公平的測試,使得 AI 模型的程式編寫能力評估更為可靠;GPT‑4o 解決了其中 33.2% 的樣本,分數是原始基準的兩倍以上。
ggml 簡介
ggml 是一個輕量級的 C/C++ 機器學習函式庫,針對 Transformer 推論與多種硬體後端的裝置端大型語言模型執行進行了最佳化。
Hugging Face 統一工具使用 API
Hugging Face 推出了一個統一的工具使用 API,讓開發者能夠使用相同的程式碼在 Mistral、Cohere、NousResearch 與 Llama 模型上實作工具呼叫。