✷ 封存 · 11 個實驗室 · 3,059 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Ollama 上的 IBM Granite 3.0 模型
IBM Granite 3.0 模型(包括 Dense 與 Mixture of Experts (MoE) 版本)現在已在 Ollama 上以 Apache 2.0 授權提供。
Anthropic 前沿模型破壞行為評估
Anthropic 推出了一套全新的破壞行為評估框架,用以檢測 AI 模型是否會誤導使用者、植入隱藏的錯誤、隱藏能力,或破壞監督系統。
Mistral AI 發佈 Ministral 3B 與 8B 邊緣模型
Mistral AI 推出了 Ministral 3B 與 8B,這兩款頂尖的邊緣模型專為裝置端運算、低延遲代理工作流以及隱私優先的本地推理而設計。
Hugging Face Transformers 梯度累積修正
Hugging Face 已更新 Transformers Trainer,透過修正批次間損失的平均方式,確保梯度累積在數學上等同於完整批次訓練。
Anthropic 推出使用字典學習的特徵分類器
Anthropic 的可解釋性團隊宣布了使用字典學習特徵作為分類器的初步實驗,為微調後的語言模型提供了一個快速且具可解釋性的替代方案。
OpenAI 評估 ChatGPT 公平性的研究摘要
OpenAI 的研究發現,基於名稱的有害刻板印象出現在不到 0.1% 的 ChatGPT 回應中,且整體答案品質在性別與種族名稱提示下保持一致。
Anthropic 負責任縮放政策更新
Anthropic 更新了其負責任縮放政策 (RSP),引入了更具彈性的風險治理框架,並包含特定的開發能力閾值與成比例的 AI 安全等級 (ASL) 標準。
OpenAI MLE-bench:評估機器學習工程中的機器學習代理
OpenAI 推出 MLE-bench,這是一個使用 75 場 Kaggle 競賽來衡量 AI 代理機器學習工程能力的基準測試,其中 o1-preview 在 16.9% 的任務中達到銅牌水平。
Gradio 5 安全審查
Hugging Face 與 Trail of Bits 合作,對 Gradio 5 進行了全面的安全審計,修復了所有已識別的漏洞,確保機器學習應用程式在預設情況下即安全。
AMD EPYC Turin CPU 在 Genoa 之上提供 2× LLM 推理吞吐量
AMD 第五代 EPYC Turin CPU 的 LLM 推理吞吐量大約是 Genoa 的兩倍,為 Hugging Face 工作負載帶來更低的延遲和更高的吞吐量。
使用 Hugging Face 與 Dask 擴展 AI 資料處理規模
Hugging Face 與 Dask 讓 AI 資料處理能從小規模本地樣本擴展至數億筆資料,透過分散式運算與多 GPU 並行推論實現。
Gradio 5 版本說明
Hugging Face 已發布 Gradio 5,這是一個可直接投入生產的框架,用於使用 Python 建構高效、可擴展且安全的機器學習 Web 應用程式。
OpenAI 與 Hearst 內容合作夥伴關係
OpenAI 與 Hearst 合作,將超過 20 個雜誌品牌與 40 多家報紙的內容整合至其 AI 產品(包括 ChatGPT),以提供使用者更可靠且具引用來源的新聞報導。
Hugging Face Transformers 4.45.0 動態投機解碼
Hugging Face 與 Intel Labs 在 Transformers 4.45.0 中引入了動態投機解碼,透過根據模型信心動態調整草稿 token 數量,使文字生成速度提升最高可達 2.7 倍。
Anthropic 美國選舉準備工作
Anthropic 已實施多層次的安全框架,包括使用政策更新、紅隊測試以及重定向至權威投票來源,以減輕 2024 年美國選舉期間 AI 被誤用的風險。
在 Hugging Face Hub 上改進 Parquet 去重
Hugging Face 正在優化其儲存架構以提升 Parquet 檔案的去重效能,並提出內容定義的列群組,以減少資料集更新時的儲存開銷。
Open FinLLM Leaderboard 發布 – 全面零樣本金融語言模型基準測試
Hugging Face 推出了 Open FinLLM Leaderboard,這是一個零樣本基準,涵蓋七大類別的 40 項金融專屬任務,用於評估大型語言模型在真實金融應用中的就緒程度。
OpenAI Canvas 測試版發布:協作寫作與程式編碼介面 for ChatGPT
OpenAI 推出 Canvas,一個測試版介面,讓 ChatGPT 能在寫作與程式編碼專案中進行協作,具備行內編輯、版本控制與專屬快捷鍵,最初向 Plus 與 Team 用戶開放。
OpenAI 建立 $4 Billion 信用額度以提升財務彈性
OpenAI 已與全球銀行聯盟建立了 $4 billion 的循環信用額度,以提升流動性並支援 AI 研究與基礎設施的擴張。
中國 AI 全球擴張分析
中國 AI 公司因國內市場飽和、激烈的價格戰與監管壓力,加速國際擴張,目標包括東南亞、中東以及西方消費者市場。
OpenAI 資金公告 2024年10月
OpenAI 以 1,570 億美元的後資金估值籌得 66 億美元的新資金,以加速前沿 AI 研究並提升運算能力。
OpenAI 即時 API 發佈
OpenAI 已在公開測試中推出即時 API,使開發者能夠使用 GPT-4o 建構低延遲、多模態的語音對語音體驗。
GPT-4o 視覺微調 API 發佈
OpenAI 推出了 GPT-4o 的視覺微調功能,讓開發者能夠使用圖文資料集自訂模型,以提升專業的視覺理解與物件偵測能力。
OpenAI 提示快取 API 發佈
OpenAI 為 GPT-4o、GPT-4o mini、o1-preview 與 o1-mini 推出提示快取功能,提供 50% 的折扣並降低重複使用輸入代幣的延遲。
OpenAI 模型蒸餾 API 整合
OpenAI 推出了整合式模型蒸餾套件,讓開發者能使用前沿模型(如 o1-preview 與 GPT-4o)的輸出,對較小的模型(如 GPT-4o mini)進行微調,提升其效能。
OpenAI 與 Altera:使用 GPT-4o 創造協作式數位人類
Altera 開發了自主 AI 代理人,稱為數位人類,能在如 Minecraft 等環境中與人協作,採用受大腦啟發且以 GPT-4o 為動力的架構。
BenCzechMark:針對捷克語 LLM 的全面評估套件
Hugging Face 與學術合作夥伴發布了 BenCzechMark,這是首個針對捷克語模型的全面評估套件,包含 9 個類別的 50 項任務,並採用新穎的對決式計分機制。
OpenAI 阻斷與伊朗相關的 STORM-0817 惡意軟體活動
OpenAI 已停用伊朗基地威脅行動者 STORM-0817 用於開發 Android 惡意軟體、抓取 Instagram 個人檔案,以及對巴基斯坦資安專業人員進行偵查的帳號。
OpenAI 打擊 SweetSpecter 與中國相關的網路活動
OpenAI 識別並封禁了與中國籍對手 SweetSpecter 相關的帳號,該對手企圖利用 ChatGPT 進行攻擊性網路行動,並以魚叉式網路釣魚攻擊針對 OpenAI 員工。
OpenAI 調查:偽造俄羅斯巨魔錯誤訊息騙局
OpenAI 已揭穿一則聲稱揭露俄羅斯巨魔帳號 GPT-4o 錯誤訊息的病毒貼文,指出此事件是一個可能源自美國的人工製作騙局。
OpenAI 破壞 CyberAv3ngers 伊朗關聯的網路研究活動
OpenAI 已封鎖與伊朗關聯的威脅行動者 CyberAv3ngers 相關的帳號,該組織使用 LLM 進行偵查、程式除錯與針對工業控制系統的漏洞研究。
OpenAI 破壞「Stop News」俄羅斯影響行動
OpenAI 封禁了一批由俄羅斯發源的影響行動「Stop News」所使用的 ChatGPT 帳號,該行動利用 AI 生成的文字與圖像冒充新聞媒體,並建立欺騙性的合作夥伴關係。
OpenAI 打斷 Operation A2Z 多語言影響活動
OpenAI 封鎖了一批使用其 API 執行多語言影響行動的帳號,該行動被稱為 Operation A2Z,利用 AI 管理虛假人物並在 X 與 Facebook 上產生政治內容。
OpenAI 打擊 Bet Bot 賭博垃圾訊息網路
OpenAI 封禁了一批透過以色列新創公司使用其 API 在 X 上運作的賭博垃圾訊息網路帳號,利用 AI 生成的虛擬人物誘導使用者前往賭博網站。
OpenAI 破壞 STORM-2035 伊朗影響行動
OpenAI 封禁了伊朗來源的行動者(稱為 Storm-2035)所使用的 ChatGPT 帳號,該帳號用於生成針對美國選舉及其他全球政治議題的欺騙性長篇文章與社群媒體評論。
OpenAI 破壞盧旺達選舉政治評論網路
OpenAI 封禁了在盧旺達使用的 ChatGPT 帳號網路,該網路用於生成黨派選舉內容,並試圖透過大量評論垃圾訊息操縱 X 趨勢。
OpenAI Tort 報告:阻止濫用舉報活動
OpenAI 封禁了參與「Tort Report」的帳號,該行動屬於類別 1 的影響作業,利用 AI 生成針對 Facebook 與 YouTube 上獨立越南媒體的通用舉報。
OpenAI 打斷「腐敗評論」影響行動
OpenAI 封禁了一批用於在 X 上生成英語評論、針對反腐基金會及阿列克謝·納瓦爾尼(Alexei Navalny)關係人的 API 活動。
Anthropic Circuits Updates September 2024
Anthropic 2024 年 9 月的 Circuits 更新提供了關於多智能體系統故障、勞工再培訓計劃證據以及研究版 Claude 在 Riemann zeta function 上的進展的初步研究。
將頂點著色網格轉換為貼圖網格
Hugging Face 推出了一種方法和 InstantTexture 函式庫,用於將頂點著色的 3D 網格轉換為 UV 映射的貼圖網格,以提升應用程式相容性。
OpenAI 審核 API 更新:omni-moderation-latest 模型發布
OpenAI 已發布 omni-moderation-latest,一個基於 GPT-4o 的多模態審核模型,提升了文字與影像的有害內容偵測準確度,尤其在非英語語言上表現更佳。
明尼蘇達州企業翻譯辦公室 ChatGPT 整合
明尼蘇達州企業翻譯辦公室已整合 ChatGPT,以加速政府翻譯服務,將交付時間從數週縮短至 48 小時以下,且每月節省超過 10 萬美元。
OpenAI 與 GEDI 的意大利新聞內容策略夥伴關係
OpenAI 與 GEDI 合作,將來自《La Repubblica》和《La Stampa》等出版物的高品質意大利語新聞內容整合至 ChatGPT 與 SearchGPT。
Llama 3.2 發行說明:多模態視覺與裝置端小型語言模型
Meta 已發布 Llama 3.2,推出 11B 與 90B 兩種規模的多模態視覺功能,以及針對裝置端部署優化的輕量級 1B 與 3B 純文字模型。
Ollama 中的 Llama 3.2 支援
Ollama 現在支援 Meta 的 Llama 3.2,推出了適用於邊緣裝置的輕量級 1B 和 3B 僅限文本模型,以及即將推出的 11B 和 90B 視覺能力模型。
Mercado Libre Verdi AI 開發平台發布
Mercado Libre 推出 Verdi,一個基於 GPT‑4o 的 AI 開發平台,讓其開發者打造安全且自主的 LLM 應用,首個案例為處理 10% 爭議的 AI 客服調解。
Hugging Face 每日論文功能指南
Hugging Face 的每日論文頁面提供了一個由社群策展的 AI 研究中心,具備作者認領、論文提交以及研究人員與開發者之間直接互動的工具。
FineVideo 資料集發布
Hugging Face 已發布 FineVideo,一個高品質的開放影片資料集,包含 43,000 部影片(3,400 小時),具備豐富且結構化的標註,用於影片理解與生成式 AI 訓練。
使用 Optimum-Intel 與 OpenVINO GenAI 優化與部署 Hugging Face 模型
Hugging Face 與 Intel 提供了一個簡化的工作流程,利用 Optimum-Intel 與 OpenVINO GenAI 在 Intel 硬體上優化與部署 Transformers 模型,特別針對邊緣與客戶端的 C++ 與 Python 環境。
Genmab「AI Everywhere」推廣:企業級 ChatGPT 擴展與 100 多個客製化 GPT 用於生技
Genmab 將 ChatGPT Enterprise 擴展至超過 2,000 名員工,並部署了 100 多個客製化 GPT,使每位使用者每週節省 3.5 小時,並加速生技研究與文件撰寫。