封存 · 11 個實驗室 · 3,059 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

2101

Qwen2-Math 發布說明

Qwen 已發布 Qwen2-Math,一系列專門的數學大型語言模型(1.5B、7B 與 72B),在數學基準測試中超越多個封閉源模型,包括 GPT-4o。

2102

Rakuten 與 OpenAI 合作夥伴關係:利用生成式 AI 獲取客戶洞見

Rakuten 正在利用 OpenAI 的 API、RAG 與 Code Interpreter,將非結構化資料轉換為自動化客服、評論摘要以及 B2B 市場洞見。

2103

Mistral AI 模型自定義與 Agents 發佈

Mistral AI 為包括 Mistral Large 2 與 Codestral 在內的旗艦模型推出了模型自定義功能,同時發佈了 Agents 的 Alpha 版本以及其客戶端 SDK 的穩定 1.0 版本。

2104

OpenAI 結構化輸出 API 功能公告

OpenAI 於 2024 年 8 月 6 日推出了結構化輸出,這是一項新的 API 功能,可保證模型回應完全符合開發者提供的 JSON Schema,提升資料導向應用的可靠性。

2105

Hugging Face TextImage Augmentation 管線發布

Hugging Face 與 Albumentations AI 推出了 TextImage Augmentation 管線,該管線同步修改文件圖像及其文字,實現真實的合成資料生成,並在有限的文件資料集上對視覺‑語言模型進行穩健的微調。

2106

Hugging Face 2024 安全功能亮點

Hugging Face 詳細說明了 2024 年的安全全景,為所有使用者推出一套預設防護,並為 Enterprise Hub 使用者提供進階治理控制。

2107

Claude AI 在巴西的可用性

Anthropic 透過網頁、行動應用程式和 API,將其 AI 助手 Claude 的可用性擴展至巴西的消費者和企業。

2108

Google 發布 Gemma 2 2B、ShieldGemma 與 Gemma Scope

Google 發布了 Gemma 2 2B、ShieldGemma 安全分類器以及 Gemma Scope 稀疏自編碼器,擴展了開源大型語言模型的功能、審核工具與可解釋性資源。

2109

Anthropic Circuits Updates July 2024

Anthropic 在 2024 年 7 月發布了一系列初步研究更新,重點關注可解釋性、多智能體系統故障以及在尚未發布的 Claude 研究版本中的數學突破。

2110

Quanto 量化減少 Transformer 擴散管線的記憶體使用

Hugging Face 的量化工具(Quanto)將 Transformer 擴散模型的 GPU 記憶體需求從約 12 GB 降至約 5 GB,且僅帶來極小的延遲與品質影響。

2111

Hugging Face NVIDIA NIM API(無伺服器)發布與停用

Hugging Face 為 Enterprise Hub 用戶推出了 NVIDIA NIM API(無伺服器),提供即付即用、無伺服器的開源大型語言模型(LLM)推論服務,透過 OpenAI 相容的 API 在 NVIDIA DGX Cloud H100 GPU 上執行。

2112

LAVE:使用 LLM 在 Docmatix 上的零樣本 VQA 評估

Hugging Face 推出 LAVE(LLM 輔助 VQA 評估),以解決傳統 VQA 指標的僵硬問題,並在 Docmatix 資料集上評估零樣本表現時,展示出 50% 的準確率提升。

2113

OpenAI SearchGPT 原型公告

OpenAI 推出了 SearchGPT,一個結合 AI 模型與即時網路資訊的臨時原型,提供帶有清晰來源引用的直接答案。

2114

Ollama 工具支援發佈

Ollama 已為 Llama 3.1 等模型引入了工具呼叫支援,讓本地 LLM 能夠與外部 API、函數和程式碼解釋器進行互動。

2115

Mistral Large 2 發佈說明 / 有什麼新功能

Mistral AI 已發佈 Mistral Large 2,這是一個擁有 123B 參數的模型,旨在實現高吞吐量單節點推理,並在程式碼編寫、推理和多語言能力方面具有競爭力的性能。

2116

OpenAI 基於規則的獎勵(RBR)模型安全

OpenAI 推出了基於規則的獎勵(RBR),這是一種使用明確、逐步規則來對齊 AI 安全行為的方法,無需大量的人類資料收集。

2117

Llama 3.1 版本說明:多語言支援、長上下文與 405B 模型

Meta 已發布 Llama 3.1,提供 8B、70B 與 405B 大小的模型,具備 128K 上下文長度、支援 8 種語言的多語言功能,且採用寬鬆授權允許合成資料生成。

2118

在 Core ML 上執行 Mistral 7B

Hugging Face 示範了如何在 Mac 上使用 WWDC 24 推出的新 Core ML 功能執行 Mistral 7B,並透過 4 位元區塊式量化將模型大小縮減至低於 4GB。

2119

GPT-4o mini 發布說明 / 有什麼新功能

OpenAI 已發布 GPT-4o mini,一款高度成本效益的小型模型,在關鍵推理與多模態基準測試中超越 GPT-3.5 Turbo 及其他小型模型。

2120

Mistral NeMo 發布說明

Mistral AI 與 NVIDIA 推出 Mistral NeMo,這是一款擁有 128k 上下文視窗、並搭配全新高效多語言分詞器 Tekken 的 12B 參數模型。

2121

Docmatix 資料集發布

Hugging Face 已發布 Docmatix,一個文件視覺問答(DocVQA)資料集,包含 240 萬張影像與 950 萬組問答對,規模較先前資料集提升了 240 倍。

2122

TGI Multi-LoRA:一次部署,服務 30 個模型

Hugging Face 在文本生成推理(TGI)中引入了 Multi-LoRA 服務,使組織能夠部署單一基礎模型,並動態提供數十個專門微調的適配器,以降低成本和營運複雜度。

2123

ChatGPT Enterprise 合規與管理工具更新

OpenAI 推出了合規 API、用於自動化使用者管理的 SCIM,以及細緻的 GPT 控制功能,協助企業客戶符合監管要求,安全擴展 AI 部署。

2124

OpenAI 證明者‑驗證者遊戲提升語言模型輸出的可讀性

OpenAI 宣布了一種證明者‑驗證者遊戲的訓練方法,使強大的語言模型能產生較弱模型可驗證的解答,從而提升正確性與人類可讀性。

2125

Anthropic 與 Menlo Ventures 推出 1 億美元的 Anthology Fund

Anthropic 與 Menlo Ventures 已推出 1 億美元的 Anthology Fund,以加速基礎設施、產業特定工具以及信任與安全領域的 AI 應用開發。

2126

Codestral Mamba 發行說明

Mistral AI 發布了 Codestral Mamba,這是一款採用 Mamba 架構的 7B 參數模型,提供線性時間推理與高效率的程式碼與推理能力。

2127

Mathstral 7B 發佈

Mistral AI 已發佈 Mathstral,這是一個與 Project Numina 合作開發、專門針對 STEM 學科和高階數學推理的 7B 參數模型。

2128

Argilla SDK 聊天機器人(使用 distilabel)– 端對端教學

Hugging Face 發布了一篇教學,說明如何使用 distilabel 產生的合成資料、微調的嵌入、lancedb 向量儲存,以及部署於 Spaces 的 Gradio 應用,打造 Argilla 2.0 聊天機器人。

2129

SmolLM 發布:高效能小型語言模型

Hugging Face 介紹 SmolLM,一個由最先進的小型語言模型(135M、360M 與 1.7B 參數)組成的系列,這些模型在精心策劃的高品質資料集上進行訓練。

2130

NuminaMath 7B TIR 榮獲 AIMO 進步獎 – 技術回顧

NuminaMath 7B TIR 透過解答 50 個隱藏數學問題中的 29 題,贏得了首屆 AIMO 進步獎,展示了兩階段微調方案、大規模高品質數學數據以及結合工具整合推理的自我一致性推理策略的威力。

2131

OpenAI 與洛斯阿拉莫斯國家實驗室生物科學研究合作夥伴關係

OpenAI 與洛斯阿拉莫斯國家實驗室合作,評估類似 GPT-4o 的多模態前沿 AI 模型如何在實驗室實體環境中安全協助科學家,推動生物科學研究的進展。

2132

Hugging Face PII 偵測實驗與 Presidio

Hugging Face 正在嘗試將 Microsoft Presidio 整合至 Dataset Hub,以提供自動化的 PII 偵測報告,協助實務者辨識並降低機器學習資料集中的隱私風險。

2133

TRL 為視覺語言模型新增 Direct Preference Optimization 支援

Hugging Face 在 TRL 函式庫中為視覺語言模型新增了 Direct Preference Optimization (DPO) 支援,讓開發者能透過 bfloat16 量化與 LoRA 技術,在單個 GPU 上使用偏好數據對 Idefics-2 等模型進行微調。

2134

Hugging Face 與 KerasHub 整合

Hugging Face 與 KerasHub 現在共享模型保存格式,讓 KerasHub 使用者能直接載入來自 Hugging Face Hub 超過 30 萬個 Transformers 庫模型。

2135

Google Cloud TPU 在 Hugging Face 推理端點與 Spaces 上的應用

Hugging Face 已將 Google Cloud TPU v5e 支援整合至 Inference Endpoints 與 Spaces,讓使用者能以具成本效益且高效能的硬體部署與擴展 AI 模型。

2136

Banque des Territoires、Polyconseil 與 Hugging Face 部署主權 RAG 解決方案以支援 EduRénov 計畫

Hugging Face、Polyconseil 與 Banque des Territoires 推出了一套主權、開源的 RAG 系統,以自動化法國 EduRénov 校園翻新計畫的電子郵件支援,確保資料居留,同時在公共政策領域擴展生成式 AI 的規模。

2137

Hugging Face Dataset Hub 搜尋功能更新

Hugging Face 已推出四個新的搜尋過濾器——模態、大小、格式和程式庫相容性——以提升 Dataset Hub 上超過 180,000 個公開資料集的可發現性。

2138

在 Intel Gaudi 2 上加速蛋白質語言模型 ProtST

Intel 與 MILA 已針對 Intel Gaudi 2 加速器優化了 ProtST 多模態蛋白質語言模型,實現了相較於 NVIDIA A100 GPU 高達 2.92 倍的微調加速。

2139

Hugging Face Transformers 代碼代理 GAIA 基準測試結果

Hugging Face 使用基於 transformers.agents 庫構建的代碼代理,在 GAIA 基準測試中取得了最高排名,證明了代碼式行動比基於 JSON 的工具調用更高效且更有效。

2140

Anthropic 第三方模型評估計畫

Anthropic 推出了資助計畫,旨在支持第三方組織開發高品質的評估工具,用以衡量 AI 模型的高階能力與安全風險。

2141

Anthropic Circuits Updates June 2024

Anthropic 2024 年 6 月的 Circuits 更新提供了關於可解釋性、多智能體系統故障以及黎曼 zeta function 數學能力的進展之初步研究結果。

2142

使用 GPT-4 找出 GPT-4 的錯誤

OpenAI 推出 CriticGPT,一個基於 GPT-4 的模型,旨在識別 ChatGPT 程式碼輸出中的錯誤,以協助人類訓練師在 RLHF 過程中工作。

2143

OpenAI 與 TIME 戰略內容合作夥伴關係

OpenAI 與 TIME 已簽訂多年期的戰略合作夥伴關係,將 TIME 百年新聞檔案整合至 OpenAI 產品,並為 TIME 提供 OpenAI 技術以開發產品。

2144

Google Gemma 2 版本說明

Google 已發布 Gemma 2,這是一個開放權重的大型語言模型(LLM)家族,提供 9B 與 27B 參數規模,具備蒸餾與注意力機制等技術創新以提升效能。

2145

Google Gemma 2 在 Ollama 上發布

Google Gemma 2 提供 2B、9B 與 27B 參數變體,於 Ollama 上發布,採用全新的架構,提供同級領先的性能與效率,表現優於規模更大的開源模型。

2146

Anthropic 擴大政府機構對 Claude 的存取權限

Anthropic 已將 Claude 3 Haiku 與 Claude 3 Sonnet 提供給美國情報界與 AWS GovCloud,透過安全且專業化的服務協議來支援政府任務。

2147

XLSCOUT ParaEmbed 2.0 發布

XLSCOUT 已發布 ParaEmbed 2.0,這是一個在專家策劃的專利資料上微調的專有嵌入模型,較 ParaEmbed 1.0 提升了 23% 的準確度。

2148

Anthropic 推出 Claude Projects 以實現協作式 AI 工作流程

Anthropic 為 Claude Pro 和 Team 用戶推出了 Projects,允許他們在 200K 的 context window 內,使用精選的知識集和自定義指令來組織對話。

2149

Hugging Face 倫理與社會通訊 #6:資料品質的重要性

Hugging Face 概述了一套全面且負責任的資料品質方法,強調高品質資料必須符合其預期用途,以確保 AI 模型效能、公平性以及科學可重現性。

2150

微調微軟 Florence-2 於 DocVQA

Hugging Face 示範了如何在 DocVQA 資料集上微調微軟的 Florence-2 視覺語言模型,於七個 epoch 後將驗證相似度從 0 提升至 57.0。