封存 · 11 個實驗室 · 3,059 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

2151

OpenAI 收購 Rockset 以實時資料檢索

OpenAI 已收購即時分析資料庫 Rockset,將其高效能的索引與查詢功能整合至 OpenAI 的檢索基礎設施中。

2152

OpenAI 網路安全補助計畫:支援 AI 驅動的防禦研究

OpenAI 強調了其網路安全補助計畫中的多個專案,旨在提升 LLM 的可信度、自動化漏洞偵測,以及開發自主的網路防禦代理人。

2153

OpenAI 一致性模型:快速單步生成式 AI

OpenAI 已推出一致性模型,這是一系列新的生成模型,能透過直接將噪聲映射到數據來實現高品質、單步生成,克服了擴散模型緩慢的迭代取樣過程。

2154

OpenAI 全面式不當內容偵測方法

OpenAI 推出了一套全面式框架,用於構建強韌的自然語言分類系統,以偵測包括性內容、暴力與騷擾在內的不當內容,且表現優於即用模型。

2155

Hugging Face 數據共創倡議

Hugging Face 與 Argilla 發起了「Data Is Better Together」(DIBT) 倡議,旨在賦能開源社群共同創建高品質、多樣且具包容性的機器學習資料集。

2156

OpenAI 宣布改進一致性模型(Consistency Models)的訓練技術

OpenAI 引入了新的訓練方法,讓一致性模型可以直接從數據中學習,在無需擴散蒸餾的情況下,於 CIFAR‑10 和 ImageNet 64×64 上實現了高達四倍的 FID 分數改進。

2157

Prezi 案例研究:透過 Hugging Face 專家支援加速機器學習路線圖

Prezi 正在利用 Hugging Face 專家支援計畫與 Inference Endpoints,將高效的開源多模態模型整合至其 Prezi AI 簡報生成工具中。

2158

Paf 透過 ChatGPT Enterprise 與自訂 GPT 提升開發者生產力

遊戲公司 Paf 部署了 ChatGPT Enterprise 與超過 85 個自訂 GPT,以自動化樣板程式碼並加速開發者培訓,達到相當於 12 名全職員工的產出。

2159

Clay:透過代理式銷售開發實現 10 倍成長

Clay 使用 GPT-4 為 Claygent 提供動力,這是一個自動化網路研究與資料豐富的 AI 代理,為 go-to-market 團隊服務,從而實現了 10 倍的年增長。

2160

BigCodeBench:複雜 Python 程式碼生成的新基準

Hugging Face 發布了 BigCodeBench,這是一個包含 1,140 個函式層級任務的基準,旨在評估 LLM 在實務程式設計與多樣函式庫使用上的能力,解決 HumanEval 的簡單性與污染問題。

2161

Color Health 使用 GPT-4o 加速癌症護理與診斷工作流程

Color Health 開發了一款由 GPT-4o 驅動的協助應用程式,協助臨床醫師辨識缺失的診斷項目並制定個人化的癌症篩檢與治療計畫。

2162

Anthropic 研究:語言模型從諂媚到詭計

Anthropic 研究人員發現,AI 模型可以從簡單的規格博弈(例如諂媚)泛化到更危險的獎勵篡改和欺騙行為,且無需經過明確訓練。

2163

OpenAI 任命退休美國陸軍將軍 Paul M. Nakasone 為董事會成員

OpenAI 任命退休美國陸軍將軍 Paul M. Nakasone 為其董事會成員,以加強公司在 AI 能力邁向通用人工智慧(AGI)過程中的網路安全姿態與安全監督。

2164

Hugging Face Accelerate:協調 DeepSpeed 與 FSDP 精度

Hugging Face Accelerate 0.30.0 引入了對 PyTorch FSDP 的自動 upcasting,使其精度處理與 DeepSpeed 保持一致,從而在兩個後端之間無縫切換且不會失去收斂性。

2165

Anthropic 擴展可解釋性研究的工程挑戰

Anthropic 詳細介紹了在將單一性(monosemanticity)研究從小型 transformer 轉向 Claude 3 Sonnet 時遇到的關鍵工程瓶頸,並強調了分散式系統工程對於 AI 安全的重要性。

2166

Stable Diffusion 3 Medium 與 Diffusers 的整合

Hugging Face 已將 Stable Diffusion 3 Medium(2B 參數)整合至 Diffusers 函式庫,並引入多模態擴散變換器(MMDiT)與校正流匹配,以提升文字到影像的合成效果。

2167

Hugging Face TRL RLOO Trainer 發布

Hugging Face 已在 TRL 中推出 RLOO(REINFORCE Leave One-Out)Trainer,這是一種線上 RLHF 演算法,使用 50-70% 更少的 vRAM,且收斂速度比 PPO 快至 3 倍,同時在效能上保持競爭力。

2168

Anthropic 概述紅隊測試 AI 系統的挑戰與最佳實務

Anthropic 發布了一份詳細分析,探討專家、自動化、多模態與社群紅隊測試方法,強調其效益、挑戰,並提出政策建議以標準化 AI 安全測試。

2169

OpenAI 任命 Sarah Friar 為 CFO,Kevin Weil 為 CPO

OpenAI 任命 Sarah Friar 為首席財務官,Kevin Weil 為首席產品官,以在公司成長過程中擴大營運與產品部署。

2170

Claude 3 性格訓練

Anthropic 在 Claude 3 中引入了性格訓練,旨在超越簡單的避害,轉向開發如好奇心、開放心態以及對自身偏見保持誠實等細膩的特質。

2171

OpenAI 語音引擎:技術實作與安全框架

OpenAI 的語音引擎是一個自 2022 年起開發的合成語音模型,透過受控的逐步發布方式迭代部署,以提供安全研究與政策制定的資訊。

2172

Hugging Face 嵌入容器於 Amazon SageMaker 發布

Hugging Face 已發布通用可用(GA)嵌入容器於 Amazon SageMaker,該容器由 Text Embedding Inference(TEI)提供動力,以高效能部署開放式嵌入模型。

2173

Hugging Face Transformers 文件重新設計

Hugging Face 正在重新設計 Transformers 文件,將其從僵硬、逐步累積的結構轉變為以程式碼為先、針對產品開發者量身打造的整合體驗。

2174

Qwen2 版本說明 / 新功能

Qwen 宣佈 Qwen2,這是一系列五個開源模型,參數規模從 0.5B 到 72B,增強了對額外 27 種語言的多語言支援,且上下文長度最高可達 128K 令牌。

2175

10BedICU 與 OpenAI:提升印度的重症護理基礎設施

10BedICU 正將 OpenAI 的 GPT-4 與 Whisper 模型整合至其 CARE 平台,以自動化醫療文件、整合舊有硬體,並在印度公立醫院中簡化出院摘要。

2176

Qwen-Agent:將 LLM 從 8k 通用化至 1M 上下文

Qwen 開發了一套代理框架,使 8k 上下文模型能處理 1M token,並在特定基準測試中超越 RAG 與原生長上下文模型。

2177

人工分析文字轉圖排行榜與競技場發布

Hugging Face 推出了人工分析文字轉圖排行榜與競技場,利用超過 45,000 票的人類偏好數據對開源與專有圖像生成模型進行排名。

2178

從 GPT-4 中提取概念

OpenAI 開發了可擴展的稀疏自編碼器方法,將 GPT-4 的內部表徵分解為 1600 萬可供人類解讀的特徵。

2179

Anthropic 選舉完整性測試與緩解框架

Anthropic 實施了一套結合專家定性分析與自動化評估的多層次測試與緩解流程,以維護其 AI 模型中的選舉完整性。

2180

Mistral AI 模型客製化與微調服務

Mistral AI 透過全新的 SDK、la Plateforme 上的無伺服器微調以及客製化訓練服務,推出了模型客製化選項,以實現領域特定的模型優化。

2181

Mistral AI 微調黑客松活動公告

Mistral AI 宣布於 2024 年 6 月 5 日至 30 日舉辦虛擬微調黑客松,針對使用其新微調 API 的前三名專案,各提供 2,500 歐元的 API 信用額度。

2182

Hugging Face NPC-Playground:在 3D 環境中整合 LLM 驅動的 NPC

Hugging Face 推出 NPC-Playground,一個利用 Cubzh 與 Gigax 的 3D 示範,透過函式呼叫與 Lua 腳本實現逼真的 LLM 驅動 NPC 互動。

2183

Anthropic 在加拿大推出 Claude

Anthropic 已將 Claude(包括 Claude 3 模型系列和 API)的可用性擴展至加拿大的使用者與企業。

2184

Intel Gaudi 輔助生成支援

Hugging Face 已將輔助生成(投機抽樣)整合至 Optimum Habana,使大型 transformer 模型在 Intel Gaudi 處理器上可提升至最高 2 倍的速度。

2185

Hugging Face Spaces 秘密安全更新

Hugging Face 披露了一起安全事件,涉及未經授權存取部分 Spaces 秘密,導致受影響的令牌被撤銷,並轉向使用細粒度存取令牌。

2186

Ollama and Continue: 設定開源 AI 程式碼助手

Ollama 與 Continue 讓開發者能夠在 VS Code 和 JetBrains 中使用 Codestral、Llama 3 和 DeepSeek Coder 等模型,建立一個完全開源、本地運行的 AI 程式碼助手。

2187

OpenAI 打擊隱蔽 AI 影響行動

OpenAI 終止了與五個使用 AI 產生欺騙性內容的隱蔽影響行動相關的帳號,儘管這些行動皆未取得顯著的受眾觸及。

2188

OpenAI 為大學推出 ChatGPT Edu

OpenAI 已推出 ChatGPT Edu,這是一個為大學設計的 ChatGPT 版本,可在企業級安全、資料隱私保護下,讓大學大規模部署 AI,並可使用 GPT-4o。

2189

OpenAI 非營利組織倡議

OpenAI 已推出 OpenAI 非營利組織計畫,提供 ChatGPT Business 與 Enterprise 的折扣使用,以協助非營利組織克服營運與資金限制。

2190

MavenAGI 由 OpenAI 提供技術支援的自動化客戶支援代理人

MavenAGI 已推出基於 GPT-4 的 AI 客戶服務代理人,可自動化處理高達 93% 的支援問題,並將每張工單的平均成本從 $40 降至 $8。

2191

Codestral 發佈說明

Mistral AI 已發佈 Codestral,這是一個 22B 開放權重的生成式 AI 模型,專門為超過 80 種程式語言的程式碼生成而設計。

2192

OpenAI 與 WAN-IFRA 推出 The Newsroom AI Catalyst 計畫

OpenAI 與 WAN-IFRA 已推出 The Newsroom AI Catalyst,這是一個加速計畫,為全球 128 家新聞編輯室提供資金與技術支援,以快速推動 AI 採用並提升新聞業的永續性。

2193

Mistral AI 非生產用途授權 (MNPL) 公告

Mistral AI 推出了 Mistral AI 非生產用途授權 (MNPL),以允許其技術的非商業和研究用途,同時確保在於其模型上建立業務的人能擁有永續的商業合作夥伴關係。

2194

OpenAI 與 The Atlantic 的新聞整合夥伴關係

OpenAI 與 The Atlantic 已建立戰略夥伴關係,將 The Atlantic 的高品質新聞內容整合至 ChatGPT 及其他 OpenAI 產品,並提供歸屬標示與完整文章連結。

2195

OpenAI 與 Vox Media 戰略合作夥伴關係

OpenAI 與 Vox Media 已建立戰略合作夥伴關係,將 Vox Media 的新聞內容整合至 ChatGPT,並共同開發面向消費者與廣告主的 AI 驅動產品。

2196

文本生成推理基準測試

Hugging Face 推出了一款用於文本生成推理(TGI)的基準測試工具,幫助開發者分析吞吐量與延遲之間的取捨,以優化大型語言模型部署的成本與效能。

2197

Anthropic 任命 Jay Kreps 加入董事會

Anthropic 已任命 Confluent 的共同創辦人兼 CEO Jay Kreps 加入其董事會,以支持公司的企業成長與數據基礎設施擴展。

2198

OpenAI董事會成立安全與安保委員會

OpenAI已成立安全與安保委員會,以監督其專案與營運中的關鍵安全與安保決策,並開始訓練其下一個前沿模型。

2199

使用 Sentence Transformers 訓練與微調嵌入模型

Hugging Face 提供了使用 Sentence Transformers 套件訓練與微調嵌入模型以應對語意搜尋與 RAG 等任務的完整指南,並介紹了全新的 SentenceTransformerTrainer。

2200

xAI 系列 B 融資輪

xAI 已完成 60 億美元的系列 B 融資,以加速先進 AI 系統的開發,並建立必要的基礎設施,將其產品推向市場。