封存 · 11 個實驗室 · 3,059 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

2201

Falcon 2 11B 發布說明

TII 已發布 Falcon 2 11B,一系列更小且高效能的模型,包括在超過 5,000 億個 token 上訓練的預訓練大型語言模型(LLM)與視覺語言模型(VLM)。

2202

CyberSecEval 2:評估大型語言模型的網路安全風險

Hugging Face 與 Meta 推出了 CyberSecEval 2,一個全面的框架,用於評估大型語言模型在程式碼解譯器濫用、進攻性網路安全能力以及提示注入攻擊方面的易受性。

2203

OpenAI 與 News Corp 多年全球合作夥伴關係

OpenAI 與 News Corp 簽訂了多年協議,允許 OpenAI 將 News Corp 來自《華爾街日報》與《泰晤士報》等主要出版物的即時與存檔內容整合至其產品中,以提升資訊的可靠性。

2204

Hugging Face AWS Inferentia2 整合

Hugging Face 擴大了對 AWS Inferentia2 的支援,讓使用者能透過 Amazon SageMaker 部署超過 100,000 個模型,並為 Hugging Face 推理端點引入了新的 Inf2 實例選項。

2205

OpenAI 安全實踐

OpenAI 詳細說明了用於開發與部署前沿 AI 模型的十項核心安全實踐,強調以科學方法將安全融入模型生命周期的每個階段。

2206

Hugging Face 與 Microsoft 戰略合作更新 2024 年 5 月

Hugging Face 與 Microsoft 擴大了戰略合作,將熱門開放模型整合至 Azure Model Catalog、在 Azure 上啟用 AMD MI300X GPU 支援,並為 Hugging Face Spaces 引入 VS Code 整合。

2207

Hugging Face 整合 AMD Instinct MI300 GPU

Hugging Face 為 AMD Instinct MI300 GPU 提供了一流的整合,使 Llama 3 70B 的推論速度提升最高可達 3 倍,微調速度提升 2 倍,相較於 MI250。

2208

Dell Enterprise Hub: 本地 AI 部署與訓練

Hugging Face 與 Dell 推出了 Dell Enterprise Hub,這是一個平台,可簡化在 Dell 硬體上本地訓練與部署開源大型語言模型的流程。

2209

Hugging Face Spaces 開發模式發布

Hugging Face 推出了 Spaces Dev Mode,讓 PRO 訂閱者可透過 VS Code 或 SSH 進行即時程式碼編輯,無需為每次變更執行 git 推送。

2210

Anthropic 使用大規模字典學習技術繪製 Claude 3 Sonnet 內部概念地圖

Anthropic 公開表示,其從 Claude 3 Sonnet 中提取出數百萬個可解釋的特徵,揭示了概念在生產級大型語言模型內部的表徵方式,並展示操控這些特徵可改變模型行為,是朝向更安全人工智慧的重要一步。

2211

Krishna Rao 加入 Anthropic 擔任執行長 (CFO)

Anthropic 已任命 Krishna Rao 為執行長 (CFO),在企業成長與國際擴張期間領導財務策略與營運。

2212

Anthropic 負責任縮放政策反思

Anthropic 提供其負責任縮放政策 (RSP) 的運作更新,詳細說明了 AI 安全等級 (ASL) 的實施情況,以及用於緩解前沿模型災難性風險的框架。

2213

Firebase Genkit 支援 Ollama

Google 已發布 Firebase Genkit,這是一個用於構建 AI 驅動應用程式的開源框架,其特色是原生支援 Ollama,可在本地運行 Google 的 Gemma 模型。

2214

OpenAI ChatGPT 語音選擇流程

OpenAI 詳細說明了為選拔 ChatGPT 五位專業配音演員而進行的五個月選角流程,同時闡明「Sky」語音並非旨在模仿 Scarlett Johansson。

2215

ChatGPT 資料分析改進(2024年5月)

OpenAI 為 ChatGPT 引入了資料分析的增強功能,包括直接雲端儲存整合、互動式表格以及可自訂的圖表,這些功能由 GPT-4o 提供支援。

2216

OpenAI 與 Reddit 合作夥伴關係

OpenAI 與 Reddit 合作,將即時 Reddit 內容整合至 ChatGPT,並實施 OpenAI 的 AI 模型,以提升 Reddit 使用者與版主的功能。

2217

Hugging Face KV 快取量化

Hugging Face 在 Transformers 函式庫中引入了 KV 快取量化,以降低長上下文文字生成的記憶體使用量,且對模型品質的影響極小。

2218

Canva Magic Studio 與 OpenAI 的整合

Canva 已整合 OpenAI 的 GPT-4 與 API,為其 Magic Studio AI 套件提供動力,該套件已被使用超過 50 億次,以簡化非專業創作者的設計流程。

2219

Mike Krieger 加入 Anthropic 擔任執行長產品官

Anthropic 已任命 Instagram 共同創辦人兼前 CTO Mike Krieger 為執行長產品官,以領導產品工程、管理和設計。

2220

OpenAI 領導層變動:Ilya Sutskever 離職,Jakub Pachocki 任命為首席科學家

OpenAI 宣布共同創辦人 Ilya Sutskever 離開公司,並任命 Jakub Pachocki 為新任首席科學家,領導朝向 AGI 的研究工作。

2221

介紹 Open Arabic LLM Leaderboard

Hugging Face 與科技創新研究院(Technology Innovation Institute)已推出 Open Arabic LLM Leaderboard(OALL),提供一個專門的、開放的阿拉伯語大型語言模型評估平台。

2222

PaliGemma 視覺語言模型發布

Google 已發布 PaliGemma,這是一系列結合 SigLIP-So400m 與 Gemma-2B 的開放式視覺語言模型,可執行圖像說明、視覺問答與目標偵測等任務。

2223

Hugging Face 與 LangChain 推出 langchain_huggingface 合作套件

Hugging Face 與 LangChain 已發布 langchain_huggingface,這是一個共同維護的合作套件,旨在簡化 Hugging Face 模型在 LangChain 生態系統中的整合。

2224

Claude 現已於歐盟推出 – Anthropic 擴大其 AI 助手的使用範圍

Anthropic 宣布 Claude(其 AI 助手)現在已可透過 Claude.ai、iOS app 以及 Team plan 提供給歐洲各地的個人與企業,將 Claude 3 模型系列擴展至歐盟市場。

2225

OpenAI GPT-4o 版本說明

OpenAI 已發布 GPT-4o,一種全端訓練的全能模型,涵蓋文字、視覺與音訊,旨在實現自然的人機互動,並具有人類般的回應延遲。

2226

OpenAI 春季更新:推出 GPT-4o

OpenAI 已發布 GPT-4o,一款能夠在音訊、視覺和文字上進行即時推理的新旗艦模型,同時將先進功能擴展至 ChatGPT 免費用戶。

2227

OpenAI GPT-4o 發佈與 ChatGPT 免費版功能增強

OpenAI 推出了 GPT-4o,這是一款提供 GPT-4 等級智能、並在文字、語音和視覺方面提升了速度與多模態能力的旗艦模型,現在免費版與付費版用戶均可使用。

2228

Transformers Agents 2.0 release notes / what's new

Hugging Face 推出了 Transformers Agents 2.0,這是一個模組化代理框架,其特點是具備迭代問題解決能力的代理,並在 GAIA benchmark 使用 Llama-3-70B-Instruct 展現了高性能。

2229

Qwen-Max-0428 發布說明

Qwen 已發布 Qwen-Max-0428,一款指令微調的聊天模型,在 MT-Bench 上優於 Qwen1.5-110B-Chat,並在 Chatbot Arena 排行榜中位列前十。

2230

Anthropic 使用政策更新 2024 年 6 月

Anthropic 已於 2024 年 6 月 6 日生效,將其可接受使用政策更新為新的使用政策,引入更嚴格的選舉完整性、高風險使用案例與生物特徵資料分析指引。

2231

使用 Intel Gaudi 2 與 Intel Xeon 建構具成本效益的企業 RAG 應用程式

Hugging Face 示範了透過 OPEA 框架結合 Intel Gaudi 2 加速卡與 Intel Xeon CPU,如何讓企業建置相較於 H100 系統具更佳每美元效能的 RAG 應用程式。

2232

Hugging Face Enterprise Hub 現已於 AWS Marketplace 上線

Hugging Face 已將 Enterprise Hub 整合至 AWS Marketplace,讓組織能透過其 AWS 帳戶升級帳號並直接管理計費。

2233

OpenAI 模型規範

OpenAI 已推出模型規範,這是一套由目標、規則與預設行為組成的框架,旨在標準化並透明化塑造 AI 模型在 OpenAI API 與 ChatGPT 中的行為。

2234

OpenAI 對資料與 AI 的方法

OpenAI 正在推出 Media Manager,讓創作者能控制其內容在 AI 訓練中的使用,並闡述其多管齊下的資料來源策略,以在模型多樣性與創作者權益之間取得平衡。

2235

OpenAI 內容來源與真實性倡議

OpenAI 正在採用 C2PA 開放標準進行數位內容認證,並開發內部工具,如圖像偵測分類器與音訊浮水印,以協助使用者辨識 AI 生成的內容。

2236

OpenAI 與 Stack Overflow API 合作夥伴關係

OpenAI 與 Stack Overflow 合作,透過 OverflowAPI 將審核過的技術資料整合至 OpenAI 模型與 ChatGPT,同時 Stack Overflow 將使用 OpenAI 模型開發 OverflowAI。

2237

Hugging Face 針對希伯來語 LLM 的開放排行榜

Hugging Face 已推出專為希伯來語大型語言模型(LLM)設計的開放排行榜,旨在解決低資源且形態複雜語言的挑戰,提升模型的評估與改進。

2238

人工分析 LLM 性能排行榜於 Hugging Face

Hugging Face 已整合人工分析 LLM 性能排行榜,為 AI 工程師提供統一的指標系統,以比較超過 100 個無伺服器 LLM API 端點的品質、價格與速度。

2239

Hugging Face 推理端點的語音辨識與說話者分割管線

Hugging Face 為在推理端點上部署結合 Whisper 語音辨識、Pyannote 說話者分割與推測解碼的模組化管線,推出了自訂推理處理器。

2240

OpenAI 打擊「Bad Grammar」俄羅斯關聯的影響行動

OpenAI 封禁了一個名為「Bad Grammar」的俄羅斯關聯網路,該網路利用 AI 模型自動生成政治評論垃圾訊息,並在多個國家的 Telegram 上散布。

2241

OpenAI 打擊與中國相關的影響行動「Spamouflage」

OpenAI 封禁了與名為 Spamouflage 的作業相關的帳號,該作業是一個與中國相關的影響力活動,利用 AI 生成內容並進行研究,以針對中國政府的批評者。

2242

OpenAI 破壞俄羅斯「Doppelganger」影響行動

OpenAI 封禁了四個與俄羅斯「Doppelganger」影響行動相關的帳號群組,該行動利用 AI 產生多語言內容,目標鎖定歐洲與北美。

2243

OpenAI 行動 Zero Zeno:與以色列相關的影響活動

OpenAI 封禁了一群由以色列政治活動公司 STOIC 操作的帳號,以阻止針對多個國家的 AI 生成影響行動。

2244

OpenAI 打擊伊朗相關的影響行動 IUVM

OpenAI 封禁了與 IUVM 相關的帳號,IUVM 是一個伊朗相關的影響網路,利用 AI 生成並翻譯親伊朗、反美與反以色列的內容。

2245

透過結構化生成提升提示一致性

Hugging Face 與 Dottxt 的研究顯示,使用結構化生成來限制 LLM 輸出可降低效能變異,並提升在不同提示格式與樣本順序下的排名一致性。

2246

StarCoder2-15B-Instruct-v0.1 發行說明 / 新功能

Hugging Face 推出 StarCoder2-15B-Instruct-v0.1,這是首個完全自我對齊的程式碼大型語言模型,使用全透明且寬鬆的管線訓練,在 HumanEval 上超越 CodeLlama-70B-Instruct。

2247

OpenAI 與《金融時報》策略夥伴關係

OpenAI 與《金融時報》已簽訂策略夥伴關係與授權協議,將屬於《金融時報》的新聞內容整合至 ChatGPT,並為《金融時報》員工提供 ChatGPT Enterprise 存取權限。

2248

Anthropic Circuits Updates April 2024

Anthropic 2024 年 4 月的 Circuits 更新提供了關於可解釋性、多智能體系統故障以及 Riemann zeta function 下限突破的初步研究結果。

2249

Qwen1.5-110B 版本說明 / 新功能

Qwen 已發布 Qwen1.5-110B,這是 Qwen1.5 系列中首個突破 1000 億參數的模型,提供與 Llama-3-70B 競爭的性能,並較 Qwen1.5-72B 有顯著提升。

2250

Moderna 與 OpenAI 合作推動 AI 驅動的藥物開發

Moderna 已在全公司部署 ChatGPT Enterprise,以加速 mRNA 藥物的開發,並透過自訂 GPT 優化業務運營。