✷ 封存 · 11 個實驗室 · 3,059 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Falcon 2 11B 發布說明
TII 已發布 Falcon 2 11B,一系列更小且高效能的模型,包括在超過 5,000 億個 token 上訓練的預訓練大型語言模型(LLM)與視覺語言模型(VLM)。
CyberSecEval 2:評估大型語言模型的網路安全風險
Hugging Face 與 Meta 推出了 CyberSecEval 2,一個全面的框架,用於評估大型語言模型在程式碼解譯器濫用、進攻性網路安全能力以及提示注入攻擊方面的易受性。
OpenAI 與 News Corp 多年全球合作夥伴關係
OpenAI 與 News Corp 簽訂了多年協議,允許 OpenAI 將 News Corp 來自《華爾街日報》與《泰晤士報》等主要出版物的即時與存檔內容整合至其產品中,以提升資訊的可靠性。
Hugging Face AWS Inferentia2 整合
Hugging Face 擴大了對 AWS Inferentia2 的支援,讓使用者能透過 Amazon SageMaker 部署超過 100,000 個模型,並為 Hugging Face 推理端點引入了新的 Inf2 實例選項。
OpenAI 安全實踐
OpenAI 詳細說明了用於開發與部署前沿 AI 模型的十項核心安全實踐,強調以科學方法將安全融入模型生命周期的每個階段。
Hugging Face 與 Microsoft 戰略合作更新 2024 年 5 月
Hugging Face 與 Microsoft 擴大了戰略合作,將熱門開放模型整合至 Azure Model Catalog、在 Azure 上啟用 AMD MI300X GPU 支援,並為 Hugging Face Spaces 引入 VS Code 整合。
Hugging Face 整合 AMD Instinct MI300 GPU
Hugging Face 為 AMD Instinct MI300 GPU 提供了一流的整合,使 Llama 3 70B 的推論速度提升最高可達 3 倍,微調速度提升 2 倍,相較於 MI250。
Dell Enterprise Hub: 本地 AI 部署與訓練
Hugging Face 與 Dell 推出了 Dell Enterprise Hub,這是一個平台,可簡化在 Dell 硬體上本地訓練與部署開源大型語言模型的流程。
Hugging Face Spaces 開發模式發布
Hugging Face 推出了 Spaces Dev Mode,讓 PRO 訂閱者可透過 VS Code 或 SSH 進行即時程式碼編輯,無需為每次變更執行 git 推送。
Anthropic 使用大規模字典學習技術繪製 Claude 3 Sonnet 內部概念地圖
Anthropic 公開表示,其從 Claude 3 Sonnet 中提取出數百萬個可解釋的特徵,揭示了概念在生產級大型語言模型內部的表徵方式,並展示操控這些特徵可改變模型行為,是朝向更安全人工智慧的重要一步。
Krishna Rao 加入 Anthropic 擔任執行長 (CFO)
Anthropic 已任命 Krishna Rao 為執行長 (CFO),在企業成長與國際擴張期間領導財務策略與營運。
Anthropic 負責任縮放政策反思
Anthropic 提供其負責任縮放政策 (RSP) 的運作更新,詳細說明了 AI 安全等級 (ASL) 的實施情況,以及用於緩解前沿模型災難性風險的框架。
Firebase Genkit 支援 Ollama
Google 已發布 Firebase Genkit,這是一個用於構建 AI 驅動應用程式的開源框架,其特色是原生支援 Ollama,可在本地運行 Google 的 Gemma 模型。
OpenAI ChatGPT 語音選擇流程
OpenAI 詳細說明了為選拔 ChatGPT 五位專業配音演員而進行的五個月選角流程,同時闡明「Sky」語音並非旨在模仿 Scarlett Johansson。
ChatGPT 資料分析改進(2024年5月)
OpenAI 為 ChatGPT 引入了資料分析的增強功能,包括直接雲端儲存整合、互動式表格以及可自訂的圖表,這些功能由 GPT-4o 提供支援。
OpenAI 與 Reddit 合作夥伴關係
OpenAI 與 Reddit 合作,將即時 Reddit 內容整合至 ChatGPT,並實施 OpenAI 的 AI 模型,以提升 Reddit 使用者與版主的功能。
Hugging Face KV 快取量化
Hugging Face 在 Transformers 函式庫中引入了 KV 快取量化,以降低長上下文文字生成的記憶體使用量,且對模型品質的影響極小。
Canva Magic Studio 與 OpenAI 的整合
Canva 已整合 OpenAI 的 GPT-4 與 API,為其 Magic Studio AI 套件提供動力,該套件已被使用超過 50 億次,以簡化非專業創作者的設計流程。
Mike Krieger 加入 Anthropic 擔任執行長產品官
Anthropic 已任命 Instagram 共同創辦人兼前 CTO Mike Krieger 為執行長產品官,以領導產品工程、管理和設計。
OpenAI 領導層變動:Ilya Sutskever 離職,Jakub Pachocki 任命為首席科學家
OpenAI 宣布共同創辦人 Ilya Sutskever 離開公司,並任命 Jakub Pachocki 為新任首席科學家,領導朝向 AGI 的研究工作。
介紹 Open Arabic LLM Leaderboard
Hugging Face 與科技創新研究院(Technology Innovation Institute)已推出 Open Arabic LLM Leaderboard(OALL),提供一個專門的、開放的阿拉伯語大型語言模型評估平台。
PaliGemma 視覺語言模型發布
Google 已發布 PaliGemma,這是一系列結合 SigLIP-So400m 與 Gemma-2B 的開放式視覺語言模型,可執行圖像說明、視覺問答與目標偵測等任務。
Hugging Face 與 LangChain 推出 langchain_huggingface 合作套件
Hugging Face 與 LangChain 已發布 langchain_huggingface,這是一個共同維護的合作套件,旨在簡化 Hugging Face 模型在 LangChain 生態系統中的整合。
Claude 現已於歐盟推出 – Anthropic 擴大其 AI 助手的使用範圍
Anthropic 宣布 Claude(其 AI 助手)現在已可透過 Claude.ai、iOS app 以及 Team plan 提供給歐洲各地的個人與企業,將 Claude 3 模型系列擴展至歐盟市場。
OpenAI GPT-4o 版本說明
OpenAI 已發布 GPT-4o,一種全端訓練的全能模型,涵蓋文字、視覺與音訊,旨在實現自然的人機互動,並具有人類般的回應延遲。
OpenAI 春季更新:推出 GPT-4o
OpenAI 已發布 GPT-4o,一款能夠在音訊、視覺和文字上進行即時推理的新旗艦模型,同時將先進功能擴展至 ChatGPT 免費用戶。
OpenAI GPT-4o 發佈與 ChatGPT 免費版功能增強
OpenAI 推出了 GPT-4o,這是一款提供 GPT-4 等級智能、並在文字、語音和視覺方面提升了速度與多模態能力的旗艦模型,現在免費版與付費版用戶均可使用。
Transformers Agents 2.0 release notes / what's new
Hugging Face 推出了 Transformers Agents 2.0,這是一個模組化代理框架,其特點是具備迭代問題解決能力的代理,並在 GAIA benchmark 使用 Llama-3-70B-Instruct 展現了高性能。
Qwen-Max-0428 發布說明
Qwen 已發布 Qwen-Max-0428,一款指令微調的聊天模型,在 MT-Bench 上優於 Qwen1.5-110B-Chat,並在 Chatbot Arena 排行榜中位列前十。
Anthropic 使用政策更新 2024 年 6 月
Anthropic 已於 2024 年 6 月 6 日生效,將其可接受使用政策更新為新的使用政策,引入更嚴格的選舉完整性、高風險使用案例與生物特徵資料分析指引。
使用 Intel Gaudi 2 與 Intel Xeon 建構具成本效益的企業 RAG 應用程式
Hugging Face 示範了透過 OPEA 框架結合 Intel Gaudi 2 加速卡與 Intel Xeon CPU,如何讓企業建置相較於 H100 系統具更佳每美元效能的 RAG 應用程式。
Hugging Face Enterprise Hub 現已於 AWS Marketplace 上線
Hugging Face 已將 Enterprise Hub 整合至 AWS Marketplace,讓組織能透過其 AWS 帳戶升級帳號並直接管理計費。
OpenAI 模型規範
OpenAI 已推出模型規範,這是一套由目標、規則與預設行為組成的框架,旨在標準化並透明化塑造 AI 模型在 OpenAI API 與 ChatGPT 中的行為。
OpenAI 對資料與 AI 的方法
OpenAI 正在推出 Media Manager,讓創作者能控制其內容在 AI 訓練中的使用,並闡述其多管齊下的資料來源策略,以在模型多樣性與創作者權益之間取得平衡。
OpenAI 內容來源與真實性倡議
OpenAI 正在採用 C2PA 開放標準進行數位內容認證,並開發內部工具,如圖像偵測分類器與音訊浮水印,以協助使用者辨識 AI 生成的內容。
OpenAI 與 Stack Overflow API 合作夥伴關係
OpenAI 與 Stack Overflow 合作,透過 OverflowAPI 將審核過的技術資料整合至 OpenAI 模型與 ChatGPT,同時 Stack Overflow 將使用 OpenAI 模型開發 OverflowAI。
Hugging Face 針對希伯來語 LLM 的開放排行榜
Hugging Face 已推出專為希伯來語大型語言模型(LLM)設計的開放排行榜,旨在解決低資源且形態複雜語言的挑戰,提升模型的評估與改進。
人工分析 LLM 性能排行榜於 Hugging Face
Hugging Face 已整合人工分析 LLM 性能排行榜,為 AI 工程師提供統一的指標系統,以比較超過 100 個無伺服器 LLM API 端點的品質、價格與速度。
Hugging Face 推理端點的語音辨識與說話者分割管線
Hugging Face 為在推理端點上部署結合 Whisper 語音辨識、Pyannote 說話者分割與推測解碼的模組化管線,推出了自訂推理處理器。
OpenAI 打擊「Bad Grammar」俄羅斯關聯的影響行動
OpenAI 封禁了一個名為「Bad Grammar」的俄羅斯關聯網路,該網路利用 AI 模型自動生成政治評論垃圾訊息,並在多個國家的 Telegram 上散布。
OpenAI 打擊與中國相關的影響行動「Spamouflage」
OpenAI 封禁了與名為 Spamouflage 的作業相關的帳號,該作業是一個與中國相關的影響力活動,利用 AI 生成內容並進行研究,以針對中國政府的批評者。
OpenAI 破壞俄羅斯「Doppelganger」影響行動
OpenAI 封禁了四個與俄羅斯「Doppelganger」影響行動相關的帳號群組,該行動利用 AI 產生多語言內容,目標鎖定歐洲與北美。
OpenAI 行動 Zero Zeno:與以色列相關的影響活動
OpenAI 封禁了一群由以色列政治活動公司 STOIC 操作的帳號,以阻止針對多個國家的 AI 生成影響行動。
OpenAI 打擊伊朗相關的影響行動 IUVM
OpenAI 封禁了與 IUVM 相關的帳號,IUVM 是一個伊朗相關的影響網路,利用 AI 生成並翻譯親伊朗、反美與反以色列的內容。
透過結構化生成提升提示一致性
Hugging Face 與 Dottxt 的研究顯示,使用結構化生成來限制 LLM 輸出可降低效能變異,並提升在不同提示格式與樣本順序下的排名一致性。
StarCoder2-15B-Instruct-v0.1 發行說明 / 新功能
Hugging Face 推出 StarCoder2-15B-Instruct-v0.1,這是首個完全自我對齊的程式碼大型語言模型,使用全透明且寬鬆的管線訓練,在 HumanEval 上超越 CodeLlama-70B-Instruct。
OpenAI 與《金融時報》策略夥伴關係
OpenAI 與《金融時報》已簽訂策略夥伴關係與授權協議,將屬於《金融時報》的新聞內容整合至 ChatGPT,並為《金融時報》員工提供 ChatGPT Enterprise 存取權限。
Anthropic Circuits Updates April 2024
Anthropic 2024 年 4 月的 Circuits 更新提供了關於可解釋性、多智能體系統故障以及 Riemann zeta function 下限突破的初步研究結果。
Qwen1.5-110B 版本說明 / 新功能
Qwen 已發布 Qwen1.5-110B,這是 Qwen1.5 系列中首個突破 1000 億參數的模型,提供與 Llama-3-70B 競爭的性能,並較 Qwen1.5-72B 有顯著提升。
Moderna 與 OpenAI 合作推動 AI 驅動的藥物開發
Moderna 已在全公司部署 ChatGPT Enterprise,以加速 mRNA 藥物的開發,並透過自訂 GPT 優化業務運營。