Qwen-Max-0428 發布說明
Qwen 已發布 Qwen-Max-0428,一款指令微調的聊天模型,在 MT-Bench 上優於 Qwen1.5-110B-Chat,並在 Chatbot Arena 排行榜中位列前十。
使用 Intel Gaudi 2 與 Intel Xeon 建構具成本效益的企業 RAG 應用程式
Hugging Face 示範了透過 OPEA 框架結合 Intel Gaudi 2 加速卡與 Intel Xeon CPU,如何讓企業建置相較於 H100 系統具更佳每美元效能的 RAG 應用程式。
Hugging Face Enterprise Hub 現已於 AWS Marketplace 上線
Hugging Face 已將 Enterprise Hub 整合至 AWS Marketplace,讓組織能透過其 AWS 帳戶升級帳號並直接管理計費。
OpenAI 模型規範
OpenAI 已推出模型規範,這是一套由目標、規則與預設行為組成的框架,旨在標準化並透明化塑造 AI 模型在 OpenAI API 與 ChatGPT 中的行為。
OpenAI 對資料與 AI 的方法
OpenAI 正在推出 Media Manager,讓創作者能控制其內容在 AI 訓練中的使用,並闡述其多管齊下的資料來源策略,以在模型多樣性與創作者權益之間取得平衡。
OpenAI 內容來源與真實性倡議
OpenAI 正在採用 C2PA 開放標準進行數位內容認證,並開發內部工具,如圖像偵測分類器與音訊浮水印,以協助使用者辨識 AI 生成的內容。
OpenAI 與 Stack Overflow API 合作夥伴關係
OpenAI 與 Stack Overflow 合作,透過 OverflowAPI 將審核過的技術資料整合至 OpenAI 模型與 ChatGPT,同時 Stack Overflow 將使用 OpenAI 模型開發 OverflowAI。
Hugging Face 針對希伯來語 LLM 的開放排行榜
Hugging Face 已推出專為希伯來語大型語言模型(LLM)設計的開放排行榜,旨在解決低資源且形態複雜語言的挑戰,提升模型的評估與改進。
人工分析 LLM 性能排行榜於 Hugging Face
Hugging Face 已整合人工分析 LLM 性能排行榜,為 AI 工程師提供統一的指標系統,以比較超過 100 個無伺服器 LLM API 端點的品質、價格與速度。
Hugging Face 推理端點的語音辨識與說話者分割管線
Hugging Face 為在推理端點上部署結合 Whisper 語音辨識、Pyannote 說話者分割與推測解碼的模組化管線,推出了自訂推理處理器。
OpenAI 打擊「Bad Grammar」俄羅斯關聯的影響行動
OpenAI 封禁了一個名為「Bad Grammar」的俄羅斯關聯網路,該網路利用 AI 模型自動生成政治評論垃圾訊息,並在多個國家的 Telegram 上散布。
OpenAI 打擊與中國相關的影響行動「Spamouflage」
OpenAI 封禁了與名為 Spamouflage 的作業相關的帳號,該作業是一個與中國相關的影響力活動,利用 AI 生成內容並進行研究,以針對中國政府的批評者。
OpenAI 破壞俄羅斯「Doppelganger」影響行動
OpenAI 封禁了四個與俄羅斯「Doppelganger」影響行動相關的帳號群組,該行動利用 AI 產生多語言內容,目標鎖定歐洲與北美。
OpenAI 行動 Zero Zeno:與以色列相關的影響活動
OpenAI 封禁了一群由以色列政治活動公司 STOIC 操作的帳號,以阻止針對多個國家的 AI 生成影響行動。
OpenAI 打擊伊朗相關的影響行動 IUVM
OpenAI 封禁了與 IUVM 相關的帳號,IUVM 是一個伊朗相關的影響網路,利用 AI 生成並翻譯親伊朗、反美與反以色列的內容。
透過結構化生成提升提示一致性
Hugging Face 與 Dottxt 的研究顯示,使用結構化生成來限制 LLM 輸出可降低效能變異,並提升在不同提示格式與樣本順序下的排名一致性。
StarCoder2-15B-Instruct-v0.1 發行說明 / 新功能
Hugging Face 推出 StarCoder2-15B-Instruct-v0.1,這是首個完全自我對齊的程式碼大型語言模型,使用全透明且寬鬆的管線訓練,在 HumanEval 上超越 CodeLlama-70B-Instruct。
OpenAI 與《金融時報》策略夥伴關係
OpenAI 與《金融時報》已簽訂策略夥伴關係與授權協議,將屬於《金融時報》的新聞內容整合至 ChatGPT,並為《金融時報》員工提供 ChatGPT Enterprise 存取權限。
Qwen1.5-110B 版本說明 / 新功能
Qwen 已發布 Qwen1.5-110B,這是 Qwen1.5 系列中首個突破 1000 億參數的模型,提供與 Llama-3-70B 競爭的性能,並較 Qwen1.5-72B 有顯著提升。
Moderna 與 OpenAI 合作推動 AI 驅動的藥物開發
Moderna 已在全公司部署 ChatGPT Enterprise,以加速 mRNA 藥物的開發,並透過自訂 GPT 優化業務運營。
OpenAI 推出 ChatGPT 與 Whisper API
OpenAI 已發布 GPT-3.5 Turbo 與 Whisper API,為開發者提供顯著的成本降低與高效能語音轉文字功能。
GPT-4 API 一般可用性與 Completions API 停用
OpenAI 已將 GPT-4 API 向所有付費客戶普遍開放,並宣布了針對 Completions、Embeddings 與 Edits API 中舊模型的停用計畫。
OpenAI 兒童安全承諾:採用安全設計原則
OpenAI 與其他產業領導者已承諾實施安全設計原則,以減輕生成式 AI 對兒童的風險,重點在於防止兒童性虐待資料(CSAM)與剝削資料(CSEM)。
OpenAI 企業 API 功能更新 2024 年 4 月
OpenAI 推出了全新的企業級安全、行政控制、Assistants API 強化功能與成本管理選項,以支援大型組織的 AI 解決方案擴展。
Hugging Face 開放式思考鏈領導榜
Hugging Face 推出了開放式思考鏈領導榜,用於衡量在各種大型語言模型上,透過思考鏈提示在具挑戰性的推理任務中所帶來的具體準確率提升。
Jack of All Trades (JAT) 多用途變換器代理
Hugging Face 推出 Jack of All Trades (JAT),一個基於單一變換器的代理,能在 Atari、BabyAI、Meta-World 與 MuJoCo 環境中執行多樣的序列決策任務。
OpenAI 指令層級:優先處理特權指令以防止提示注入
OpenAI 引入了一個指令層級,訓練大型語言模型優先處理系統提示而非不可信的使用者輸入,顯著降低了對提示注入與越獄攻擊的脆弱性。
開放醫療大型語言模型排行榜:醫療領域大型語言模型基準測試
Hugging Face 推出了開放醫療大型語言模型排行榜,這是一個標準化平台,用於評估與比較大型語言模型在各種醫療資料集上的表現,以提升可靠性與患者安全。
Meta Llama 3 發布說明
Meta 已發布 Llama 3,這是一個開放存取的 LLM 系列,提供 8B 與 70B 參數模型,具備改進的分詞與在 15 兆令牌上進行的訓練。
CodeQwen1.5 版本說明
Qwen 發布了 CodeQwen1.5-7B,一款支援 92 種程式語言與 64K 令牌上下文視窗的開源程式碼大型語言模型,以提升開發者生產力。
Ryght 案例研究:使用 Hugging Face 建構生命科學生成式 AI 平台
Ryght 已推出 Ryght Preview,一個面向醫療保健與生命科學的企業級生成式 AI 平台,利用 Hugging Face 的專家支援、TGI 與 TEI,提供安全、彈性且高效能的 AI 助手。
在 Hugging Face 端點上執行隱私保護推論
Hugging Face 與 Zama 已經實現了透過 Hugging Face 端點部署全同態加密(FHE)模型,使用者可以在加密資料上執行機器學習推論,而無需解密。
LiveCodeBench 排行榜:無汙染的程式碼 LLM 評估
Hugging Face 推出了 LiveCodeBench 排行榜,這是一項由加州大學伯克利分校、麻省理工學院與康乃爾大學的研究人員開發的新基準,用於評估 LLM 的程式碼生成與推理能力,並透過時間窗口的題目集防止基準汙染。
Gradio 重新載入模式加速 AI 應用程式開發
Gradio 的重新載入模式讓開發者能即時將來源程式碼變更套用至 AI 應用程式,無需重新啟動伺服器,顯著降低開發延遲。
Idefics2 8B 視覺語言模型發布 – 架構、資料與效能
Hugging Face 發布了 Idefics2,一款 8 億參數的開源視覺語言模型,在 VQA 與 OCR 基準測試上優於其他 8B 模型,且可透過 🤗 Transformers 直接進行微調。
OpenAI 日本啟動與 GPT-4 日文客製模型
OpenAI 在東京開設了首個亞洲辦公室,並推出了針對日語優化的 GPT-4 客製模型,其速度最高可比 GPT-4 Turbo 快 3 倍。
視覺語言模型說明
Hugging Face 提供了一份關於視覺語言模型(VLM)的完整指南,詳細說明了它們的架構、開源選項、評估基準,以及透過 TRL 函式庫進行微調的全新實驗性支援。
Hugging Face 與 Google Cloud Vertex AI Model Garden 整合
Hugging Face 推出了「Deploy on Google Cloud」,使用者可透過 Hugging Face Hub 或 Vertex Model Garden,將數千個開源基礎模型部署至 Vertex AI 或 Google Kubernetes Engine(GKE)。
CodeGemma 發行說明 / 新功能
Google 已發布 CodeGemma,這是一個基於 Gemma、開放存取、專注於程式碼的 LLM 系列,於額外 5000 億個程式碼、數學與英語語料的 token 上進行訓練。
Hugging Face 公共政策計畫概覽與提交的資料
Hugging Face 宣布了一項全面的跨功能公共政策計畫,為美國、歐盟與英國的政策制定者提供詳細的立場文件、證詞與意見信,彰顯其負責任開放的承諾並塑造 AI 法規。
Klarna AI 助理整合與績效結果
Klarna 部署了由 OpenAI 驅動的 AI 助理,處理了其三分之二的客服聊天,完成相當於 700 名全職客服人員的工作,同時提升了解決時間與利潤。
Hugging Face 與 Wiz 研究合作夥伴關係:AI 安全
Hugging Face 與 Wiz 合作,整合先進的漏洞管理與雲端安全姿態管理,以保護其平台及更廣泛的 AI/ML 生態系統。
Text2SQL 與 Hugging Face Dataset Viewer API 以及 DuckDB-NSQL-7B
Hugging Face 示範了如何使用 DuckDB-NSQL-7B 模型與 Dataset Viewer API,將自然語言問題轉換為 SQL 查詢,以分析超過 120,000 個開放資料集。
OpenAI 微調 API 改進與自訂模型計畫擴展
OpenAI 為其微調 API 引入了新的控制功能,並擴大了自訂模型計畫,加入協助微調與完全自訂訓練模型,以滿足特定領域的需求。
使用 🤗 Optimum Intel 在 Xeon 上加速 SetFit 推論
Hugging Face 示範了如何透過 🤗 Optimum Intel 函式庫的後訓練靜態量化,在 Intel Xeon CPU 上將 SetFit 模型的推論吞吐量提升至最高 7.8 倍。
Qwen1.5-32B 發布說明 / 有什麼新功能
Qwen 已發布 Qwen1.5-32B 與 Qwen1.5-32B-Chat,這兩款模型旨在在相較於 72B 版本的情況下,兼顧高效能與較低的記憶體與推論成本。
Hugging Face 與 Cloudflare Workers AI 整合
Hugging Face 整合 Cloudflare Workers AI,為受歡迎的開源模型提供無伺服器 GPU 推論,讓開發者能以按請求付費的計價模式部署 AI 應用。
OpenAI 與 Harvey 合作開發自訂案例法模型
OpenAI 與 Harvey 合作打造了一個自訂訓練的案例法模型,該模型納入了 100 億個美國案例法的 token,以提升推理能力並減少法律專業任務中的幻覺現象。
ChatGPT 存取更新:免註冊即時使用
OpenAI 已啟用即時使用 ChatGPT 的功能,無需註冊帳戶,擴大了 AI 對全球受眾的可及性。
Oscar Health AI 實施:降低成本與提升護理
Oscar Health 使用 OpenAI 的 API 自動化臨床文件與理賠處理,將文件時間減少 40%,升級解決時間減少 50%。