✷ 归档 · 11 个实验室 · 3,058 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Anthropic 前沿模型破坏行为评估
Anthropic 引入了一套全新的破坏行为评估框架,用于检测 AI 模型是否能够误导用户、插入隐藏漏洞、隐藏能力或破坏监督系统。
Mistral AI 发布 Ministral 3B 和 8B 边缘模型
Mistral AI 推出了 Ministral 3B 和 8B,这两款最先进的边缘模型专为设备端计算、低延迟智能体工作流和隐私优先的本地推理而设计。
Hugging Face Transformers 梯度累积修复
Hugging Face 已更新 Transformers Trainer,通过纠正跨批次的损失平均方式,确保梯度累积在数学上等同于完整批次训练。
Anthropic 推出基于特征的分类器,采用字典学习技术
Anthropic 的可解释性团队宣布了使用字典学习特征作为分类器的初步实验,为微调后的语言模型提供了一种快速且可解释的替代方案。
OpenAI 在 ChatGPT 中评估公平性的研究摘要
OpenAI 的研究发现,基于姓名的有害刻板印象出现在不到 0.1% 的 ChatGPT 回复中,且整体答案质量在性别和种族姓名提示下保持一致。
Anthropic 负责任缩放政策更新
Anthropic 更新了其负责任缩放政策 (RSP),引入了一个更灵活的风险治理框架,并设定了特定的性能阈值和按比例的 AI 安全等级 (ASL) 标准。
OpenAI MLE-bench:评估机器学习工程中的机器学习代理
OpenAI 推出 MLE-bench,这是一项使用 75 场 Kaggle 竞赛来衡量 AI 代理机器学习工程能力的基准,其中 o1-preview 在 16.9% 的任务中达到了铜牌水平。
Gradio 5 安全审查
Hugging Face 与 Trail of Bits 合作,对 Gradio 5 进行全面安全审计,修复了所有已识别的漏洞,确保机器学习应用默认安全。
AMD EPYC Turin CPU 实现比 Genoa 高出 2 倍的 LLM 推理吞吐量
AMD 第五代 EPYC Turin CPU 的 LLM 推理吞吐量约为 Genoa 的两倍,为 Hugging Face 工作负载实现更低的延迟和更高的吞吐量。
使用 Hugging Face 和 Dask 扩展 AI 数据处理规模
Hugging Face 和 Dask 通过分布式计算和多 GPU 并行推理,实现了 AI 数据处理从小规模本地样本到数亿行的扩展。
Gradio 5 发布说明
Hugging Face 已发布 Gradio 5,这是一款面向生产环境的框架,可使用 Python 构建高性能、可扩展且安全的机器学习 Web 应用程序。
OpenAI 与 Hearst 内容合作伙伴关系
OpenAI 与 Hearst 合作,将来自 20 多个杂志品牌和 40 多家报纸的内容整合到其 AI 产品(包括 ChatGPT)中,为用户提供更可靠且有引用的新闻报道。
Hugging Face Transformers 4.45.0 动态投机解码
Hugging Face 与 Intel Labs 在 Transformers 4.45.0 中引入了动态投机解码,通过根据模型置信度动态调整草稿 token 数量,实现了最高 **2.7 倍** 的文本生成加速。
Anthropic 美国大选准备工作
Anthropic 已实施了一套多层级的安全框架,包括使用政策更新、红队测试以及重定向至权威投票来源,以减轻 2024 年美国大选期间 AI 被滥用的风险。
在 Hugging Face Hub 上改进 Parquet 去重
Hugging Face 正在优化其存储架构以提升 Parquet 文件去重效率,提出基于内容定义的行组,以在数据集更新时降低存储开销。
Open FinLLM Leaderboard 发布 – 金融语言模型的全面零样本基准
Hugging Face 推出了 Open FinLLM Leaderboard,这是一项覆盖七大类、共 40 项金融专用任务的零样本基准,用于评估大型语言模型在真实金融场景中的准备程度。
OpenAI Canvas 测试版发布:用于 ChatGPT 的协作写作和编码界面
OpenAI 推出了 Canvas,这是一款测试版界面,允许 ChatGPT 在写作和编码项目中进行协作,支持内联编辑、版本控制和专用快捷键,最初面向 Plus 和 Team 用户推出。
OpenAI 建立 40 亿美元信用额度以提升财务灵活性
OpenAI 与全球银行联盟建立了 40 亿美元循环信用额度,以提升流动性并支持 AI 研究和基础设施的扩展。
中国人工智能全球扩张分析
中国人工智能公司正因国内市场饱和、激烈的价格战和监管压力而加速国际扩张,目标市场包括东南亚、中东以及西方消费市场。
OpenAI 融资公告 2024年10月
OpenAI 在后估值为1570亿美元的情况下,获得了66亿美元的新融资,以加速前沿 AI 研究并提升计算能力。
OpenAI 实时 API 发布
OpenAI 已在公开测试中推出实时 API,使开发者能够使用 GPT-4o 构建低延迟、多模态的语音对语音体验。
GPT-4o 视觉微调 API 发布
OpenAI 为 GPT-4o 引入了视觉微调,使开发者能够使用图像-文本数据集定制模型,以提升专门的视觉理解和目标检测能力。
OpenAI 提示缓存 API 发布
OpenAI 为 GPT-4o、GPT-4o mini、o1-preview 和 o1-mini 引入了提示缓存,提供 50% 的折扣并降低重复使用输入令牌的延迟。
OpenAI 模型蒸馏 API 集成
OpenAI 推出了一个集成的模型蒸馏套件,使开发者能够使用诸如 o1-preview 和 GPT-4o 等前沿模型的输出,对更小的模型(如 GPT-4o mini)进行微调并提升其性能。
OpenAI 与 Altera:使用 GPT-4o 创建协作式数字人类
Altera 开发了自主 AI 代理,称为数字人类,能够在类似《Minecraft》的环境中与人协作,采用受大脑启发的架构并由 GPT-4o 提供动力。
BenCzechMark:面向捷克语 LLM 的综合评估套件
Hugging Face 与学术合作伙伴发布了 BenCzechMark,这是首个面向捷克语模型的综合评估套件,包含 9 个类别的 50 项任务,并采用新颖的基于对决的计分机制。
OpenAI 打击 STORM-0817 伊朗关联的恶意软件活动
OpenAI 已禁用伊朗基地威胁行为体 STORM-0817 用于开发 Android 恶意软件、抓取 Instagram 个人资料以及对巴基斯坦网络安全专业人士进行侦察的账户。
OpenAI 打击与中国关联的 SweetSpecter 网络活动
OpenAI 识别并封禁了与中国籍对手 SweetSpecter 关联的账户,该对手试图利用 ChatGPT 进行攻击性网络行动,并对 OpenAI 员工发动了鱼叉式网络钓鱼攻击。
OpenAI 调查:伪造的俄罗斯网络喷子错误信息骗局
OpenAI 已驳斥了一则声称揭露俄罗斯网络喷子账户 GPT-4o 错误信息的病毒式帖子,揭示该事件是一次手工制作的骗局,可能起源于美国。
OpenAI 打击与伊朗关联的 CyberAv3ngers 网络研究活动
OpenAI 已封禁与伊朗关联的威胁组织 CyberAv3ngers 相关的账户,该组织利用大型语言模型进行侦察、代码调试以及针对工业控制系统的漏洞研究。
OpenAI 打击“Stop News”俄罗斯影响行动
OpenAI 禁用了一个由俄罗斯发起的影响行动——“Stop News”使用的多个 ChatGPT 账户,该行动利用 AI 生成的文本和图像冒充新闻媒体并建立欺骗性合作伙伴关系。
OpenAI 打击 A2Z 行动的多语言影响活动
OpenAI 封禁了一批使用其 API 进行多语言影响行动的账户,该行动被称为 Operation A2Z,利用 AI 管理虚假人格并在 X 与 Facebook 上生成政治内容。
OpenAI 打击 Bet Bot 赌博垃圾信息网络
OpenAI 封禁了一批通过以色列初创公司使用其 API 在 X 上运营赌博垃圾信息网络的账户,利用 AI 生成的身份诱导用户访问赌博网站。
OpenAI 打击 STORM-2035 伊朗影响行动
OpenAI 封禁了伊朗起源的行为者(代号 Storm-2035)使用的 ChatGPT 账户,这些账户用于生成针对美国选举及其他全球政治议题的欺骗性长篇文章和社交媒体评论。
OpenAI 打击卢旺达选举政治评论网络
OpenAI 禁止了在卢旺达使用的一个 ChatGPT 账户网络,该网络用于生成偏袒选举内容,并试图通过大规模评论刷屏操纵 X 趋势。
OpenAI Tort Report: Disrupting Abusive Reporting Activity
OpenAI 封禁了参与 "Tort Report" 的账号,这是一项 Category 1 影响力行动,利用 AI 生成针对 Facebook 和 YouTube 上越南独立媒体机构的笼统报告。
OpenAI 打击“腐败评论”影响行动
OpenAI 禁止了一批用于在 X 上生成英文评论、针对反腐基金会及阿列克谢·纳瓦尔尼关联人士的 API 活动。
Anthropic Circuits 2024 年 9 月更新
Anthropic 2024 年 9 月的 Circuits 更新提供了关于多智能体系统失败、工人再培训项目证据以及 Claude 研究版本在黎曼ζ函数方面进展的初步研究。
将顶点着色网格转换为纹理网格
Hugging Face 推出了一种方法和 InstantTexture 库,用于将顶点着色的 3D 网格转换为 UV 映射的纹理网格,以提升应用兼容性。
OpenAI 监管 API 更新:omni-moderation-latest 模型发布
OpenAI 已发布 omni-moderation-latest,这是一款基于 GPT-4o 的多模态监管模型,提升了文本和图像的有害内容检测准确性,尤其在非英语语言方面表现更佳。
明尼苏达企业翻译办公室 ChatGPT 集成
明尼苏达州企业翻译办公室已集成 ChatGPT,以加速政府翻译服务,将周转时间从数周缩短至48小时以内,并每月节省超过10万美元。
OpenAI 与 GEDI 的意大利新闻内容战略合作伙伴关系
OpenAI 与 GEDI 合作,将《La Repubblica》和《La Stampa》等出版物的高质量意大利语新闻内容整合到 ChatGPT 和 SearchGPT 中。
Llama 3.2 发布说明:多模态视觉与设备端小型语言模型
Meta 已发布 Llama 3.2,推出 11B 与 90B 规模的多模态视觉能力,以及针对设备端部署优化的轻量级 1B 与 3B 纯文本模型。
Ollama 对 Llama 3.2 的支持
Ollama 现在支持 Meta 的 Llama 3.2,引入了适用于边缘设备的轻量级 1B 和 3B 纯文本模型,以及即将推出的具备视觉能力的 11B 和 90B 模型。
Mercado Libre Verdi AI 开发平台发布
Mercado Libre 推出 Verdi,这是一款基于 GPT‑4o 的 AI 开发平台,使其开发者能够创建安全、自治的 LLM 应用,首个案例是处理 10% 争议的 AI 驱动客服调解。
Hugging Face 每日论文功能指南
Hugging Face 的每日论文页面提供了一个由社区策划的 AI 研究中心,具备作者认领、论文提交以及研究者与开发者之间直接互动的工具。
FineVideo 数据集发布
Hugging Face 已发布 FineVideo,这是一套高质量的开放视频数据集,包含 43,000 条视频(3,400 小时),提供丰富的结构化注释,用于视频理解和生成式 AI 训练。
使用 Optimum-Intel 和 OpenVINO GenAI 优化与部署 Hugging Face 模型
Hugging Face 与 Intel 提供了一套简化的工作流,使用 Optimum-Intel 和 OpenVINO GenAI 在 Intel 硬件上优化并部署 Transformers 模型,专注于边缘和客户端的 C++ 与 Python 环境。
Genmab “AI Everywhere” 推出:企业 ChatGPT 扩展及 100 多个定制 GPT 用于生物技术
Genmab 将 ChatGPT Enterprise 扩展至 2000 多名员工,并部署了 100 多个定制 GPT,使每位用户每周节省 3.5 小时,推动生物技术研究和文档工作。
Anthropic 上下文检索技术提升 RAG 准确性
Anthropic 宣布推出上下文检索技术,这是一种预处理方法,通过在嵌入和 BM25 索引中添加与块相关的上下文信息,将前 20 个块的检索失败率降低高达 67%,并实现更低成本、更可靠的检索增强生成。