✷ 归档 · 11 个实验室 · 3,058 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Hugging Face 使用 Infisical 的机密管理扩展
Hugging Face 迁移至 Infisical,以在多云环境中实现机密管理的集中化,消除机密散乱,并通过自动化的 Kubernetes 集成和 RBAC 提升安全性。
文本生成推理 (TGI) Intel Gaudi 集成
Hugging Face 已将 Intel Gaudi 硬件支持直接集成到 Text Generation Inference (TGI) 主代码库中,为在 Intel AI 加速器上运行 LLM 提供了生产就绪的服务解决方案。
QVQ-Max 视觉推理模型发布
Qwen 已发布 QVQ-Max,这是一款能够分析图像和视频,以解决数学、编程和创意任务中复杂问题的视觉推理模型。
Zendesk 与 OpenAI:向主动 AI 代理转型以提升客户服务
Zendesk 正在试点一类由 OpenAI 模型驱动的 AI 代理,利用生成式推理和多代理架构,实现高达 80% 的客户服务解决方案自动化。
Anthropic 对 Claude 3.5 Haiku 思维的追踪:新型可解释性显微镜与人工智能生物学新发现
Anthropic 发布了两篇论文,介绍了用于大型语言模型的电路追踪“显微镜”方法,并将其应用于 Claude 3.5 Haiku,揭示了多语言共享概念、诗歌生成中的长程规划、心算的并行路径,以及幻觉、越狱和不忠实推理背后的机制。
Anthropic 经济指数:来自 Claude 3.7 Sonnet 的洞察
Anthropic 的第二份经济指数报告显示,Claude 3.7 Sonnet 增加了编程、教育和科学领域的 AI 用量,同时在增强与自动化之间保持了稳定的平衡。
Anthropic Economic Index: Insights from Claude 3.7 Sonnet
Anthropic 的第二份 Economic Index 报告显示,Claude 3.7 Sonnet 在编程、教育和科学领域的使用量有所增加,其 extended thinking 模式主要承担技术和创意问题解决的角色。
DeepSeek-V3-0324 发布说明
DeepSeek 发布了 DeepSeek-V3-0324,这是 R1 的基座模型更新版本,采用 MIT 许可证,并在指令遵循、编程和数学能力方面有所提升。
Qwen2.5-Omni 发布:用于实时交互的端到端多模态模型
Qwen 发布了 Qwen2.5-Omni,这是一款端到端多模态模型,能够处理文本、图像、音频和视频,以生成实时流式文本和自然语音响应。
OpenAI 面向 AGI 开发的安全策略
OpenAI 正在实施一个多层次的安全框架,结合 AI 驱动的防御、持续的红队演练以及零信任架构,以在向 AGI 迈进的过程中保护基础设施和新兴的 AI 代理。
使用 Sentence Transformers 训练和微调重新排序模型
Hugging Face 通过 Sentence Transformers 提供了完整的指南和框架,用于训练和微调 Cross Encoder 重新排序模型,以优化特定领域的检索性能。
OpenAI GPT-4o 图像生成发布
OpenAI 已将原生图像生成集成到 GPT-4o 中,使其能够在单一多模态模型中实现精确的文本渲染、多轮细化以及高保真度的写实效果。
GPT-4o 图像生成系统卡片附录
OpenAI 已在 GPT-4o 中原生嵌入了一种新的图像生成功能,能够实现照片级真实感输出、图像到图像的转换以及精确的文本渲染。
Hebbia Matrix: 使用多代理 AI 自动化金融和法律工作流
Hebbia 推出了 Matrix,这是一款由 OpenAI 的 o1、o3-mini 和 GPT-4o 提供动力的多代理 AI 平台,通过克服离线数据的 RAG 限制,实现了金融和法律工作高达 90% 的自动化。
DeepSeek-V3-0324 发布说明
DeepSeek 已发布 DeepSeek-V3-0324,具备改进的推理、前端开发和工具使用能力,现可按 MIT 许可证获取。
OpenAI 领导层更新 2025年3月
OpenAI 已扩大 Mark Chen、Brad Lightcap 和 Julia Villagra 的职务,以更好地整合研究与产品开发并扩大全球运营。
Gradio 数据框更新:新功能和增强
Hugging Face 已更新 Gradio 中的 gr.Dataframe 组件,新增多单元格选择、列固定、搜索与过滤功能,并提升了可访问性。
Qwen2.5-VL-32B 发布说明
Qwen 已发布 Qwen2.5-VL-32B-Instruct,这是一款通过强化学习优化的视觉语言模型,具备卓越的数学推理能力、细粒度的图像理解以及符合人类偏好的响应。
OpenAI 与 MIT Media Lab 关于 ChatGPT 情感使用的研究
OpenAI 与 MIT Media Lab 对情感使用——即与 AI 的情感交互——进行了研究,发现虽然此类使用在真实世界中很少见,但其对福祉的影响因用户行为、交互方式和个人情况而异。
Hugging Face 推理端点分析更新
Hugging Face 更新了其推理端点分析仪表板,加入实时指标、可自定义时间范围以及详细的副本生命周期视图,以提升监控和调试能力。
Booking.com 与 OpenAI 个性化集成
Booking.com 已集成 OpenAI 的 GPT 模型,通过 AI 行程规划器、智能筛选和自动化评论摘要,彻底改变旅行发现和预订方式。
OpenAI 下一代音频模型 API 发布
OpenAI 在其 API 中发布了新的语音转文本和文本转语音模型,具备提升的转录准确性和可引导的合成语音,供语音代理使用。
Open R1:在本地运行 OlympicCoder 7B 进行编码
Hugging Face 提供了一份指南,介绍如何使用 LM Studio 和 Continue VS Code 扩展在本地部署 OlympicCoder 7B 模型,以实现可与 Claude 3.7 Sonnet 和 GPT-4o 在 LiveCodeBench 上竞争的编码性能。
Hugging Face 对白宫 AI 行动计划信息请求的回应
Hugging Face 主张开源和开放科学在 AI 开发中的根本作用,认为开源模型在性能和效率方面正日益匹配甚至超越闭源商业系统。
Anthropic 前沿红队进展报告
Anthropic 报告称,前沿 AI 模型在网络安全和生物学领域显示出快速进展的“早期预警”迹象,尽管目前仍低于构成实质性提升的国家安全风险阈值。
Anthropic 对加州州长 Newsom 的 AI 工作组草案报告做出回应
Anthropic 对加州州长 Newsom 的 AI 工作组草案报告表示欢迎,支持其对客观标准和透明度的呼吁,同时概述了该实验室现有的安全、安全性和第三方测试做法,并敦促通过轻度监管来扩大行业透明度。
EliseAI: 通过 OpenAI 提升住房和医疗效率
EliseAI 利用 OpenAI 的 GPT-4 和 Whisper 模型,在住房和医疗行业自动化复杂的对话工作流,以提高运营效率。
ChatGPT for Business 2025年3月更新
OpenAI 在 2025 年 3 月为 ChatGPT for Business 引入了新功能,包括 Canvas、深度研究工具和 OpenAI o1 pro 模式。
NVIDIA GTC 2025 物理 AI 发布:Cosmos Transfer、物理 AI 数据集和 Isaac GR00T N1
NVIDIA 已发布用于可控世界场景生成的 Cosmos Transfer、一个 15TB 物理 AI 数据集以及 Isaac GR00T N1,这是首个用于通用人形机器人推理的开放基础模型。
Hugging Face Xet 存储集成
Hugging Face 已开始将仓库从 LFS 迁移到 Xet 存储,利用内容定义分块技术显著缩短了海量 AI 模型和数据集的上传与下载时间。
Mistral Small 3.1 发布说明
Mistral AI 发布了 Mistral Small 3.1,这是一款采用 Apache 2.0 协议授权的模型,具备多模态理解能力、128k token 上下文窗口,且性能表现优于 GPT-4o Mini 和 Gemma 3。
OpenAI 对埃隆·马斯克诉讼法院裁决的回应
OpenAI 宣布,法院已驳回埃隆·马斯克申请初步禁令的请求,并驳回了他的几项主张, affirming OpenAI 对维持其非营利实体的承诺。
Anthropic 推出使用隐藏目标语言模型的对齐审计
Anthropic 发布了一篇论文,描述了一场盲审计游戏:研究人员训练了一个具有隐蔽奖励模型奉承目标的语言模型,并评估了八种检测此类隐藏非对齐目标的技术。
LY Corporation 与 OpenAI 合作
LY Corporation 正在利用 OpenAI 的 API 和 GPT-4o 在其 LINE 和 Yahoo! JAPAN 平台上整合生成式 AI,预计年度销售额增加 110B yen,生产力提升 10B yen.
Gemma 3 发行说明 / 新功能
Google 发布了 Gemma 3,这是一个多模态、多语言的开放权重 LLM 家族,参数规模从 1B 到 27B,上下文窗口可达 128k 标记。
Open R1 Update #3: OlympicCoder 和代码推理洞察
Hugging Face 推出 OlympicCoder,一组在 IOI 问题上优于前沿模型的代码推理模型,并附带新数据集和训练推理模型的技术经验。
OpenAI 用于构建代理的新工具
OpenAI 发布了一套新的代理构建工具,包括 Responses API、开源 Agents SDK 以及用于网页搜索、文件搜索和计算机使用的内置工具。
LeRobot L2D: 世界上最大的开源自动驾驶数据集
Hugging Face 和 Yaak 发布了 Learning to Drive (L2D),这是一个多模态自动驾驶数据集,包含来自 30 个德国城市的超过 5,000 小时的驾驶数据,以实现端到端的空间智能训练。
OpenAI 链式思维监控用于奖励黑客检测
OpenAI 已经发现,监控链式思维(CoT)推理可以检测前沿模型中的奖励黑客和不当行为,但直接优化 CoT 以抑制不良思维可能导致模型隐藏其意图。
Nubank 集成 OpenAI GPT-4o 用于客户服务和欺诈检测
Nubank 正利用 OpenAI 的 GPT-4o 和 GPT-4o mini 自动化处理 55% 的一级客户咨询,将聊天响应时间降低 70%,并通过基于视觉的分析增强欺诈检测。
边缘上的LLM推理:通过React Native运行本地LLM
Hugging Face 提供了一份全面的指南,使用 React Native 和 llama.rn 在 Android 和 iOS 上本地运行量化的 GGUF 模型,构建注重隐私的移动应用。
Mistral OCR 发布说明
Mistral AI 推出了 Mistral OCR,这是一款高精度的光学字符识别 API,旨在从复杂文档中提取交错的文本、图像、表格和公式,用于 RAG 系统。
Factory 使用 OpenAI 推理模型的软件开发平台
Factory 利用 OpenAI o1、o3-mini 和 GPT-4o 将特性开发周期提升 2-4 倍,并将上下文切换时间降低 60%。
Anthropic 向 OSTP 提交的美国 AI 行动计划建议
Anthropic 向美国科学技术政策办公室 (OSTP) 提交了一份包含六个要点的建议方案,敦促在安全测试、出口管制、实验室安全、能源基础设施、政府 AI 采用以及经济数据方面采取果断行动,为预计在 2026-27 年出现的强大 AI 系统做好准备。
QwQ-32B 发布说明 / 新功能
Qwen 发布了 QwQ-32B,这是一个 320亿参数的推理模型,利用扩展的强化学习来实现与更大的 DeepSeek-R1 相当的性能。
Mistral AI 用于产品开发的智能体工作流
Mistral AI 推出了一种由 Mistral Large 2 提供动力的智能体工作流,可实现会议记录到产品需求文档 (PRD) 和可执行工程任务单的自动化转换。
LaunchDarkly 的 AI 驱动产品管理方法
LaunchDarkly 首席产品与技术官 Claire Vo 阐述了 AI 如何自动化传统产品管理任务,并将角色推向商业通用管理或集成技术领导。
OpenAI NextGenAI 联盟启动
OpenAI 已启动 NextGenAI,这是一个由 15 家研究机构组成的联盟,获得 $50 million 的资助、算力和 API 访问支持,以加速 AI 驱动的研究和教育。
Aya Vision: 使用 8B 和 32B 模型推进多语言多模态
Cohere For AI 发布了 Aya Vision,这是一系列支持 23 种语言的开放权重视觉语言模型(8B 和 32B),在多语言多模态任务中表现优于更大的模型。
Hugging Face 与 JFrog 合作以增强 AI 模型安全
Hugging Face 已将 JFrog 的扫描器集成到 Hugging Face Hub,以减少误报并在各种序列化格式中检测模型权重内的恶意代码。