✷ 归档 · 11 个实验室 · 3,058 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Anthropic 系列 E 轮融资与战略增长
Anthropic 已完成 35 亿美元的系列 E 融资,融资后估值达 615 亿美元,旨在推进下一代 AI 系统并扩大计算能力。
OpenAI 和美国国家实验室 1,000 科学家 AI Jam Session
OpenAI 和美国能源部在九个国家实验室组织了 '1,000 科学家 AI Jam Session',利用如 o3-mini 这样的前沿 AI 模型加速科学发现。
使用 Arize Phoenix 对 smolagents 进行跟踪与评估
Hugging Face 演示了如何将 Arize Phoenix 与 smolagents 结合使用,以实现对代理工作流的实时跟踪和基于 LLM‑as‑a‑judge 的评估。
Anthropic 与美国国家实验室合作开展 1,000 位科学家 AI Jam
Anthropic 正与美国能源部合作开展首届 1,000 位科学家 AI Jam,以评估 Claude 3.7 Sonnet 在科学研究和国家安全应用方面的能力。
Mercari 与 GPT-4o mini 的 AI 集成
Mercari 已将 GPT-4o mini 和其他 OpenAI 模型集成,以自动化产品列表生成并优化销售建议,从而提高了列表转化率和每位用户的平均销售额。
OpenAI GPT-4.5 研究预览
OpenAI 已发布 GPT-4.5,这是一个大规模通用模型,旨在相比 GPT-4o 提供更广泛的知识、改进的情感智能和减少的幻觉。
使用 o1 和 o3-mini 构建自主金融分析师
Endex 正在利用 OpenAI 的 o1 和 o3-mini 推理模型构建一个自主的 AI 金融分析师,能够进行复杂的数据合成、多模态分析和精确的金融推理。
Hugging Face 和 IISc 合作开源 Vaani 数据集
Hugging Face 与印度科学院(IISc)和 ARTPARK 合作,提供对 Vaani 的全球访问,Vaani 是一个旨在代表印度语言多样性的大规模多模态多语言数据集。
Anthropic Transparency Hub Launch
Anthropic 推出了 Transparency Hub,旨在提供一个统一的框架来报告安全协议、风险缓解策略和运营指标,以确保 AI 系统是安全且值得信赖的。
Claude 和 Alexa+ 集成
Anthropic 宣布 Claude 模型现在为 Alexa+ 提供动力,通过 Amazon Bedrock 集成了先进的 AI 能力和安全功能,并计划在未来几周内在美国推出。
OpenAI Deep Research 系统卡片
OpenAI 已推出 Deep Research,这是一种由早期版本的 o3 驱动的、针对网页浏览进行了优化的代理式能力,用于执行复杂任务的多步骤互联网研究。
FastRTC: 用于 Python 的实时通信库
Hugging Face 发布了 FastRTC,这是一个旨在通过处理 WebRTC 和 WebSocket 通信层来简化实时音视频 AI 应用开发的 Python 库。
Anthropic 研究:预测语言模型中的罕见行为
Anthropic 开发了一种利用幂律分布的方法,基于小规模的部署前评估,来预测部署规模下罕见且危险的 AI 行为。
Ollama Minions: 本地与云端 LLM 混合协作
Ollama 引入了 Minions,这是一个由斯坦福大学 Hazy Research 开发的框架,通过将工作负载委托给 Llama 3.2 等本地模型,在保持高性能的同时降低了云端 LLM 成本。
QwQ-Max-Preview 发布
Qwen 已推出 QwQ-Max-Preview,一个基于 Qwen2.5-Max 构建的预览推理模型,在数学、编码和 Agent 相关工作流程方面表现出色。
Hugging Face 远程 VAEs 用于推理端点
Hugging Face 推出了一项实验功能,将 VAE 解码过程委托给远程端点,以降低消费级 GPU 上高分辨率图像和视频合成的显存需求。
Claude 3.7 Sonnet 扩展思考模式发布
Anthropic 发布了 Claude 3.7 Sonnet,该模型具备可切换的扩展思考模式,使模型能为复杂问题分配更多计算资源,并向用户提供可见的原始思维过程。
Claude 3.7 Sonnet and Claude Code Release
Anthropic 发布了 Claude 3.7 Sonnet,这是首款能够同时提供近乎即时响应和扩展思考能力的混合推理模型,并推出了用于 agentic 编程的命令行工具 Claude Code。
OpenAI 阻断 AI 的恶意使用
OpenAI 已发布一份报告,详细说明其阻断恶意 AI 使用的努力,重点在于防止国家关联的威胁行为者和威权政权利用 AI 进行隐蔽影响行动和网络活动。
SigLIP 2 发布说明 / 新特性
Google 发布了 SigLIP 2,这是一个多语言视觉语言编码器系列,在零样本分类、图像-文本检索和 VLM 迁移性能方面在所有规模上均优于原始 SigLIP。
Uber AI 集成用于按需服务
Uber 使用 OpenAI 的技术来个性化用户互动,自动化复杂的市场解决方案,并通过 AI 驱动的协作者提升劳动力生产力。
SmolVLM2: 让每台设备都能理解视频
Hugging Face 发布了 SmolVLM2,这是一系列高效的视觉和视频语言模型,参数规模为 2.2B、500M 和 256M,旨在使从手机到服务器的设备能够进行本地视频理解。
Anthropic Crosscoder Model Diffing 研究
Anthropic 的可解释性团队正在探索 Crosscoder Model Diffing,以分析 AI 模型之间的差异,这些发现被作为初步研究结果呈现。
PaliGemma 2 Mix 发布说明
Google 已发布 PaliGemma 2 mix,这是一系列在包括 OCR、标题生成和目标检测在内的多样化任务上微调的视觉语言模型,以展示 PaliGemma 2 预训练检查点的潜力。
Grok 3 Beta 发布说明 / 新特性
xAI 推出了 Grok 3 Beta,这是一个全新的模型系列,具有先进的推理能力和 DeepSearch 智能体,在 Colossus 超级集群上训练,计算量是之前 SOTA 模型的 10 倍。
OpenAI SWE-Lancer 基准发布
OpenAI 推出了 SWE-Lancer,一个包含超过 1,400 个来自 Upwork 的真实世界自由职业软件工程任务的基准,用于衡量 AI 模型在软件开发中的经济影响和技术能力。
Hugging Face 添加 Hyperbolic、Nebius AI Studio 和 Novita 作为 Serverless 推理提供商
Hugging Face 已将 Hyperbolic、Nebius AI Studio 和 Novita 集成作为 Serverless 推理提供商,通过 Hub 和客户端 SDK 直接扩展对 DeepSeek-R1 和 FLUX.1 等模型的访问。
Mistral Saba: 针对中东和南亚地区的专业区域语言模型
Mistral AI 发布了 Mistral Saba,这是一个针对阿拉伯语和印度起源语言优化的 24B 参数模型,旨在提供比大型通用模型更高的准确度和更低的延迟。
OpenAI 和 Guardian Media Group 内容合作伙伴关系
OpenAI 和 Guardian Media Group 已建立战略合作伙伴关系,将 Guardian 编辑内容整合到 ChatGPT 中,为每周 3 亿用户提供直接访问可信报道和扩展摘要的途径。
Hugging Face Open LLM Leaderboard 更新:集成 Math-Verify 以改进数学评估
Hugging Face 使用 Math-Verify 重新评估了 Open LLM Leaderboard 上的 3,751 个模型,以修复解析错误和格式严格性,导致 MATH-Hard 排名发生显著变动。
Hugging Face 将 Fireworks.ai 集成作为推理提供商
Hugging Face 已在 Hub 上添加 Fireworks.ai 作为受支持的推理提供商,使得如 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 等模型能够在 HF 生态系统中进行无服务器推理。
Anthropic 与英国政府签署谅解备忘录以转型公共服务
Anthropic 已与英国科学、创新和技术部签署了谅解备忘录,旨在探索使用 Claude AI 来增强公共服务并建立负责任的部署实践。
Fanatics Betting and Gaming 在金融领域的 AI 应用
Fanatics Betting and Gaming 正在利用 ChatGPT 和定制化 GPTs 来自动化手动财务任务,减少每月工作量并加速战略决策。
Wayfair AI 实施与策略
Wayfair 正在集成 OpenAI 的生成式 AI 和多模态功能,以个性化电子商务体验,现代化遗留代码库,并在法律工作流程中自动化风险分析。
Rogo 使用 OpenAI o1 和 GPT-4o 扩展金融研究
Rogo 利用包含 OpenAI o1 和 GPT-4o 的分层模型架构来自动化金融研究和尽职调查,每周为分析师节省超过 10 小时。
Hugging Face: 优化 10亿次分类的成本和延迟
Hugging Face 提供了一个框架和基准,用于降低大规模编码器模型推理的成本,表明 NVIDIA L4 GPU 和优化的批次大小可以以低至 253.82 美元处理 10亿 次文本分类。
OpenAI Model Spec 更新
OpenAI 已在 CC0 许可证下发布了更新的 Model Spec,以定义 AI 行为,优先考虑用户可定制性和知识自由,同时保持安全防护措施。
Hugging Face 视频数据集脚本
Hugging Face 推出了一套开源视频数据集脚本,旨在简化高质量、过滤后的数据集的创建,用于微调视频生成模型。
Hugging Face Xet支持的仓库:通过块级聚合加速Hub传输
Hugging Face 正在引入一个基于块的去重系统,使用 xet-core 和 hf_xet,通过块级聚合将上传和下载速度提高 2-3 倍。
Anthropic 关于巴黎 AI 行动峰会的声明
Anthropic CEO Dario Amodei 呼吁针对 AI 安全、AI 开发中的民主领导地位以及经济动荡采取紧急的全球行动,因为 AI 能力在 2026-2030 年间将接近“天才国家”的水平。
Open R1 Update #2: OpenR1-Math-220k 数据集和推理洞察
Hugging Face 介绍了 OpenR1-Math-220k,这是一个旨在重建 DeepSeek R1 蒸馏管道的大规模数学推理数据集,同时分享了社区关于 GRPO 和 Chain-of-Thought 长度控制的见解。
OpenAI 与 Schibsted 媒体集团合作伙伴关系
OpenAI 已与 Schibsted 媒体集团合作,将 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等标题的高质量北欧新闻内容整合到 ChatGPT 中。
开放阿拉伯LLM排行榜 2
Hugging Face及其合作伙伴发布了开放阿拉伯LLM排行榜2(OALL v2),用本地阿拉伯数据集和新的RAG评估框架取代了饱和和机器翻译的基准,以更准确地衡量阿拉伯语能力。
Anthropic 经济指数发布及初步发现
Anthropic 发布了经济指数,这是一项基于数百万条 Claude.ai 对话的、关于 AI 在各职业中使用的驱动数据研究,并发布了底层数据集以供开放研究。
Anthropic 经济指数:分析 AI 对劳动力市场的影响
Anthropic 推出了经济指数和配套的开源数据集,以追踪 AI 在现实世界职业任务中的实际使用情况,揭示了目前的使用趋势更倾向于于增强而非自动化。
OpenAI 介绍智能时代
OpenAI 将智能时代定义为由 AI 驱动的技术进步的新时代,强调其作为提升人类生产力、创造力和科学发现的工具的作用。
Mistral AI le Chat 更新 2025 年 2 月
Mistral AI 发布了更新后的 le Chat AI 助手,其特点是高速推理、集成的网络搜索、代码执行以及新的 Pro、Team 和 Enterprise 层级。
Lyft 集成 Claude AI 以提升乘客和司机的体验
Lyft 正与 Anthropic 合作在其平台上部署 Claude AI,通过 Amazon Bedrock 已经实现了客户服务解决时间减少 87% 的成果。
OpenAI 在欧洲的数据驻留及全球扩张
OpenAI 已在欧洲推出数据驻留选项,并将这些能力扩展到全球,以帮助组织满足本地数据主权和合规要求。
OpenAI 和加州州立大学系统部署 ChatGPT Edu
OpenAI 和加州州立大学(CSU)系统已启动迄今为止规模最大的 ChatGPT 部署,为 23 个校区的超过 520,000 名学生和教职员工提供 ChatGPT Edu 访问权限。