Uber AI 集成用于按需服务
Uber 使用 OpenAI 的技术来个性化用户互动,自动化复杂的市场解决方案,并通过 AI 驱动的协作者提升劳动力生产力。
SmolVLM2: 让每台设备都能理解视频
Hugging Face 发布了 SmolVLM2,这是一系列高效的视觉和视频语言模型,参数规模为 2.2B、500M 和 256M,旨在使从手机到服务器的设备能够进行本地视频理解。
PaliGemma 2 Mix 发布说明
Google 已发布 PaliGemma 2 mix,这是一系列在包括 OCR、标题生成和目标检测在内的多样化任务上微调的视觉语言模型,以展示 PaliGemma 2 预训练检查点的潜力。
OpenAI SWE-Lancer 基准发布
OpenAI 推出了 SWE-Lancer,一个包含超过 1,400 个来自 Upwork 的真实世界自由职业软件工程任务的基准,用于衡量 AI 模型在软件开发中的经济影响和技术能力。
Hugging Face 添加 Hyperbolic、Nebius AI Studio 和 Novita 作为 Serverless 推理提供商
Hugging Face 已将 Hyperbolic、Nebius AI Studio 和 Novita 集成作为 Serverless 推理提供商,通过 Hub 和客户端 SDK 直接扩展对 DeepSeek-R1 和 FLUX.1 等模型的访问。
OpenAI 和 Guardian Media Group 内容合作伙伴关系
OpenAI 和 Guardian Media Group 已建立战略合作伙伴关系,将 Guardian 编辑内容整合到 ChatGPT 中,为每周 3 亿用户提供直接访问可信报道和扩展摘要的途径。
Hugging Face Open LLM Leaderboard 更新:集成 Math-Verify 以改进数学评估
Hugging Face 使用 Math-Verify 重新评估了 Open LLM Leaderboard 上的 3,751 个模型,以修复解析错误和格式严格性,导致 MATH-Hard 排名发生显著变动。
Hugging Face 将 Fireworks.ai 集成作为推理提供商
Hugging Face 已在 Hub 上添加 Fireworks.ai 作为受支持的推理提供商,使得如 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 等模型能够在 HF 生态系统中进行无服务器推理。
Fanatics Betting and Gaming 在金融领域的 AI 应用
Fanatics Betting and Gaming 正在利用 ChatGPT 和定制化 GPTs 来自动化手动财务任务,减少每月工作量并加速战略决策。
Wayfair AI 实施与策略
Wayfair 正在集成 OpenAI 的生成式 AI 和多模态功能,以个性化电子商务体验,现代化遗留代码库,并在法律工作流程中自动化风险分析。
Rogo 使用 OpenAI o1 和 GPT-4o 扩展金融研究
Rogo 利用包含 OpenAI o1 和 GPT-4o 的分层模型架构来自动化金融研究和尽职调查,每周为分析师节省超过 10 小时。
Hugging Face: 优化 10亿次分类的成本和延迟
Hugging Face 提供了一个框架和基准,用于降低大规模编码器模型推理的成本,表明 NVIDIA L4 GPU 和优化的批次大小可以以低至 253.82 美元处理 10亿 次文本分类。
OpenAI Model Spec 更新
OpenAI 已在 CC0 许可证下发布了更新的 Model Spec,以定义 AI 行为,优先考虑用户可定制性和知识自由,同时保持安全防护措施。
Hugging Face 视频数据集脚本
Hugging Face 推出了一套开源视频数据集脚本,旨在简化高质量、过滤后的数据集的创建,用于微调视频生成模型。
Hugging Face Xet支持的仓库:通过块级聚合加速Hub传输
Hugging Face 正在引入一个基于块的去重系统,使用 xet-core 和 hf_xet,通过块级聚合将上传和下载速度提高 2-3 倍。
Open R1 Update #2: OpenR1-Math-220k 数据集和推理洞察
Hugging Face 介绍了 OpenR1-Math-220k,这是一个旨在重建 DeepSeek R1 蒸馏管道的大规模数学推理数据集,同时分享了社区关于 GRPO 和 Chain-of-Thought 长度控制的见解。
OpenAI 与 Schibsted 媒体集团合作伙伴关系
OpenAI 已与 Schibsted 媒体集团合作,将 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等标题的高质量北欧新闻内容整合到 ChatGPT 中。
开放阿拉伯LLM排行榜 2
Hugging Face及其合作伙伴发布了开放阿拉伯LLM排行榜2(OALL v2),用本地阿拉伯数据集和新的RAG评估框架取代了饱和和机器翻译的基准,以更准确地衡量阿拉伯语能力。
OpenAI 介绍智能时代
OpenAI 将智能时代定义为由 AI 驱动的技术进步的新时代,强调其作为提升人类生产力、创造力和科学发现的工具的作用。
OpenAI 在欧洲的数据驻留及全球扩张
OpenAI 已在欧洲推出数据驻留选项,并将这些能力扩展到全球,以帮助组织满足本地数据主权和合规要求。
OpenAI 和加州州立大学系统部署 ChatGPT Edu
OpenAI 和加州州立大学(CSU)系统已启动迄今为止规模最大的 ChatGPT 部署,为 23 个校区的超过 520,000 名学生和教职员工提供 ChatGPT Edu 访问权限。
DABStep: 多步骤推理的数据代理基准
Hugging Face 和 Adyen 推出了 DABStep,这是一个包含超过 450 个真实世界数据分析任务的基准,揭示了当前最先进的 AI 代理在复杂推理任务上的准确率仅为 16%。
pi0 and pi0-FAST:用于通用机器人控制的视觉-语言-动作模型
Hugging Face 已将由 Physical Intelligence 开发的通用视觉-语言-动作 (VLA) 模型 pi0 和 pi0-FAST 集成到 LeRobot 仓库中,以实现跨多种形态的通用机器人控制。
使用 ChatGPT 进行美甲设计
持证美甲师 Tabytha Scott 使用 ChatGPT 作为创意伙伴,将无限的设计想法缩小为可执行的美甲概念。
Hugging Face 开源 DeepResearch
Hugging Face 已开源一个框架,以复现 OpenAI 的 Deep Research 能力,使用代码原生的 agentic 方法在 GAIA 基准上取得了 55.15% 的得分。
使用 ChatGPT 进行专业钓鱼指导
OpenAI 强调了一位专业钓鱼者如何使用 ChatGPT 制定有针对性的钓鱼计划,并加速初学者在该运动中的学习曲线。
使用 ChatGPT GPTs 构建自定义数学导师
Phil Birchenall 使用自定义 GPT 创建了一个个性化的狗主题数学导师,帮助他的女儿提高了数学技能并通过了她的 SATs 考试。
OpenAI 深度研究用于复杂行业趋势
OpenAI 已推出深度研究,这是一款旨在自动化复杂行业趋势分析的工具,以提升专业研究人员的个人能力。
OpenAI 深度研究
OpenAI 已推出深度研究,这是 ChatGPT 中的一种由 o3 模型版本驱动的代理能力,能够自主执行多步骤网络研究,以生成全面的分析级报告。
Open-R1 更新 #1:复现 DeepSeek-R1 训练与合成数据
Hugging Face 发布了 Open-R1 项目的首次进展更新,详细介绍了 DeepSeek-R1 评估分数的复现情况、GRPO 在 TRL 中的集成情况,以及扩展合成推理数据生成的策略。
OpenAI 打击 AI 辅助的浪漫诱骗和屠猪诈骗
OpenAI 已封禁一批由柬埔寨网络使用的 ChatGPT 账户,该网络利用这些账户自动化翻译和生成角色,用于浪漫和投资诈骗。
OpenAI 打击“Sponsored Discontent”影响行动
OpenAI 已封禁与一项名为“Sponsored Discontent”的中国影响行动相关的账户,该行动利用 ChatGPT 生成针对美国和一位中国异见人士的批评内容,最终在拉美主流媒体植入长篇文章。
OpenAI 使用 AI 打击与朝鲜(DPRK)关联的网络威胁行为者
OpenAI 已封禁与朝鲜(DPRK)关联的威胁行为者账户,包括 VELVET CHOLLIMA 和 STARDUST CHOLLIMA,这些行为者利用 AI 进行代码协助、调试和社会工程研究。
OpenAI 使用 ChatGPT 打击伊朗影响网络
OpenAI 已封禁五个被伊朗关联的影响行动 STORM-2035 和 IUVM 用于生成亲伊朗、亲哈马斯内容的 ChatGPT 账户,这些内容跨多语言和平台发布。
OpenAI 打击针对加纳选举的隐蔽影响行动
OpenAI 禁用了由名为 DigitSol 的商业实体使用的一批 ChatGPT 账户,这些账户在加纳总统选举期间用于生成支持 Bawumia、抨击 Mahama 的隐蔽影响行动内容。
OpenAI 打击 AI 辅助任务诈骗网络
OpenAI 已封禁一批由柬埔寨网络用于通过 AI 翻译和社会工程实施“任务诈骗”的 ChatGPT 账户。
OpenAI 打击 AI 辅助的欺诈性招聘计划
OpenAI 禁用了数十个用于欺诈性招聘计划的账户,该计划利用 AI 伪造求职申请、进行面试并执行工作任务,其手法与归因于朝鲜国家行动的 TTP 相符。
OpenAI Operation Peer Review:破坏 AI 辅助的监视规划
OpenAI 禁止了一批可能来源于中国的 ChatGPT 账户,这些账户使用 AI 辅助研究政治行为者、分析抗议文件并开发监视工具。
OpenAI o3-mini 系统卡
OpenAI 发布了 o3-mini 系统卡,详细说明了大规模强化学习和思维链推理如何使模型在安全性能上达到最先进水平,并在准备框架下获得中等风险分类。
OpenAI o3-mini 发布说明 / 新功能概览
OpenAI 已发布 o3-mini,一个针对 STEM 优化的高效推理模型,在数学、编码和科学方面提供与 o1 相当的性能,同时具有更低的延迟和扩展的开发者功能。
Mini-R1: 通过 GRPO 和倒计时游戏再现 DeepSeek-R1 推理
Hugging Face 展示了如何通过在 Countdown Game 上使用 Group Relative Policy Optimization (GRPO) 训练 Qwen2.5-3B 模型来再现 DeepSeek-R1 的 'aha moment'(自我纠正和推理)。
Hugging Face 艺术 AI 工具通讯 第 1 期
Hugging Face 已推出一份月度通讯,详细阐述了开源创意 AI 的现状,突出了 2024 年向 Diffusion Transformers 的转变以及高质量开源视频和音频模型的出现。
OpenAI 与美国国家实验室合作伙伴关系
OpenAI 已与美国国家实验室合作,在 Venado 超级计算机上部署推理模型,以加速科学研究并加强国家安全。
如何在 AWS 上部署和微调 DeepSeek R1 模型
Hugging Face 展示了如何使用 Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、Amazon SageMaker AI(GPU 和 Neuron 实例)以及使用 Hugging Face Neuron Deep Learning AMI 的 EC2 Neuron,在 AWS 上部署 DeepSeek R1 及其蒸馏变体并进行微调。
Qwen2.5-Max 发布说明
Qwen 发布了 Qwen2.5-Max,这是一个在超过 20 万亿个 token 上预训练的大规模 Mixture-of-Experts (MoE) 模型,可通过 API 和 Qwen Chat 使用。
Open-R1:对 DeepSeek-R1 的完全开源复现
Hugging Face 推出了 Open-R1 项目,旨在系统地重构 DeepSeek-R1 的数据和训练流水线,目标是为开源社区提供构建推理模型所缺失的数据集和代码。
Hugging Face 推理提供商集成
Hugging Face 已将四个无服务器推理提供商——fal、Replicate、SambaNova 和 Together AI——直接集成到 Hub 中,以提供统一的、以模型为中心的无服务器推理。
Diffusers 中的开放视频生成模型现状
Hugging Face 对开放视频生成模型提供了全面的概述,并介绍了一套 Diffusers 优化方案,可将 HunyuanVideo 等模型的显存需求从 60GB 降低至约 6.5GB.
Qwen2.5-1M 发布:开源 7B 和 14B 模型,支持 1M Token 上下文及基于 vLLM 的推理框架
Qwen 发布了开源的 Qwen2.5-7B-Instruct-1M 和 Qwen2.5-14B-Instruct-1M 模型,支持高达 100 万 token 的上下文,并配有优化的基于 vLLM 的推理框架,可实现 3-7 倍的预填充加速,并保持与 GPT-4o-mini 相当的短任务性能。
Qwen2.5-VL 发布说明
Qwen 发布了 Qwen2.5-VL,这是一个旗舰视觉语言模型,提供 3B、7B 和 72B 三种规模,引入了先进的视觉代理能力、长视频理解和结构化文档解析。