6551

Uber AI 集成用于按需服务

Uber 使用 OpenAI 的技术来个性化用户互动,自动化复杂的市场解决方案,并通过 AI 驱动的协作者提升劳动力生产力。

6552

SmolVLM2: 让每台设备都能理解视频

Hugging Face 发布了 SmolVLM2,这是一系列高效的视觉和视频语言模型,参数规模为 2.2B、500M 和 256M,旨在使从手机到服务器的设备能够进行本地视频理解。

6553

PaliGemma 2 Mix 发布说明

Google 已发布 PaliGemma 2 mix,这是一系列在包括 OCR、标题生成和目标检测在内的多样化任务上微调的视觉语言模型,以展示 PaliGemma 2 预训练检查点的潜力。

6554

OpenAI SWE-Lancer 基准发布

OpenAI 推出了 SWE-Lancer,一个包含超过 1,400 个来自 Upwork 的真实世界自由职业软件工程任务的基准,用于衡量 AI 模型在软件开发中的经济影响和技术能力。

6555

Hugging Face 添加 Hyperbolic、Nebius AI Studio 和 Novita 作为 Serverless 推理提供商

Hugging Face 已将 Hyperbolic、Nebius AI Studio 和 Novita 集成作为 Serverless 推理提供商,通过 Hub 和客户端 SDK 直接扩展对 DeepSeek-R1 和 FLUX.1 等模型的访问。

6556

OpenAI 和 Guardian Media Group 内容合作伙伴关系

OpenAI 和 Guardian Media Group 已建立战略合作伙伴关系,将 Guardian 编辑内容整合到 ChatGPT 中,为每周 3 亿用户提供直接访问可信报道和扩展摘要的途径。

6557

Hugging Face Open LLM Leaderboard 更新:集成 Math-Verify 以改进数学评估

Hugging Face 使用 Math-Verify 重新评估了 Open LLM Leaderboard 上的 3,751 个模型,以修复解析错误和格式严格性,导致 MATH-Hard 排名发生显著变动。

6558

Hugging Face 将 Fireworks.ai 集成作为推理提供商

Hugging Face 已在 Hub 上添加 Fireworks.ai 作为受支持的推理提供商,使得如 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 等模型能够在 HF 生态系统中进行无服务器推理。

6559

Fanatics Betting and Gaming 在金融领域的 AI 应用

Fanatics Betting and Gaming 正在利用 ChatGPT 和定制化 GPTs 来自动化手动财务任务,减少每月工作量并加速战略决策。

6560

Wayfair AI 实施与策略

Wayfair 正在集成 OpenAI 的生成式 AI 和多模态功能,以个性化电子商务体验,现代化遗留代码库,并在法律工作流程中自动化风险分析。

6561

Rogo 使用 OpenAI o1 和 GPT-4o 扩展金融研究

Rogo 利用包含 OpenAI o1 和 GPT-4o 的分层模型架构来自动化金融研究和尽职调查,每周为分析师节省超过 10 小时。

6562

Hugging Face: 优化 10亿次分类的成本和延迟

Hugging Face 提供了一个框架和基准,用于降低大规模编码器模型推理的成本,表明 NVIDIA L4 GPU 和优化的批次大小可以以低至 253.82 美元处理 10亿 次文本分类。

6563

OpenAI Model Spec 更新

OpenAI 已在 CC0 许可证下发布了更新的 Model Spec,以定义 AI 行为,优先考虑用户可定制性和知识自由,同时保持安全防护措施。

6564

Hugging Face 视频数据集脚本

Hugging Face 推出了一套开源视频数据集脚本,旨在简化高质量、过滤后的数据集的创建,用于微调视频生成模型。

6565

Hugging Face Xet支持的仓库:通过块级聚合加速Hub传输

Hugging Face 正在引入一个基于块的去重系统,使用 xet-core 和 hf_xet,通过块级聚合将上传和下载速度提高 2-3 倍。

6566

Open R1 Update #2: OpenR1-Math-220k 数据集和推理洞察

Hugging Face 介绍了 OpenR1-Math-220k,这是一个旨在重建 DeepSeek R1 蒸馏管道的大规模数学推理数据集,同时分享了社区关于 GRPO 和 Chain-of-Thought 长度控制的见解。

6567

OpenAI 与 Schibsted 媒体集团合作伙伴关系

OpenAI 已与 Schibsted 媒体集团合作,将 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等标题的高质量北欧新闻内容整合到 ChatGPT 中。

6568

开放阿拉伯LLM排行榜 2

Hugging Face及其合作伙伴发布了开放阿拉伯LLM排行榜2(OALL v2),用本地阿拉伯数据集和新的RAG评估框架取代了饱和和机器翻译的基准,以更准确地衡量阿拉伯语能力。

6569

OpenAI 介绍智能时代

OpenAI 将智能时代定义为由 AI 驱动的技术进步的新时代,强调其作为提升人类生产力、创造力和科学发现的工具的作用。

6570

OpenAI 在欧洲的数据驻留及全球扩张

OpenAI 已在欧洲推出数据驻留选项,并将这些能力扩展到全球,以帮助组织满足本地数据主权和合规要求。

6571

OpenAI 和加州州立大学系统部署 ChatGPT Edu

OpenAI 和加州州立大学(CSU)系统已启动迄今为止规模最大的 ChatGPT 部署,为 23 个校区的超过 520,000 名学生和教职员工提供 ChatGPT Edu 访问权限。

6572

DABStep: 多步骤推理的数据代理基准

Hugging Face 和 Adyen 推出了 DABStep,这是一个包含超过 450 个真实世界数据分析任务的基准,揭示了当前最先进的 AI 代理在复杂推理任务上的准确率仅为 16%。

6573

pi0 and pi0-FAST:用于通用机器人控制的视觉-语言-动作模型

Hugging Face 已将由 Physical Intelligence 开发的通用视觉-语言-动作 (VLA) 模型 pi0 和 pi0-FAST 集成到 LeRobot 仓库中,以实现跨多种形态的通用机器人控制。

6574

使用 ChatGPT 进行美甲设计

持证美甲师 Tabytha Scott 使用 ChatGPT 作为创意伙伴,将无限的设计想法缩小为可执行的美甲概念。

6575

Hugging Face 开源 DeepResearch

Hugging Face 已开源一个框架,以复现 OpenAI 的 Deep Research 能力,使用代码原生的 agentic 方法在 GAIA 基准上取得了 55.15% 的得分。

6576

使用 ChatGPT 进行专业钓鱼指导

OpenAI 强调了一位专业钓鱼者如何使用 ChatGPT 制定有针对性的钓鱼计划,并加速初学者在该运动中的学习曲线。

6577

使用 ChatGPT GPTs 构建自定义数学导师

Phil Birchenall 使用自定义 GPT 创建了一个个性化的狗主题数学导师,帮助他的女儿提高了数学技能并通过了她的 SATs 考试。

6578

OpenAI 深度研究用于复杂行业趋势

OpenAI 已推出深度研究,这是一款旨在自动化复杂行业趋势分析的工具,以提升专业研究人员的个人能力。

6579

OpenAI 深度研究

OpenAI 已推出深度研究,这是 ChatGPT 中的一种由 o3 模型版本驱动的代理能力,能够自主执行多步骤网络研究,以生成全面的分析级报告。

6580

Open-R1 更新 #1:复现 DeepSeek-R1 训练与合成数据

Hugging Face 发布了 Open-R1 项目的首次进展更新,详细介绍了 DeepSeek-R1 评估分数的复现情况、GRPO 在 TRL 中的集成情况,以及扩展合成推理数据生成的策略。

6581

OpenAI 打击 AI 辅助的浪漫诱骗和屠猪诈骗

OpenAI 已封禁一批由柬埔寨网络使用的 ChatGPT 账户,该网络利用这些账户自动化翻译和生成角色,用于浪漫和投资诈骗。

6582

OpenAI 打击“Sponsored Discontent”影响行动

OpenAI 已封禁与一项名为“Sponsored Discontent”的中国影响行动相关的账户,该行动利用 ChatGPT 生成针对美国和一位中国异见人士的批评内容,最终在拉美主流媒体植入长篇文章。

6583

OpenAI 使用 AI 打击与朝鲜(DPRK)关联的网络威胁行为者

OpenAI 已封禁与朝鲜(DPRK)关联的威胁行为者账户,包括 VELVET CHOLLIMA 和 STARDUST CHOLLIMA,这些行为者利用 AI 进行代码协助、调试和社会工程研究。

6584

OpenAI 使用 ChatGPT 打击伊朗影响网络

OpenAI 已封禁五个被伊朗关联的影响行动 STORM-2035 和 IUVM 用于生成亲伊朗、亲哈马斯内容的 ChatGPT 账户,这些内容跨多语言和平台发布。

6585

OpenAI 打击针对加纳选举的隐蔽影响行动

OpenAI 禁用了由名为 DigitSol 的商业实体使用的一批 ChatGPT 账户,这些账户在加纳总统选举期间用于生成支持 Bawumia、抨击 Mahama 的隐蔽影响行动内容。

6586

OpenAI 打击 AI 辅助任务诈骗网络

OpenAI 已封禁一批由柬埔寨网络用于通过 AI 翻译和社会工程实施“任务诈骗”的 ChatGPT 账户。

6587

OpenAI 打击 AI 辅助的欺诈性招聘计划

OpenAI 禁用了数十个用于欺诈性招聘计划的账户,该计划利用 AI 伪造求职申请、进行面试并执行工作任务,其手法与归因于朝鲜国家行动的 TTP 相符。

6588

OpenAI Operation Peer Review:破坏 AI 辅助的监视规划

OpenAI 禁止了一批可能来源于中国的 ChatGPT 账户,这些账户使用 AI 辅助研究政治行为者、分析抗议文件并开发监视工具。

6589

OpenAI o3-mini 系统卡

OpenAI 发布了 o3-mini 系统卡,详细说明了大规模强化学习和思维链推理如何使模型在安全性能上达到最先进水平,并在准备框架下获得中等风险分类。

6590

OpenAI o3-mini 发布说明 / 新功能概览

OpenAI 已发布 o3-mini,一个针对 STEM 优化的高效推理模型,在数学、编码和科学方面提供与 o1 相当的性能,同时具有更低的延迟和扩展的开发者功能。

6591

Mini-R1: 通过 GRPO 和倒计时游戏再现 DeepSeek-R1 推理

Hugging Face 展示了如何通过在 Countdown Game 上使用 Group Relative Policy Optimization (GRPO) 训练 Qwen2.5-3B 模型来再现 DeepSeek-R1 的 'aha moment'(自我纠正和推理)。

6592

Hugging Face 艺术 AI 工具通讯 第 1 期

Hugging Face 已推出一份月度通讯,详细阐述了开源创意 AI 的现状,突出了 2024 年向 Diffusion Transformers 的转变以及高质量开源视频和音频模型的出现。

6593

OpenAI 与美国国家实验室合作伙伴关系

OpenAI 已与美国国家实验室合作,在 Venado 超级计算机上部署推理模型,以加速科学研究并加强国家安全。

6594

如何在 AWS 上部署和微调 DeepSeek R1 模型

Hugging Face 展示了如何使用 Hugging Face Inference Endpoints、Amazon Bedrock Marketplace、Amazon SageMaker AI(GPU 和 Neuron 实例)以及使用 Hugging Face Neuron Deep Learning AMI 的 EC2 Neuron,在 AWS 上部署 DeepSeek R1 及其蒸馏变体并进行微调。

6595

Qwen2.5-Max 发布说明

Qwen 发布了 Qwen2.5-Max,这是一个在超过 20 万亿个 token 上预训练的大规模 Mixture-of-Experts (MoE) 模型,可通过 API 和 Qwen Chat 使用。

6596

Open-R1:对 DeepSeek-R1 的完全开源复现

Hugging Face 推出了 Open-R1 项目,旨在系统地重构 DeepSeek-R1 的数据和训练流水线,目标是为开源社区提供构建推理模型所缺失的数据集和代码。

6597

Hugging Face 推理提供商集成

Hugging Face 已将四个无服务器推理提供商——fal、Replicate、SambaNova 和 Together AI——直接集成到 Hub 中,以提供统一的、以模型为中心的无服务器推理。

6598

Diffusers 中的开放视频生成模型现状

Hugging Face 对开放视频生成模型提供了全面的概述,并介绍了一套 Diffusers 优化方案,可将 HunyuanVideo 等模型的显存需求从 60GB 降低至约 6.5GB.

6599

Qwen2.5-1M 发布:开源 7B 和 14B 模型,支持 1M Token 上下文及基于 vLLM 的推理框架

Qwen 发布了开源的 Qwen2.5-7B-Instruct-1M 和 Qwen2.5-14B-Instruct-1M 模型,支持高达 100 万 token 的上下文,并配有优化的基于 vLLM 的推理框架,可实现 3-7 倍的预填充加速,并保持与 GPT-4o-mini 相当的短任务性能。

6600

Qwen2.5-VL 发布说明

Qwen 发布了 Qwen2.5-VL,这是一个旗舰视觉语言模型,提供 3B、7B 和 72B 三种规模,引入了先进的视觉代理能力、长视频理解和结构化文档解析。