6851

XLSCOUT ParaEmbed 2.0 发布

XLSCOUT 已发布 ParaEmbed 2.0,这是一款在专家策划的专利数据上微调的专有嵌入模型,准确率比 ParaEmbed 1.0 提高了 23%。

6852

Hugging Face伦理与社会通讯 #6:数据质量的重要性

Hugging Face概述了一种整体且负责任的数据质量方法,强调高质量数据必须适合其预期用途,以确保AI模型性能、公平性和科学可重复性。

6853

微调 Microsoft Florence-2 用于 DocVQA

Hugging Face 演示了如何在 DocVQA 数据集上微调微软的 Florence-2 视觉语言模型,经过七个 epoch 后,验证相似度从 0 提升至 57.0。

6854

OpenAI 收购 Rockset 以实现实时数据检索

OpenAI 收购了实时分析数据库 Rockset,以将其高性能索引和查询能力整合到 OpenAI 的检索基础设施中。

6855

OpenAI 网络安全资助计划:支持 AI 驱动的防御研究

OpenAI 强调了其网络安全资助计划中的多个项目,旨在提升 LLM 的可信度、自动化漏洞检测以及开发自主网络防御代理。

6856

OpenAI 一致性模型:快速单步生成式 AI

OpenAI 推出了“一致性模型”,这是一类全新的生成模型家族,通过直接将噪声映射到数据,实现高质量的单步生成,克服了扩散模型缓慢的迭代采样过程。

6857

OpenAI 对不良内容检测的整体方法

OpenAI 推出了一套整体框架,用于构建稳健的自然语言分类系统,以检测包括性内容、暴力和骚扰在内的不良内容,该框架的表现优于现成模型。

6858

Hugging Face 数据共建倡议

Hugging Face 与 Argilla 发起了 “Data Is Better Together”(DIBT)倡议,旨在赋能开源社区共同创建高质量、多样且包容的机器学习数据集。

6859

OpenAI 发布改进的一致性模型训练技术

OpenAI 引入了新的训练方法,使一致性模型能够直接从数据中学习,在无需扩散模型蒸馏的情况下,在 CIFAR-10 和 ImageNet 64×64 上实现了高达四倍的 FID 分数提升。

6860

Prezi 案例研究:通过 Hugging Face 专家支持加速机器学习路线图

Prezi 正在利用 Hugging Face 专家支持计划和 Inference Endpoints,将高效的开源多模态模型集成到其 Prezi AI 演示生成工具中。

6861

Paf 通过 ChatGPT Enterprise 和自定义 GPT 提升开发者生产力

游戏公司 Paf 部署了 ChatGPT Enterprise 和超过 85 个自定义 GPT,以自动化样板代码并加速开发者培训,实现相当于 12 名全职员工的产出。

6862

Clay:通过代理式销售潜客实现10倍增长

Clay 使用 GPT-4 为 Claygent 提供动力,这是一款为 go-to-market 团队自动化网页研究和数据丰富的 AI 代理,实现了年同比 10 倍增长。

6863

BigCodeBench:用于复杂 Python 代码生成的新基准

Hugging Face 已发布 BigCodeBench,这是一套包含 1,140 个函数级任务的基准,旨在评估 LLM 在实用编程和多库使用方面的能力,解决了 HumanEval 的简单性和污染问题。

6864

Color Health 使用 GPT-4o 加速癌症护理和诊断工作流程

Color Health 开发了一款由 GPT-4o 驱动的副驾驶应用,帮助临床医生识别缺失的诊断项目并制定个性化的癌症筛查和治疗方案。

6865

OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员

OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员,以在 AI 能力迈向通用人工智能(AGI)的过程中加强公司的网络安全姿态和安全监督。

6866

Hugging Face Accelerate:统一 DeepSpeed 与 FSDP 的精度

Hugging Face Accelerate 0.30.0 引入了对 PyTorch FSDP 的自动上转,以使其精度处理与 DeepSpeed 对齐,从而实现两种后端之间的无缝切换且不损失收敛性。

6867

Stable Diffusion 3 Medium 与 Diffusers 的集成

Hugging Face 已将 Stable Diffusion 3 Medium(2B 参数)集成到 Diffusers 库中,引入了多模态扩散 Transformer(MMDiT)和校正流匹配,以提升文本到图像的合成效果。

6868

Hugging Face TRL RLOO 训练器发布

Hugging Face 在 TRL 中推出了 RLOO(REINFORCE Leave One-Out)训练器,这是一种在线 RLHF 算法,使用的显存(vRAM)减少 50-70%,收敛速度比 PPO 快至 3 倍,同时在性能上保持竞争力。

6869

OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官

OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官,以在公司增长的过程中扩大运营规模和产品部署。

6870

OpenAI 语音引擎:技术实现与安全框架

OpenAI 的语音引擎是一款自 2022 年起开发的合成语音模型,通过受控的迭代发布来推动安全研究和政策制定。

6871

Hugging Face 嵌入容器 for Amazon SageMaker 发布

Hugging Face 已发布正式可用(GA)的 Amazon SageMaker 嵌入容器,该容器由 Text Embedding Inference (TEI) 提供动力,用于高性能部署开源嵌入模型。

6872

Hugging Face Transformers 文档重新设计

Hugging Face 正在重新设计 Transformers 文档,以从僵化的增量结构转变为面向产品开发者的代码优先、整体整合的体验。

6873

Qwen2 发布说明 / 新功能

Qwen 宣布推出 Qwen2 系列,共五个开源模型,参数规模从 0.5B 到 72B,增强了对 27 种额外语言的多语言支持,并支持最长达 128K token 的上下文长度。

6874

10BedICU 与 OpenAI:提升印度的危重护理基础设施

10BedICU 正在将 OpenAI 的 GPT-4 和 Whisper 模型集成到其 CARE 平台中,以实现医疗文档自动化、旧硬件集成以及在印度政府医院中简化出院摘要。

6875

Qwen-Agent:将大型语言模型从8k扩展到1M上下文

Qwen 开发了一个代理框架,使 8k 上下文模型能够处理 1M 令牌,在特定基准测试中超越了 RAG 和原生长上下文模型。

6876

人工分析文本到图像排行榜与竞技场发布

Hugging Face 推出了人工分析文本到图像排行榜与竞技场,利用超过 45,000 票的人类偏好数据,对开源和专有图像生成模型进行排名。

6877

从 GPT-4 中提取概念

OpenAI 开发了可扩展的稀疏自编码器方法,将 GPT-4 的内部表征分解为 1600 万可供人类解释的特征。

6878

Hugging Face NPC-Playground:在 3D 环境中集成 LLM 驱动的 NPC

Hugging Face 推出 NPC-Playground,这是一款使用 Cubzh 和 Gigax 的 3D 演示,通过函数调用和 Lua 脚本实现逼真的 LLM 驱动 NPC 交互。

6879

Intel Gaudi 辅助生成支持

Hugging Face 已将辅助生成(投机采样)集成到 Optimum Habana 中,使基于 Intel Gaudi 处理器的大型 Transformer 模型实现最高约 2 倍的加速。

6880

Hugging Face Spaces 密钥安全更新

Hugging Face 披露了一起安全事件,涉及未经授权访问 Spaces 密钥的一个子集,导致受影响的令牌被撤销,并过渡到使用细粒度访问令牌。

6881

OpenAI 打击隐蔽 AI 影响行动

OpenAI 终止了与五个使用 AI 生成欺骗性内容的隐蔽影响行动相关的账户,尽管这些行动均未实现显著的受众覆盖。

6882

OpenAI 为大学推出 ChatGPT Edu

OpenAI 已推出 ChatGPT Edu,这是一款专为大学设计的 ChatGPT 版本,可在规模化部署 AI 的同时提供企业级安全、数据隐私以及对 GPT-4o 的访问。

6883

OpenAI 非营利组织倡议

OpenAI 已推出 OpenAI for Nonprofits,为非营利组织提供 ChatGPT Business 和 Enterprise 的折扣访问,以帮助它们克服运营和资金限制。

6884

MavenAGI 由 OpenAI 提供支持的自动化客户支持代理

MavenAGI 推出了基于 GPT-4 构建的 AI 客户服务代理,可自动处理高达 93% 的支持问题,并将每张工单的平均成本从 $40 降至 $8。

6885

OpenAI 与 WAN-IFRA 推出新闻编辑室 AI 催化剂计划

OpenAI 与 WAN-IFRA 已推出新闻编辑室 AI 催化剂计划,这是一项加速器项目,为全球 128 家新闻编辑室提供资金和技术支持,以快速推进 AI 采用并提升新闻业的可持续性。

6886

OpenAI 与 The Atlantic 新闻整合合作伙伴关系

OpenAI 与 The Atlantic 已达成战略合作,将 The Atlantic 的优质新闻内容整合至 ChatGPT 及其他 OpenAI 产品中,并提供出处说明和完整文章链接。

6887

OpenAI 与 Vox Media 战略合作伙伴关系

OpenAI 与 Vox Media 已达成战略合作,将 Vox Media 的新闻内容整合至 ChatGPT,并在面向消费者和广告主的 AI 驱动产品上展开合作。

6888

文本生成推理基准测试

Hugging Face 推出了一款文本生成推理(TGI)基准测试工具,帮助开发者分析吞吐量与延迟之间的权衡,以优化大语言模型部署的成本和性能。

6889

OpenAI董事会成立安全与安保委员会

OpenAI已成立安全与安保委员会,以监督其项目和运营中的关键安全与安保决策,同时开始训练其下一代前沿模型。

6890

使用 Sentence Transformers 进行嵌入模型的训练与微调

Hugging Face 提供了使用 Sentence Transformers 库训练和微调嵌入模型的完整指南,适用于语义搜索、RAG 等任务,并引入了全新的 SentenceTransformerTrainer。

6891

Falcon 2 11B 发布说明

TII 已发布 Falcon 2 11B,这是一系列更小且高性能的模型,包括在超过 5 万亿标记上训练的预训练 LLM 和视觉语言模型(VLM)。

6892

CyberSecEval 2:评估大型语言模型的网络安全风险

Hugging Face 和 Meta 推出了 CyberSecEval 2,这是一套用于评估 LLM 对代码解释器滥用、攻击性网络安全能力以及提示注入攻击易感性的综合框架。

6893

OpenAI 与 News Corp 多年全球合作伙伴关系

OpenAI 与 News Corp 已签署多年协议,允许 OpenAI 将 News Corp 来自《华尔街日报》和《泰晤士报》等主要出版物的当前及存档内容整合到其产品中,以提升信息可靠性。

6894

Hugging Face AWS Inferentia2 集成

Hugging Face 已扩展对 AWS Inferentia2 的支持,使得可以通过 Amazon SageMaker 部署超过 100,000 个模型,并为 Hugging Face 推理端点引入了新的 Inf2 实例选项。

6895

OpenAI 安全实践

OpenAI 详细阐述了用于开发和部署前沿 AI 模型的十项核心安全实践,强调以科学方法将安全融入模型生命周期的每个阶段。

6896

Hugging Face 与 Microsoft 战略合作更新(2024年5月)

Hugging Face 与 Microsoft 扩大了战略合作,将流行的开源模型集成到 Azure 模型目录,支持 Azure 上的 AMD MI300X GPU,并为 Hugging Face Spaces 引入了 VS Code 集成。

6897

Hugging Face 对 AMD Instinct MI300 GPU 的集成

Hugging Face 为 AMD Instinct MI300 GPU 提供了一流的集成,使 Llama 3 70B 的推理速度提升至最高 3 倍,微调速度提升至 2 倍,相较于 MI250。

6898

Dell Enterprise Hub:本地 AI 部署与训练

Hugging Face 与 Dell 联手推出 Dell Enterprise Hub,这是一套简化在 Dell 硬件上本地训练和部署开源大型语言模型的平台。

6899

Hugging Face Spaces 开发模式发布

Hugging Face 推出了 Spaces 开发模式,允许 PRO 订阅者通过 VS Code 或 SSH 进行实时代码编辑,无需为每一次更改进行 git 推送。

6900

OpenAI ChatGPT 语音选择流程

OpenAI 详细说明了为 ChatGPT 选拔五位专业配音演员的五个月配音过程,并澄清语音 “Sky” 并非旨在模仿 Scarlett Johansson。