XLSCOUT ParaEmbed 2.0 发布
XLSCOUT 已发布 ParaEmbed 2.0,这是一款在专家策划的专利数据上微调的专有嵌入模型,准确率比 ParaEmbed 1.0 提高了 23%。
Hugging Face伦理与社会通讯 #6:数据质量的重要性
Hugging Face概述了一种整体且负责任的数据质量方法,强调高质量数据必须适合其预期用途,以确保AI模型性能、公平性和科学可重复性。
微调 Microsoft Florence-2 用于 DocVQA
Hugging Face 演示了如何在 DocVQA 数据集上微调微软的 Florence-2 视觉语言模型,经过七个 epoch 后,验证相似度从 0 提升至 57.0。
OpenAI 收购 Rockset 以实现实时数据检索
OpenAI 收购了实时分析数据库 Rockset,以将其高性能索引和查询能力整合到 OpenAI 的检索基础设施中。
OpenAI 网络安全资助计划:支持 AI 驱动的防御研究
OpenAI 强调了其网络安全资助计划中的多个项目,旨在提升 LLM 的可信度、自动化漏洞检测以及开发自主网络防御代理。
OpenAI 一致性模型:快速单步生成式 AI
OpenAI 推出了“一致性模型”,这是一类全新的生成模型家族,通过直接将噪声映射到数据,实现高质量的单步生成,克服了扩散模型缓慢的迭代采样过程。
OpenAI 对不良内容检测的整体方法
OpenAI 推出了一套整体框架,用于构建稳健的自然语言分类系统,以检测包括性内容、暴力和骚扰在内的不良内容,该框架的表现优于现成模型。
Hugging Face 数据共建倡议
Hugging Face 与 Argilla 发起了 “Data Is Better Together”(DIBT)倡议,旨在赋能开源社区共同创建高质量、多样且包容的机器学习数据集。
OpenAI 发布改进的一致性模型训练技术
OpenAI 引入了新的训练方法,使一致性模型能够直接从数据中学习,在无需扩散模型蒸馏的情况下,在 CIFAR-10 和 ImageNet 64×64 上实现了高达四倍的 FID 分数提升。
Prezi 案例研究:通过 Hugging Face 专家支持加速机器学习路线图
Prezi 正在利用 Hugging Face 专家支持计划和 Inference Endpoints,将高效的开源多模态模型集成到其 Prezi AI 演示生成工具中。
Paf 通过 ChatGPT Enterprise 和自定义 GPT 提升开发者生产力
游戏公司 Paf 部署了 ChatGPT Enterprise 和超过 85 个自定义 GPT,以自动化样板代码并加速开发者培训,实现相当于 12 名全职员工的产出。
Clay:通过代理式销售潜客实现10倍增长
Clay 使用 GPT-4 为 Claygent 提供动力,这是一款为 go-to-market 团队自动化网页研究和数据丰富的 AI 代理,实现了年同比 10 倍增长。
BigCodeBench:用于复杂 Python 代码生成的新基准
Hugging Face 已发布 BigCodeBench,这是一套包含 1,140 个函数级任务的基准,旨在评估 LLM 在实用编程和多库使用方面的能力,解决了 HumanEval 的简单性和污染问题。
Color Health 使用 GPT-4o 加速癌症护理和诊断工作流程
Color Health 开发了一款由 GPT-4o 驱动的副驾驶应用,帮助临床医生识别缺失的诊断项目并制定个性化的癌症筛查和治疗方案。
OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员
OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员,以在 AI 能力迈向通用人工智能(AGI)的过程中加强公司的网络安全姿态和安全监督。
Hugging Face Accelerate:统一 DeepSpeed 与 FSDP 的精度
Hugging Face Accelerate 0.30.0 引入了对 PyTorch FSDP 的自动上转,以使其精度处理与 DeepSpeed 对齐,从而实现两种后端之间的无缝切换且不损失收敛性。
Stable Diffusion 3 Medium 与 Diffusers 的集成
Hugging Face 已将 Stable Diffusion 3 Medium(2B 参数)集成到 Diffusers 库中,引入了多模态扩散 Transformer(MMDiT)和校正流匹配,以提升文本到图像的合成效果。
Hugging Face TRL RLOO 训练器发布
Hugging Face 在 TRL 中推出了 RLOO(REINFORCE Leave One-Out)训练器,这是一种在线 RLHF 算法,使用的显存(vRAM)减少 50-70%,收敛速度比 PPO 快至 3 倍,同时在性能上保持竞争力。
OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官
OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官,以在公司增长的过程中扩大运营规模和产品部署。
OpenAI 语音引擎:技术实现与安全框架
OpenAI 的语音引擎是一款自 2022 年起开发的合成语音模型,通过受控的迭代发布来推动安全研究和政策制定。
Hugging Face 嵌入容器 for Amazon SageMaker 发布
Hugging Face 已发布正式可用(GA)的 Amazon SageMaker 嵌入容器,该容器由 Text Embedding Inference (TEI) 提供动力,用于高性能部署开源嵌入模型。
Hugging Face Transformers 文档重新设计
Hugging Face 正在重新设计 Transformers 文档,以从僵化的增量结构转变为面向产品开发者的代码优先、整体整合的体验。
Qwen2 发布说明 / 新功能
Qwen 宣布推出 Qwen2 系列,共五个开源模型,参数规模从 0.5B 到 72B,增强了对 27 种额外语言的多语言支持,并支持最长达 128K token 的上下文长度。
10BedICU 与 OpenAI:提升印度的危重护理基础设施
10BedICU 正在将 OpenAI 的 GPT-4 和 Whisper 模型集成到其 CARE 平台中,以实现医疗文档自动化、旧硬件集成以及在印度政府医院中简化出院摘要。
Qwen-Agent:将大型语言模型从8k扩展到1M上下文
Qwen 开发了一个代理框架,使 8k 上下文模型能够处理 1M 令牌,在特定基准测试中超越了 RAG 和原生长上下文模型。
人工分析文本到图像排行榜与竞技场发布
Hugging Face 推出了人工分析文本到图像排行榜与竞技场,利用超过 45,000 票的人类偏好数据,对开源和专有图像生成模型进行排名。
从 GPT-4 中提取概念
OpenAI 开发了可扩展的稀疏自编码器方法,将 GPT-4 的内部表征分解为 1600 万可供人类解释的特征。
Hugging Face NPC-Playground:在 3D 环境中集成 LLM 驱动的 NPC
Hugging Face 推出 NPC-Playground,这是一款使用 Cubzh 和 Gigax 的 3D 演示,通过函数调用和 Lua 脚本实现逼真的 LLM 驱动 NPC 交互。
Intel Gaudi 辅助生成支持
Hugging Face 已将辅助生成(投机采样)集成到 Optimum Habana 中,使基于 Intel Gaudi 处理器的大型 Transformer 模型实现最高约 2 倍的加速。
Hugging Face Spaces 密钥安全更新
Hugging Face 披露了一起安全事件,涉及未经授权访问 Spaces 密钥的一个子集,导致受影响的令牌被撤销,并过渡到使用细粒度访问令牌。
OpenAI 打击隐蔽 AI 影响行动
OpenAI 终止了与五个使用 AI 生成欺骗性内容的隐蔽影响行动相关的账户,尽管这些行动均未实现显著的受众覆盖。
OpenAI 为大学推出 ChatGPT Edu
OpenAI 已推出 ChatGPT Edu,这是一款专为大学设计的 ChatGPT 版本,可在规模化部署 AI 的同时提供企业级安全、数据隐私以及对 GPT-4o 的访问。
OpenAI 非营利组织倡议
OpenAI 已推出 OpenAI for Nonprofits,为非营利组织提供 ChatGPT Business 和 Enterprise 的折扣访问,以帮助它们克服运营和资金限制。
MavenAGI 由 OpenAI 提供支持的自动化客户支持代理
MavenAGI 推出了基于 GPT-4 构建的 AI 客户服务代理,可自动处理高达 93% 的支持问题,并将每张工单的平均成本从 $40 降至 $8。
OpenAI 与 WAN-IFRA 推出新闻编辑室 AI 催化剂计划
OpenAI 与 WAN-IFRA 已推出新闻编辑室 AI 催化剂计划,这是一项加速器项目,为全球 128 家新闻编辑室提供资金和技术支持,以快速推进 AI 采用并提升新闻业的可持续性。
OpenAI 与 The Atlantic 新闻整合合作伙伴关系
OpenAI 与 The Atlantic 已达成战略合作,将 The Atlantic 的优质新闻内容整合至 ChatGPT 及其他 OpenAI 产品中,并提供出处说明和完整文章链接。
OpenAI 与 Vox Media 战略合作伙伴关系
OpenAI 与 Vox Media 已达成战略合作,将 Vox Media 的新闻内容整合至 ChatGPT,并在面向消费者和广告主的 AI 驱动产品上展开合作。
文本生成推理基准测试
Hugging Face 推出了一款文本生成推理(TGI)基准测试工具,帮助开发者分析吞吐量与延迟之间的权衡,以优化大语言模型部署的成本和性能。
OpenAI董事会成立安全与安保委员会
OpenAI已成立安全与安保委员会,以监督其项目和运营中的关键安全与安保决策,同时开始训练其下一代前沿模型。
使用 Sentence Transformers 进行嵌入模型的训练与微调
Hugging Face 提供了使用 Sentence Transformers 库训练和微调嵌入模型的完整指南,适用于语义搜索、RAG 等任务,并引入了全新的 SentenceTransformerTrainer。
Falcon 2 11B 发布说明
TII 已发布 Falcon 2 11B,这是一系列更小且高性能的模型,包括在超过 5 万亿标记上训练的预训练 LLM 和视觉语言模型(VLM)。
CyberSecEval 2:评估大型语言模型的网络安全风险
Hugging Face 和 Meta 推出了 CyberSecEval 2,这是一套用于评估 LLM 对代码解释器滥用、攻击性网络安全能力以及提示注入攻击易感性的综合框架。
OpenAI 与 News Corp 多年全球合作伙伴关系
OpenAI 与 News Corp 已签署多年协议,允许 OpenAI 将 News Corp 来自《华尔街日报》和《泰晤士报》等主要出版物的当前及存档内容整合到其产品中,以提升信息可靠性。
Hugging Face AWS Inferentia2 集成
Hugging Face 已扩展对 AWS Inferentia2 的支持,使得可以通过 Amazon SageMaker 部署超过 100,000 个模型,并为 Hugging Face 推理端点引入了新的 Inf2 实例选项。
OpenAI 安全实践
OpenAI 详细阐述了用于开发和部署前沿 AI 模型的十项核心安全实践,强调以科学方法将安全融入模型生命周期的每个阶段。
Hugging Face 与 Microsoft 战略合作更新(2024年5月)
Hugging Face 与 Microsoft 扩大了战略合作,将流行的开源模型集成到 Azure 模型目录,支持 Azure 上的 AMD MI300X GPU,并为 Hugging Face Spaces 引入了 VS Code 集成。
Hugging Face 对 AMD Instinct MI300 GPU 的集成
Hugging Face 为 AMD Instinct MI300 GPU 提供了一流的集成,使 Llama 3 70B 的推理速度提升至最高 3 倍,微调速度提升至 2 倍,相较于 MI250。
Dell Enterprise Hub:本地 AI 部署与训练
Hugging Face 与 Dell 联手推出 Dell Enterprise Hub,这是一套简化在 Dell 硬件上本地训练和部署开源大型语言模型的平台。
Hugging Face Spaces 开发模式发布
Hugging Face 推出了 Spaces 开发模式,允许 PRO 订阅者通过 VS Code 或 SSH 进行实时代码编辑,无需为每一次更改进行 git 推送。
OpenAI ChatGPT 语音选择流程
OpenAI 详细说明了为 ChatGPT 选拔五位专业配音演员的五个月配音过程,并澄清语音 “Sky” 并非旨在模仿 Scarlett Johansson。