OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员
OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员,以在 AI 能力迈向通用人工智能(AGI)的过程中加强公司的网络安全姿态和安全监督。
Hugging Face Accelerate:统一 DeepSpeed 与 FSDP 的精度
Hugging Face Accelerate 0.30.0 引入了对 PyTorch FSDP 的自动上转,以使其精度处理与 DeepSpeed 对齐,从而实现两种后端之间的无缝切换且不损失收敛性。
Stable Diffusion 3 Medium 与 Diffusers 的集成
Hugging Face 已将 Stable Diffusion 3 Medium(2B 参数)集成到 Diffusers 库中,引入了多模态扩散 Transformer(MMDiT)和校正流匹配,以提升文本到图像的合成效果。
Hugging Face TRL RLOO 训练器发布
Hugging Face 在 TRL 中推出了 RLOO(REINFORCE Leave One-Out)训练器,这是一种在线 RLHF 算法,使用的显存(vRAM)减少 50-70%,收敛速度比 PPO 快至 3 倍,同时在性能上保持竞争力。
OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官
OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官,以在公司增长的过程中扩大运营规模和产品部署。
OpenAI 语音引擎:技术实现与安全框架
OpenAI 的语音引擎是一款自 2022 年起开发的合成语音模型,通过受控的迭代发布来推动安全研究和政策制定。
Hugging Face 嵌入容器 for Amazon SageMaker 发布
Hugging Face 已发布正式可用(GA)的 Amazon SageMaker 嵌入容器,该容器由 Text Embedding Inference (TEI) 提供动力,用于高性能部署开源嵌入模型。
Hugging Face Transformers 文档重新设计
Hugging Face 正在重新设计 Transformers 文档,以从僵化的增量结构转变为面向产品开发者的代码优先、整体整合的体验。
Qwen2 发布说明 / 新功能
Qwen 宣布推出 Qwen2 系列,共五个开源模型,参数规模从 0.5B 到 72B,增强了对 27 种额外语言的多语言支持,并支持最长达 128K token 的上下文长度。
10BedICU 与 OpenAI:提升印度的危重护理基础设施
10BedICU 正在将 OpenAI 的 GPT-4 和 Whisper 模型集成到其 CARE 平台中,以实现医疗文档自动化、旧硬件集成以及在印度政府医院中简化出院摘要。
Qwen-Agent:将大型语言模型从8k扩展到1M上下文
Qwen 开发了一个代理框架,使 8k 上下文模型能够处理 1M 令牌,在特定基准测试中超越了 RAG 和原生长上下文模型。
人工分析文本到图像排行榜与竞技场发布
Hugging Face 推出了人工分析文本到图像排行榜与竞技场,利用超过 45,000 票的人类偏好数据,对开源和专有图像生成模型进行排名。
从 GPT-4 中提取概念
OpenAI 开发了可扩展的稀疏自编码器方法,将 GPT-4 的内部表征分解为 1600 万可供人类解释的特征。
Hugging Face NPC-Playground:在 3D 环境中集成 LLM 驱动的 NPC
Hugging Face 推出 NPC-Playground,这是一款使用 Cubzh 和 Gigax 的 3D 演示,通过函数调用和 Lua 脚本实现逼真的 LLM 驱动 NPC 交互。
Intel Gaudi 辅助生成支持
Hugging Face 已将辅助生成(投机采样)集成到 Optimum Habana 中,使基于 Intel Gaudi 处理器的大型 Transformer 模型实现最高约 2 倍的加速。
Hugging Face Spaces 密钥安全更新
Hugging Face 披露了一起安全事件,涉及未经授权访问 Spaces 密钥的一个子集,导致受影响的令牌被撤销,并过渡到使用细粒度访问令牌。
OpenAI 打击隐蔽 AI 影响行动
OpenAI 终止了与五个使用 AI 生成欺骗性内容的隐蔽影响行动相关的账户,尽管这些行动均未实现显著的受众覆盖。
OpenAI 为大学推出 ChatGPT Edu
OpenAI 已推出 ChatGPT Edu,这是一款专为大学设计的 ChatGPT 版本,可在规模化部署 AI 的同时提供企业级安全、数据隐私以及对 GPT-4o 的访问。
OpenAI 非营利组织倡议
OpenAI 已推出 OpenAI for Nonprofits,为非营利组织提供 ChatGPT Business 和 Enterprise 的折扣访问,以帮助它们克服运营和资金限制。
MavenAGI 由 OpenAI 提供支持的自动化客户支持代理
MavenAGI 推出了基于 GPT-4 构建的 AI 客户服务代理,可自动处理高达 93% 的支持问题,并将每张工单的平均成本从 $40 降至 $8。
OpenAI 与 WAN-IFRA 推出新闻编辑室 AI 催化剂计划
OpenAI 与 WAN-IFRA 已推出新闻编辑室 AI 催化剂计划,这是一项加速器项目,为全球 128 家新闻编辑室提供资金和技术支持,以快速推进 AI 采用并提升新闻业的可持续性。
OpenAI 与 The Atlantic 新闻整合合作伙伴关系
OpenAI 与 The Atlantic 已达成战略合作,将 The Atlantic 的优质新闻内容整合至 ChatGPT 及其他 OpenAI 产品中,并提供出处说明和完整文章链接。
OpenAI 与 Vox Media 战略合作伙伴关系
OpenAI 与 Vox Media 已达成战略合作,将 Vox Media 的新闻内容整合至 ChatGPT,并在面向消费者和广告主的 AI 驱动产品上展开合作。
文本生成推理基准测试
Hugging Face 推出了一款文本生成推理(TGI)基准测试工具,帮助开发者分析吞吐量与延迟之间的权衡,以优化大语言模型部署的成本和性能。
OpenAI董事会成立安全与安保委员会
OpenAI已成立安全与安保委员会,以监督其项目和运营中的关键安全与安保决策,同时开始训练其下一代前沿模型。
使用 Sentence Transformers 进行嵌入模型的训练与微调
Hugging Face 提供了使用 Sentence Transformers 库训练和微调嵌入模型的完整指南,适用于语义搜索、RAG 等任务,并引入了全新的 SentenceTransformerTrainer。
Falcon 2 11B 发布说明
TII 已发布 Falcon 2 11B,这是一系列更小且高性能的模型,包括在超过 5 万亿标记上训练的预训练 LLM 和视觉语言模型(VLM)。
CyberSecEval 2:评估大型语言模型的网络安全风险
Hugging Face 和 Meta 推出了 CyberSecEval 2,这是一套用于评估 LLM 对代码解释器滥用、攻击性网络安全能力以及提示注入攻击易感性的综合框架。
OpenAI 与 News Corp 多年全球合作伙伴关系
OpenAI 与 News Corp 已签署多年协议,允许 OpenAI 将 News Corp 来自《华尔街日报》和《泰晤士报》等主要出版物的当前及存档内容整合到其产品中,以提升信息可靠性。
Hugging Face AWS Inferentia2 集成
Hugging Face 已扩展对 AWS Inferentia2 的支持,使得可以通过 Amazon SageMaker 部署超过 100,000 个模型,并为 Hugging Face 推理端点引入了新的 Inf2 实例选项。
OpenAI 安全实践
OpenAI 详细阐述了用于开发和部署前沿 AI 模型的十项核心安全实践,强调以科学方法将安全融入模型生命周期的每个阶段。
Hugging Face 与 Microsoft 战略合作更新(2024年5月)
Hugging Face 与 Microsoft 扩大了战略合作,将流行的开源模型集成到 Azure 模型目录,支持 Azure 上的 AMD MI300X GPU,并为 Hugging Face Spaces 引入了 VS Code 集成。
Hugging Face 对 AMD Instinct MI300 GPU 的集成
Hugging Face 为 AMD Instinct MI300 GPU 提供了一流的集成,使 Llama 3 70B 的推理速度提升至最高 3 倍,微调速度提升至 2 倍,相较于 MI250。
Dell Enterprise Hub:本地 AI 部署与训练
Hugging Face 与 Dell 联手推出 Dell Enterprise Hub,这是一套简化在 Dell 硬件上本地训练和部署开源大型语言模型的平台。
Hugging Face Spaces 开发模式发布
Hugging Face 推出了 Spaces 开发模式,允许 PRO 订阅者通过 VS Code 或 SSH 进行实时代码编辑,无需为每一次更改进行 git 推送。
OpenAI ChatGPT 语音选择流程
OpenAI 详细说明了为 ChatGPT 选拔五位专业配音演员的五个月配音过程,并澄清语音 “Sky” 并非旨在模仿 Scarlett Johansson。
ChatGPT 数据分析改进 2024年5月
OpenAI 在 ChatGPT 中推出了数据分析的增强功能,包括直接云存储集成、交互式表格和可定制图表,基于 GPT-4o 提供支持。
OpenAI 与 Reddit 合作伙伴关系
OpenAI 与 Reddit 已合作,将实时 Reddit 内容集成到 ChatGPT 中,并实现 OpenAI 的 AI 模型,以提升 Reddit 的用户和版主功能。
Hugging Face KV 缓存量化
Hugging Face 在 Transformers 库中引入了 KV 缓存量化,以在对模型质量影响最小的情况下降低长上下文文本生成的内存使用。
Canva Magic Studio 与 OpenAI 的集成
Canva 已集成 OpenAI 的 GPT-4 和 API,为其 Magic Studio AI 套件提供动力,该套件已被使用超过 50 亿次,以简化非专业创作者的设计。
OpenAI 领导层变动:Ilya Sutskever 离职,Jakub Pachocki 任命为首席科学家
OpenAI 宣布联合创始人 Ilya Sutskever 将离开公司,Jakub Pachocki 被任命为新任首席科学家,负责领导面向 AGI 的研究工作。
介绍开放阿拉伯语大型语言模型排行榜
Hugging Face 与技术创新研究所推出了开放阿拉伯语大型语言模型排行榜(OALL),为阿拉伯语大型语言模型提供了一个专门的、开放的评估平台。
PaliGemma 视觉语言模型发布
Google 已发布 PaliGemma,这是一系列结合 SigLIP-So400m 和 Gemma-2B 的开源视觉语言模型,可实现图像字幕、视觉问答和目标检测等任务。
Hugging Face 与 LangChain 推出 langchain_huggingface 合作包
Hugging Face 与 LangChain 已发布 langchain_huggingface,这是一个共同维护的合作包,旨在简化 Hugging Face 模型在 LangChain 生态系统中的集成。
OpenAI GPT-4o 发布说明
OpenAI 已发布 GPT-4o,这是一款在文本、视觉和音频上端到端训练的全能模型,能够实现自然的人机交互,并具有人类般的响应延迟。
OpenAI 春季更新:推出 GPT-4o
OpenAI 已发布 GPT-4o,这款能够在音频、视觉和文本之间进行实时推理的新旗舰模型,同时向 ChatGPT 免费用户扩展了高级功能。
OpenAI GPT-4o 发布及 ChatGPT 免费层增强
OpenAI 已推出 GPT-4o,这款旗舰模型提供 GPT-4 级别的智能,具备更快的速度和跨文本、语音、视觉的多模态能力,现已对免费和付费用户均可使用。
Transformers Agents 2.0 release notes / what's new
Hugging Face 推出了 Transformers Agents 2.0,这是一个模块化智能体框架,其特点是具备迭代式问题解决智能体,并且使用 Llama-3-70B-Instruct 在 GAIA 基准测试中表现出高性能。
Qwen-Max-0428 发布说明
Qwen 已发布 Qwen-Max-0428,这是一款指令微调的聊天模型,在 MT-Bench 上优于 Qwen1.5-110B-Chat,并在 Chatbot Arena 排行榜中位列前十。
使用 Intel Gaudi 2 和 Intel Xeon 构建成本高效的企业 RAG 应用
Hugging Face 演示了通过 OPEA 框架将 Intel Gaudi 2 加速器与 Intel Xeon CPU 结合使用,如何使企业能够构建相较于基于 H100 系统具有更高性价比的 RAG 应用。