1451

Qwen-Max-0428 发布说明

Qwen 已发布 Qwen-Max-0428,这是一款指令微调的聊天模型,在 MT-Bench 上优于 Qwen1.5-110B-Chat,并在 Chatbot Arena 排行榜中位列前十。

1452

使用 Intel Gaudi 2 和 Intel Xeon 构建成本高效的企业 RAG 应用

Hugging Face 演示了通过 OPEA 框架将 Intel Gaudi 2 加速器与 Intel Xeon CPU 结合使用,如何使企业能够构建相较于基于 H100 系统具有更高性价比的 RAG 应用。

1453

Hugging Face 企业中心现已在 AWS Marketplace 上提供

Hugging Face 已将 Enterprise Hub 与 AWS Marketplace 集成,使组织能够升级其账户并通过 AWS 账户直接管理计费。

1454

OpenAI 模型规范

OpenAI 推出了模型规范,这是一套由目标、规则和默认行为组成的框架,旨在标准化并透明地塑造 AI 模型在 OpenAI API 和 ChatGPT 中的行为。

1455

OpenAI 对数据和 AI 的方法

OpenAI 正在推出 Media Manager,让创作者能够控制其内容在 AI 训练中的使用,并详细阐述其多管齐下的数据来源策略,以在模型多样性与创作者权益之间取得平衡。

1456

OpenAI 内容来源与真实性倡议

OpenAI 正在采用 C2PA 开放标准进行数字内容认证,并开发内部工具,如图像检测分类器和音频水印,以帮助用户识别 AI 生成的内容。

1457

OpenAI 与 Stack Overflow API 合作伙伴关系

OpenAI 与 Stack Overflow 已合作,通过 OverflowAPI 将经过审查的技术数据集成到 OpenAI 模型和 ChatGPT 中,同时 Stack Overflow 将使用 OpenAI 模型开发 OverflowAI。

1458

Hugging Face 开放排行榜(针对希伯来语 LLM)

Hugging Face 推出了专门用于评估和提升希伯来语大型语言模型(LLM)的开放排行榜,旨在应对资源匮乏和形态复杂语言的挑战。

1459

人工分析 LLM 性能排行榜 在 Hugging Face

Hugging Face 已集成 Artificial Analysis LLM Performance Leaderboard,为 AI 工程师提供统一的度量体系,以比较 100 多个无服务器 LLM API 端点的质量、价格和速度。

1460

Hugging Face 推理端点 ASR 与说话人分离流水线

Hugging Face 推出了一款自定义推理处理程序,用于在推理端点上部署结合 Whisper ASR、Pyannote 分离和推测解码的模块化流水线。

1461

OpenAI 打击“Bad Grammar”俄罗斯关联的影响行动

OpenAI 禁止了一个名为“Bad Grammar”的俄罗斯关联网络,该网络使用 AI 模型自动生成跨多个国家的政治评论垃圾信息并在 Telegram 上发布。

1462

OpenAI 打击与中国有关的影响行动 “Spamouflage”

OpenAI 禁用了与名为 Spamouflage 的行动相关的账户,该行动是一个与中国有关的影响力宣传活动,利用 AI 生成内容并进行研究,以针对中国政府的批评者。

1463

OpenAI 打击俄罗斯‘Doppelganger’影响行动

OpenAI 禁止了四个与俄罗斯‘Doppelganger’影响行动相关的账户群组,这些账户使用 AI 生成多语言内容,针对欧洲和北美。

1464

OpenAI 零 Zeno 行动:与以色列关联的影响活动

OpenAI 禁止了由以色列政治宣传公司 STOIC 运营的一批账户,以阻止针对多个国家的 AI 生成影响行动。

1465

OpenAI 打击伊朗关联的影响行动 IUVM

OpenAI 封禁了与 IUVM 相关的账户,IUVM 是一个伊朗关联的影响网络,使用 AI 生成并翻译亲伊朗、反美和反以色列的内容。

1466

通过结构化生成提升提示一致性

Hugging Face 与 Dottxt 的研究表明,使用结构化生成来约束 LLM 输出可以降低性能差异,并提升在不同提示格式和示例顺序下的排名一致性。

1467

StarCoder2-15B-Instruct-v0.1 发布说明 / 新功能

Hugging Face 推出 StarCoder2-15B-Instruct-v0.1,这是首个使用完全透明且宽松的流水线进行全自我对齐的代码大语言模型,在 HumanEval 上超越了 CodeLlama-70B-Instruct。

1468

OpenAI 与《金融时报》战略合作伙伴关系

OpenAI 与《金融时报》已达成战略合作伙伴关系和许可协议,将归属的 FT 新闻内容整合到 ChatGPT 中,并为 FT 员工提供 ChatGPT Enterprise 访问权限。

1469

Qwen1.5-110B 发布说明 / 新功能

Qwen 已发布 Qwen1.5-110B,这是 Qwen1.5 系列中首个参数量超过 1000 亿的模型,提供了与 Llama-3-70B 竞争的性能,并相较 Qwen1.5-72B 有显著提升。

1470

Moderna 与 OpenAI 的 AI 驱动药物研发合作

Moderna 已在整个组织内部署了 ChatGPT Enterprise,以加速 mRNA 药物的研发,并通过定制 GPT 优化业务运营。

1471

OpenAI 推出 ChatGPT 与 Whisper API

OpenAI 已发布 GPT-3.5 Turbo 和 Whisper API,为开发者提供显著的成本降低和高性能的语音转文本能力。

1472

GPT-4 API 正式可用及 Completions API 弃用

OpenAI 已向所有付费客户正式开放 GPT-4 API,并公布了对 Completions、Embeddings 和 Edits API 中旧模型的弃用计划。

1473

OpenAI儿童安全承诺:采用安全设计原则

OpenAI 与其他行业领袖已承诺实施安全设计原则,以降低生成式 AI 对儿童的风险,重点在于防止儿童性虐待材料(CSAM)和剥削材料(CSEM)。

1474

OpenAI 企业 API 功能更新 2024年4月

OpenAI 引入了全新的企业级安全、管理控制、Assistants API 增强功能以及成本管理选项,以支持大型组织的 AI 解决方案规模化。

1475

Hugging Face 开放链式思考排行榜

Hugging Face 推出了开放链式思考排行榜,用于衡量链式思考提示在各种大型语言模型上对复杂推理任务所带来的特定准确率提升。

1476

全能型(JAT)多用途变压器代理

Hugging Face 推出全能型(JAT),一种基于单一 Transformer 的代理,能够在 Atari、BabyAI、Meta-World 和 MuJoCo 环境中执行多样的序列决策任务。

1477

OpenAI 指令层级:优先处理特权指令以防止提示注入

OpenAI 引入了指令层级,训练大型语言模型优先处理系统提示而非不可信的用户输入,从而显著降低了对提示注入和越狱的易受攻击性。

1478

开放医学-LLM 排行榜:在医疗领域对大型语言模型进行基准评估

Hugging Face 推出了开放医学-LLM 排行榜,一个标准化平台,用于在多样化医学数据集上评估和比较 LLM 的性能,以提升可靠性和患者安全。

1479

Meta Llama 3 发布说明

Meta 发布了 Llama 3,这是一款开放获取的 LLM 系列,提供 8B 和 70B 参数模型,具备改进的分词器,并在 15 万亿 token 上进行训练。

1480

CodeQwen1.5 发布说明

Qwen 已发布 CodeQwen1.5-7B,这是一款支持 92 种编程语言和 64K token 上下文窗口的开源代码大模型,以提升开发者生产力。

1481

Ryght 案例研究:使用 Hugging Face 构建生命科学生成式 AI 平台

Ryght 已推出 Ryght Preview,这是一款面向医疗保健和生命科学的企业级生成式 AI 平台,利用 Hugging Face 的专家支持、TGI 和 TEI,提供安全、灵活且高性能的 AI 副驾驶。

1482

在 Hugging Face 端点上运行隐私保护推理

Hugging Face 与 Zama 已实现通过 Hugging Face 端点部署全同态加密(FHE)模型,使用户能够在加密数据上进行机器学习推理,而无需解密。

1483

LiveCodeBench 排行榜:无污染的代码 LLM 评估

Hugging Face 推出了 LiveCodeBench 排行榜,这是一项由加州大学伯克利分校、麻省理工学院和康奈尔大学的研究人员开发的新基准,用于评估 LLM 的代码生成和推理能力,并通过时间窗口问题集防止基准污染。

1484

Gradio 重载模式加速 AI 应用开发

Gradio 的重载模式使开发者能够在不重启服务器的情况下即时将源代码更改应用到 AI 应用中,显著降低开发延迟。

1485

Idefics2 8B 视觉语言模型发布 – 架构、数据与性能

Hugging Face 发布了 Idefics2,这是一款 8B 开源视觉语言模型,在 VQA 和 OCR 基准测试中优于其他 8B 模型,并可通过 🤗 Transformers 进行微调。

1486

OpenAI 日本发布与 GPT-4 日语定制模型

OpenAI 在东京开设了首个亚洲办事处,并发布了针对日语优化的 GPT-4 定制模型,其运行速度比 GPT-4 Turbo 快至 3 倍。

1487

视觉语言模型概述

Hugging Face 提供了一份关于视觉语言模型(VLM)的综合指南,详细阐述了它们的架构、开源选项、评估基准,以及通过 TRL 库进行微调的全新实验性支持。

1488

Hugging Face 与 Google Cloud Vertex AI 模型花园集成

Hugging Face 推出了 “Deploy on Google Cloud”,使用户能够通过 Hugging Face Hub 或 Vertex Model Garden 将数千个开源基础模型部署到 Vertex AI 或 Google Kubernetes Engine(GKE)。

1489

CodeGemma 发布说明 / 新功能

Google 已发布 CodeGemma,这是一系列基于 Gemma 的开放获取代码专用大语言模型(LLM),在额外的 5000 亿代码、数学和英文数据令牌上进行训练。

1490

Hugging Face 公共政策项目概览及提交材料

Hugging Face 宣布了一项全面的公共政策项目,为美国、欧盟和英国的政策制定者提供详细的立场文件、证词和评论信,体现了其跨职能的负责任开放承诺以及塑造 AI 监管的努力。

1491

Klarna AI 助手集成与绩效结果

Klarna 部署了一个基于 OpenAI 的 AI 助手,处理了三分之二的客户服务聊天,完成相当于 700 名全职代理的工作,同时提升了解决时间和利润。

1492

Hugging Face 与 Wiz 研究合作伙伴关系,致力于 AI 安全

Hugging Face 与 Wiz 合作,整合先进的漏洞管理和云安全姿态管理,以保护其平台及更广泛的 AI/ML 生态系统。

1493

使用 Hugging Face 数据集查看器 API 和 DuckDB-NSQL-7B 的 Text2SQL

Hugging Face 演示了如何使用 DuckDB-NSQL-7B 模型和 Dataset Viewer API,将自然语言问题转换为 SQL 查询,从而分析超过 120,000 个开放数据集。

1494

OpenAI 微调 API 改进及定制模型计划扩展

OpenAI 为其微调 API 引入了新的控制功能,并扩展了定制模型计划,涵盖了辅助微调和针对特定领域需求的全定制训练模型。

1495

使用 🤗 Optimum Intel 在 Xeon 上加速 SetFit 推理

Hugging Face 演示了如何通过 🤗 Optimum Intel 库的后训练静态量化,在 Intel Xeon CPU 上实现 SetFit 模型最高 7.8 倍的推理吞吐量提升。

1496

Qwen1.5-32B 发布说明 / 新功能

Qwen 已发布 Qwen1.5-32B 和 Qwen1.5-32B-Chat,这些模型旨在在保持高性能的同时,相较于 72B 版本降低内存和推理成本。

1497

Hugging Face 与 Cloudflare Workers AI 集成

Hugging Face 将 Cloudflare Workers AI 集成,以为流行的开源模型提供无服务器 GPU 推理,使开发者能够以按请求付费的定价模式部署 AI 应用。

1498

OpenAI 与 Harvey 合作开发定制案例法模型

OpenAI 与 Harvey 合作创建了一个定制训练的案例法模型,整合了 100 亿个美国案例法的标记,以提升推理能力并减少法律专业任务中的幻觉现象。

1499

ChatGPT 访问更新:无需账户注册即可即时使用

OpenAI 已实现无需账户注册即可即时使用 ChatGPT,扩大了 AI 对全球受众的可访问性。

1500

Oscar Health AI 实施:降低成本并提升护理

Oscar Health 使用 OpenAI 的 API 自动化临床文档和索赔处理,将文档时间缩短 40%,升级解决时间缩短 50%。