Anthropic 提升业务性能的提示工程
TL;DR
Anthropic 发布了一份关于提升业务性能的提示工程指南,证明了战略性提示可以显著提高 Claude 的准确性、一致性和成本效率。通过应用诸如 few-shot prompting 和 prompt chaining 等结构化技术,企业可以减少幻觉并降低部署成本,同时保持品牌一致的客户体验。
有效提示的核心优势
在专业环境中,战略性提示工程对于优化生成式 AI 的输出至关重要。Anthropic 确定了精心设计的提示词的四个主要优势:
- 准确性: 有效的提示可以进一步降低输出不准确和产生幻觉的风险。
- 一致性: 深思熟虑的提示可以确保在最终用户体验中保持统一的质量、格式、相关性和语气。
- 有用性: 提示工程允许企业迎合特定的角色和行业特定需求,提供有针对性的体验。
- 成本节约: 优化提示可以最大限度地减少不必要的往复交互,从而降低大规模运行输入和输出的成本。
业务关键提示技术
Anthropic 建议将提示工程视为一门科学——经常进行测试和迭代——并提供清晰、明确的指令,就像 Claude 是入职第一天的实习生一样。
分步推理
引导 Claude "think step by step" 通常会提高响应的准确性。这对于逻辑谜题或复杂的评估特别有效,例如确定保险索赔是否符合特定的保单要求。
Few-Shot Prompting
提供所需输入和理想输出的真实且具体的示例,有助于 Claude 理解预期的格式并处理边缘情况。例如,在脱敏个人身份信息 (PII) 时,提供如何将姓名、电话号码和电子邮件替换为 "XXX" 的合成示例,可以确保模型遵循所需的脱敏标准。
Prompt Chaining
Prompt chaining 涉及将复杂的任务分解为多个较小的提示词。每个后续提示词可以包含之前的提示词-响应对,以构建上下文。一个解释税务情况的工作流示例将涉及:
- 创建一个相关税务代码的列表。
- 识别这些文档中的相关章节。
- 根据收集到的信息向用户生成最终响应。
案例研究:准确性提升 20%
Anthropic 与一家财富 500 强公司合作,使用 Claude Instant 构建了一个面向客户的聊天助手。该公司寻求一种友好、简洁、低延迟且高准确性的聊天机器人,因为他们发现其他市场解决方案过于冗长或生硬。
实施策略
Anthropic 的提示工程师与该公司的领域专家 (SMEs) 合作,实施了以下内容:
- Scratchpads: 引导 Claude 使用 scratchpad(例如,使用
<relevant_quotes>标签)在内部展示其工作过程。这个过程对客户是隐藏的,但可以提高准确性。 - Few-Shot Examples: 针对公司特定的预期格式和风格对模型进行训练。
- SME Guidance: 引导 Claude 使用领域专家推荐的特定数据点和工作流,例如影响法律情况的特定因素。
结果
通过将提示工程的最佳实践与领域专业知识相结合,该公司 提高了 Claude 的准确性 20%,同时降低了成本并缩短了上市时间。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch