本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
启动系统提示推荐
开始提出建议,为您的代理生成优化的系统提示。该服务分析代理跟踪,确定故障模式,并生成修订后的系统提示音,以提高目标评估器的性能。
注意
建议由 LLM 生成。在应用它们之前进行审查和测试。
代码示例
例
请求参数
| 参数 | Type | 必需 | 描述 |
|---|---|---|---|
|
|
字符串 |
是 |
推荐的名称。最多 48 个字符。图案: |
|
|
字符串 |
是 |
必须是 |
|
|
对象 |
是 |
|
|
|
字符串 |
否 |
可选描述。最多 4096 个字符。 |
|
|
字符串 |
否 |
等效性标记。如果您使用相同的客户端令牌重试请求,该服务将返回现有建议,而不是创建新的建议。 |
系统PromptRecommendationConfig 字段
| 字段 | 类型 | 必需 | 说明 |
|---|---|---|---|
|
|
Union |
是 |
当前系统提示要优化。提供 |
|
|
Union |
是 |
用于分析的追踪来源。有关建议,请参阅追踪来源。 |
|
|
对象 |
是 |
指定目标评估者的评估配置。包含一个仅包含一个评估者参考的 |
选择评估员
选择与要改进的方向对齐的评估器。您选择的评估器决定建议的优化方向;无论评估者的得分高如何,都是优化器将提示推送到的方向。
您可以使用内置评估器或提供自定义评估器 ARN。使用以下准则进行选择:
-
如果您的代理有明确的任务要完成(预订、检索、多步工作流程),
Builtin.GoalSuccessRate这是正确的信号。 -
如果你的代理更开放,而且你关心互动本身的质量,
Builtin.Helpfulness那就更合适了。 -
如果您关心的质量是特定领域的,或者不是由内置评估器捕获的,请使用自定义评估器来最好地表示测量结果。
注意
推荐支持内置 LLM-as-judge、自定义和基于代码的评估器,但要求评估器返回数值作为优化信号。对于自定义 LLM-as-judge 评估器,使用numerical比例ratingScale进行配置(不是categorical)。对于基于代码的评估器,请在响应架构中包含该value字段。
在 API 中,仅使用一个评估器参考来指定evaluationConfig.evaluators列表中的评估者:
"evaluationConfig": { "evaluators": [ {"evaluatorArn": "arn:aws:bedrock-agentcore:::evaluator/Builtin.GoalSuccessRate"} ] }
在 CLI 中,使用以下--evaluator标志:
--evaluator Builtin.GoalSuccessRate
系统提示输入模式
| Mode | CLI 标志 | API 字段 |
|---|---|---|
|
行内文本 |
|
|
|
配置包 |
|
|
使用配置包时,结果包括应用了优化系统提示的新捆绑包版本。
响应
| 字段 | Type | 说明 |
|---|---|---|
|
|
字符串 |
建议的唯一标识符。 |
|
|
字符串 |
该建议的 ARN。 |
|
|
字符串 |
你指定的名字。 |
|
|
字符串 |
|
|
|
字符串 |
初始状态: |
|
|
Timestamp |
创建推荐的时间。 |
|
|
Timestamp |
上次更新建议的时间。 |
推荐结果
当推荐达到COMPLETED状态(通过 “获取推荐” 检索)时,结果包含:
| 字段 | Type | 说明 |
|---|---|---|
|
|
字符串 |
优化的系统提示文本。 |
|
|
对象 |
当输入是配置包时出现。包含 |
|
|
字符串 |
解释提出该建议的原因以及修改建议背后的理由。 |
|
|
字符串 |
如果建议失败,则出现。描述故障的错误代码。 |
|
|
字符串 |
如果建议失败,则出现。 Human-readable 错误描述。 |
错误
| 错误 | HTTP 状态 | 说明 |
|---|---|---|
|
|
400 |
请求参数无效。检查字段限制和必填字段。 |
|
|
403 |
权限不足。验证 IAM 策略。 |
|
|
409 |
已经存在具有相同客户令牌且具有不同参数的推荐。 |
|
|
402 |
您已超过并发建议的最大数量。 |
|
|
429 |
超出请求速率。使用指数回退进行重试。 |
|
|
500 |
Service-side 错误。重试请求。 |