启动系统提示建议
启动建议,为您的代理生成经过优化的系统提示。该服务分析代理跟踪,识别故障模式,并生成修订后的系统提示,以提高目标评估者的性能。
注意
推荐由法学硕士生成。在应用之前对其进行审查和测试。
代码示例
例
请求参数
| 参数 | Type | 必需 | 描述 |
|---|---|---|---|
|
|
字符串 |
是 |
推荐的名称。最多 48 个字符。图案: |
|
|
字符串 |
是 |
必须是 |
|
|
对象 |
是 |
|
|
|
字符串 |
否 |
可选描述。最多 4096 个字符。 |
|
|
字符串 |
否 |
等能令牌。如果您使用相同的客户端令牌重试请求,则该服务将返回现有建议,而不是创建新建议。 |
系统PromptRecommendationConfig 字段
| 字段 | 类型 | 必需 | 说明 |
|---|---|---|---|
|
|
Union |
是 |
当前系统提示进行优化。提供 |
|
|
Union |
是 |
追踪来源进行分析。有关建议,请参阅追踪来源。 |
|
|
对象 |
是 |
指定目标评估者的评估配置。包含一个只有一个赋值器参考的 |
选择评估者
选择与您想要改进的方向对齐的赋值器。您选择的赋值器决定了建议的优化方向;无论评估者得分很高,优化器都会将提示推向什么。
您可以使用内置评估器或提供自定义评估器 ARN。使用以下准则进行选择:
-
如果您的代理有明确的任务要完成(预订、取回、多步骤工作流程),那么
Builtin.GoalSuccessRate这是正确的信号。 -
如果你的代理人更具开放性,并且你关心互动本身的质量,那
Builtin.Helpfulness就更合适了。 -
如果您关心的质量是特定领域的,或者不是由内置评估器捕获的,请使用自定义评估器来最好地表示测量结果。
注意
推荐支持内置 LLM-as-judge、自定义和基于代码的赋值器,但要求评估器返回一个数值作为优化信号。对于自定义 LLM-as-judge 赋值器,请ratingScale使用numerical比例(不是categorical)进行配置。对于基于代码的赋值器,请在响应架构中包含value字段。
在 API 中,在evaluationConfig.evaluators列表中指定仅包含一个赋值器参考的赋值器:
"evaluationConfig": { "evaluators": [ {"evaluatorArn": "arn:aws:bedrock-agentcore:::evaluator/Builtin.GoalSuccessRate"} ] }
在 CLI 中,使用以下--evaluator标志:
--evaluator Builtin.GoalSuccessRate
系统提示输入模式
| Mode | CLI 标志 | API 字段 |
|---|---|---|
|
内联文本 |
|
|
|
配置包 |
|
|
使用配置包时,结果包括应用了经过优化的系统提示符的新捆绑包版本。
响应
| 字段 | Type | 说明 |
|---|---|---|
|
|
字符串 |
建议的唯一标识符。 |
|
|
字符串 |
该建议的 ARN。 |
|
|
字符串 |
您指定的名称。 |
|
|
字符串 |
|
|
|
字符串 |
初始状态: |
|
|
Timestamp |
建议的创建时间。 |
|
|
Timestamp |
上次更新建议的时间。 |
推荐结果
当推荐达到COMPLETED状态(通过 “获取推荐” 检索)时,结果将包含:
| 字段 | Type | 说明 |
|---|---|---|
|
|
字符串 |
优化的系统提示文本。 |
|
|
对象 |
当输入为配置包时出现。包含 |
|
|
字符串 |
解释产生该建议的原因以及建议的修改背后的原因。 |
|
|
字符串 |
如果建议失败,则在场。描述失败的错误代码。 |
|
|
字符串 |
如果建议失败,则在场。 Human-readable 错误描述。 |
错误
| 错误 | HTTP 状态 | 说明 |
|---|---|---|
|
|
400 |
请求参数无效。检查字段限制和必填字段。 |
|
|
403 |
权限不足。验证 IAM 策略。 |
|
|
409 |
已经存在具有相同客户端令牌且参数不同的推荐。 |
|
|
402 |
您已超过并发推荐的最大数量。 |
|
|
429 |
超出请求速率。使用指数回退进行重试。 |
|
|
500 |
Service-side 错误。重试请求。 |