amazon-bedrock
aws/agent-toolkit-for-aws
在 Amazon Bedrock 上构建生成式 AI 应用程序。涵盖模型调用(Converse API、InvokeModel)、基于知识库的 RAG、Bedrock 代理、安全防护机制以及 AgentCore。 适用于调用模型、配置知识库、创建智能代理、应用防护机制、部署到AgentCore、排查Bedrock错误(ThrottlingException、AccessDeniedException)或选择模型(Claude、Llama、Nova、Titan)。 还可用于提示词缓存的配置和调试、配额健康检查以及限流
...展开全部关于amazon-bedrock
在 Amazon Bedrock 上构建生成式 AI 应用所需的领域专业知识。内容涵盖通过 Converse API 和 InvokeModel 调用模型、利用知识库进行检索增强生成、Bedrock 智能体、通过 Guardrails 实现内容安全,以及利用 AgentCore 进行智能体部署和扩展。 在调用模型、配置知识库、创建智能代理、应用Guardrails、向AgentCore部署、排查Bedrock错误(如ThrottlingException和AccessDeniedException)或在Claude、Llama、Nova和Titan等模型之间进行选择时,均可使用本指南。 此外,该技能还涉及提示词缓存、配额健康检查、成本追踪、模型迁移、分块策略以及 AgentCore 支付功能,但明确不适用于自定义模型训练、Rekognition 或 Comprehend。 由于 Bedrock API、模型 ID 和配置参数频繁变更,该技能坚持在响应前将捆绑的参考文件作为主要权威来源进行查阅。
一个主要主题是 Bedrock API 架构,该架构提供了五个独立的端点,其误用是常见的错误来源:用于列出模型和管理访问权限的 bedrock 控制平面;用于通过 Converse 或 InvokeModel 调用模型的 bedrock-runtime; bedrock-mantle 用于 OpenAI 兼容 API(推荐新用户使用);以及 bedrock-agent 和 bedrock-agent-runtime 用于代理配置和调用。AgentCore 是一项独立服务,拥有自己的控制平面和数据平面端点。 该技能推荐使用 AWS MCP 服务器进行沙箱执行和审计日志记录,但也可与任何具有 AWS CLI 访问权限的代理配合使用。
该技能特别强调关键警告和安全实践:必须始终显式设置 maxTokens,因为若未设置,系统会预留远超实际需求的配额,从而导致意外的限流;Guardrails 个人身份信息(PII)屏蔽仅适用于响应内容,而未屏蔽的内容仍会记录到 CloudWatch;此外,必须使用最新版本的 boto3 和 AWS CLI v2。 安全指南建议优先使用 IAM 角色而非用户、范围限定权限、Secrets Manager、混淆代理保护(confused-deputy),并将代理生成的参数视为不可信输入。出于统一请求/响应格式的考虑,建议优先使用 Converse API 而非 InvokeModel,其中能力表和模型选择表会指向更深入的参考文件。
常见问题
我应该使用哪个 Bedrock API 来调用模型?
在 bedrock-runtime 端点上,该技能推荐使用 Converse API 而不是 InvokeModel,因为它为所有模型提供了统一的请求/响应格式。InvokeModel 仅用于极少数提供商特有的功能,而对于新的 OpenAI 兼容工作,建议使用 bedrock-mantle。
为什么强调每次调用都要设置 maxTokens?
若未设置 maxTokens,系统将默认采用模型的最大值(例如 Claude Sonnet 的 64K),并会默默预留远超实际需求的配额,这往往是引发意外 ThrottlingException 的常见原因。
Bedrock API 共有多少个端点,它们分别用于什么?
共有五个:bedrock(控制平面)、bedrock-runtime(调用模型)、bedrock-mantle(OpenAI 兼容 API)、bedrock-agent(配置代理和知识库)以及 bedrock-agent-runtime(调用代理和查询知识库)。 AgentCore 是一个独立的服务,拥有自己的端点。
该技能关于 Guardrails 和 PII 的警告内容是什么?
Guardrails 的 PII 屏蔽仅适用于 API 响应;原始未屏蔽内容(包括 PII)仍会以明文形式记录到 CloudWatch Logs 中。为符合 HIPAA/GDPR 合规要求,建议使用 KMS 对这些日志进行加密并限制访问权限。
该技能是否适用于训练自定义模型或使用 Rekognition?
不适合。该技能明确指出,它不适用于自定义模型训练、Rekognition 或 Comprehend。它专注于模型调用、RAG、智能代理、安全防护机制和 AgentCore。





首页
