我的 Amazon Bedrock 批量推理作业运行缓慢或失败。
批量作业的执行时间取决于可用容量、队列中的并发作业数量以及特定于模型的资源分配。使用以下解决方法在 Amazon Bedrock 中优化您的批量推理作业。
要缩短作业处理时间并提高结果质量,请创建清晰简洁的提示,不包含不必要的上下文。
如果您并行运行多个批量推理作业,请确保其不超过不同模型和 AWS 区域的不同服务配额。
有关大规模项目的详细信息,请参阅 Automate Amazon Bedrock batch inference: Building a scalable and efficient pipeline(自动化 Amazon Bedrock 批量推理:构建可扩展且高效的管道)。
使用 Amazon EventBridge 计划批量推理作业在资源可用性可能更高的非高峰时段运行。
在 CreateModelInvocationJob API 请求中使用跨区域推理配置文件以跨区域分配工作负载。
rePost Polyglot
已提问 3 年前
AWS-Yuting-Su
已发布 2 年前