← 返回资讯
产品发布 AWS ML Blog

Amazon SageMaker AI 引入容器缓存加速模型扩展

Amazon SageMaker AI 推理新增容器镜像缓存功能,这是快速扩展优化的重大进展。在生成式 AI 模型扩展期间,端到端延迟最多可提升 2 倍。

查看原文
解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。