Amazon SageMaker创建Endpoint报错:PyTorchModel部署模型归档文件已存在
解决SageMaker部署PyTorch模型时的归档文件重复错误
你遇到的错误是因为本地生成的模型代码归档文件已存在,而overwrite=True仅作用于SageMaker端点,不影响本地代码的打包过程。
解决方案
- 手动清理本地已存在的模型归档文件:检查当前工作目录,删除自动生成的打包文件(比如临时的代码归档包)
- 在初始化
PyTorchModel时添加force=True参数,强制覆盖本地已存在的归档文件,修改后的代码如下:
pytorch_model = PyTorchModel( model_data='model.tar.gz', role=role, source_dir='model/code', entry_point='inference.py', framework_version='1.3.1', py_version='py3', force=True ) pytorch_model.deploy( instance_type='ml.t2.medium', initial_instance_count=1, endpoint_name='test', overwrite=True )
force=True参数会让SageMaker SDK在打包source_dir中的代码时,强制覆盖本地已存在的同名归档文件;而overwrite=True仅负责覆盖已存在的SageMaker端点资源,两者作用场景不同,同时设置即可解决你的问题。
内容的提问来源于stack exchange,提问作者Meghana S
相关产品推荐
相关产品推荐

