ModelArts训练作业预置框架自定义配置深度学习框架版本

举报
星月菩提 发表于 2020/11/24 17:21:24 2020/11/24
5.2k+ 0 0
【摘要】 以pytorch 1.5和tensorflow 1.14为例,如何在训练作业预置框架进行动态配置Pytorch 1.5和tensorflow 1.14

当前ModelArts各功能都只支持有限的框架版本,如果想要使用一个预置框架没有的版本应该如何处理?

下面以pytorch 1.5和tensorflow 1.14为例,如何在训练作业预置框架进行动态配置Pytorch 1.5和tensorflow 1.14

Pytorch 1.5要基于cuda 10.1版本以上,tensorflow 1.14需要cuda10. 因此需要选择正确的docker镜像版本,才能实现

Torch 安装命令参考

https://pytorch.org/get-started/previous-versions/

1      Pytorch 1.5

创建训练作业时选择pytorch 1.4框架

入口脚本的第一行,注意一定是第一行增加如下代码

import os
os.system('pip uninstall torch torchvision –y;pip install torch==1.5.0 torchvision==0.6.0')

2      Tensorflow 1.14

2.1        GPU版本

入口脚本的第一行,注意一定是第一行增加如下代码

import os
os.system('pip uninstall tensorflow-gpu -y; pip install tensorflow-gpu==1.14.0;')

训练作业进行如下配置

2.2        CPU版本

在入口脚本的第一行,注意一定是第一行增加如下代码

import os
os.system('pip uninstall tensorflow -y; pip install tensorflow==1.14.0;')

训练作业进行如下配置

资源规格根据自己的需求来,一定要是cpu的资源

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

作者其他文章

评论(0

抱歉,系统识别当前为高风险访问,暂不支持该操作

    全部回复

    上滑加载中

    设置昵称

    在此一键设置昵称,即可参与社区互动!

    *长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

    *长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。