【经验】为什么用GPU运行深度学习代码还是很慢
·
可能因为batch_size设置太小。
今天做深度学习作业的时候发现程序是在GPU上跑的,但是运行的非常慢,一个epoch需要运行很长时间,经过检查发现:

显存(第二栏)仅仅用了十分之一不到,所以说明batch_size设置的太小了。当时设置的是20,10

然后当batch_size 设为200,100时,显存利用如下:


这样程序运行的快了很多。
DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。
更多推荐



所有评论(0)