IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 人工智能 -> 卷积神经网络中的内存问题 -> 正文阅读

[人工智能]卷积神经网络中的内存问题

在创建卷积神经网络时,遇到了内存溢出的问题,困扰我比较久的有两个。

1 中间产生的tensor过大导致内存不够

核心错误信息如下:

(1) Resource exhausted: OOM when allocating tensor with shape[4000,256,127,127] and type float on /job:localhost/replica:0/task:0/device:GPU:0 by allocator GPU_0_bfc
         [[node Conv2D_1 (defined at work55.py:116) ]]

很明显,这里是因为我的张量太大了,所以没有足够的内存可以分配。
这个张量是做前向传播的一个中间量,由输入图片矩阵做卷积得到,核查后发现是我的卷积核太大了(哭)。
卷积核改小以后就可以顺利运行了。

ps:这个格式的内存溢出错误还挺常见的,我在之前也遇到不少。总结一下就是:找到引起溢出的变量,倒推出它产生的原因再考虑修改。

2 TensorFlow变量初始化后占用内存过大

需要初始化的tf变量:

def initialize_parameters():
    """
    初始化参数。
    卷积核的维度:    
     [ filter_height, filter_width, in_channel, out_channels ],其中 filter_height 为卷积核高度,filter_width 为卷积核宽度,
     in_channel 是图像通道数 ,和 input 的 in_channel 要保持一致,out_channel 是卷积核数量

    残差图像作为第一层卷积的原始输入,第一层卷积有8个5×5的卷积核,中间三层的卷积中有256个3×3的卷积核,第五层卷积则有256个3×3的卷积核。
    
    返回:
        包含了tensor类型的W1-W5的字典
    """
    tf.set_random_seed(4)
    W1 = tf.get_variable("W1",[5,5,3,8],initializer=tf.contrib.layers.xavier_initializer(seed=0))
    W2 = tf.get_variable("W2",[3,3,8,8],initializer=tf.contrib.layers.xavier_initializer(seed=1))
    W3 = tf.get_variable("W3",[3,3,8,8],initializer=tf.contrib.layers.xavier_initializer(seed=2))
    
    
    parameters={
        "W1":W1,
        "W2":W2,
        "W3":W3,
        
    }
    return parameters
#全局初始化所有变量
init = tf.global_variables_initializer()
#初始化参数
sess.run(init)

(这里的W1、W2、W3就是上文提到的初始太大后来被改小的卷积核)

程序运行中的GPU内存
可以看到,程序开始运行后,占了22.5GB的GPU内存,真的贼不合理。初始占据这么大的内存就导致后面我有其他数据进内存的时候内存溢出了。
最初我以为是run后初始变量占空间太大,后来简单算了一下没有那么大,具体什么原因我到现在也不是很清楚,但是这个问题我解决了哈哈哈哈。

添加代码如下:

config = tf.ConfigProto()
config.gpu_options.allow_growth = True
with tf.Session(config=config) as sess:
	sess.run(init)
	'''
	other code
	'''

代码的作用在于不会一次性分配GPU内存,而是按需分配,就可以避免一次分配大量内存而后续内存不够的情况。
参考博客:
https://www.cnblogs.com/txg198955/p/6734358.html

  人工智能 最新文章
2022吴恩达机器学习课程——第二课(神经网
第十五章 规则学习
FixMatch: Simplifying Semi-Supervised Le
数据挖掘Java——Kmeans算法的实现
大脑皮层的分割方法
【翻译】GPT-3是如何工作的
论文笔记:TEACHTEXT: CrossModal Generaliz
python从零学(六)
详解Python 3.x 导入(import)
【答读者问27】backtrader不支持最新版本的
上一篇文章      下一篇文章      查看所有文章
加:2021-08-14 14:01:52  更:2021-08-14 14:02:26 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2025年1日历 -2025/1/12 1:46:44-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码