浅谈Tensorflow 动态双向RNN的输出问题

更新时间：2020年4月22日 23:19 点击：1898

tf.nn.bidirectional_dynamic_rnn()

函数：

def bidirectional_dynamic_rnn(
  cell_fw, # 前向RNN
  cell_bw, # 后向RNN
  inputs, # 输入
  sequence_length=None,# 输入序列的实际长度（可选，默认为输入序列的最大长度）
  initial_state_fw=None, # 前向的初始化状态（可选）
  initial_state_bw=None, # 后向的初始化状态（可选）
  dtype=None, # 初始化和输出的数据类型（可选）
  parallel_iterations=None,
  swap_memory=False,
  time_major=False,
  # 决定了输入输出tensor的格式：如果为true, 向量的形状必须为 `[max_time, batch_size, depth]`.
  # 如果为false, tensor的形状必须为`[batch_size, max_time, depth]`.
  scope=None
)

其中，

outputs为(output_fw, output_bw)，是一个包含前向cell输出tensor和后向cell输出tensor组成的元组。假设

time_major=false,tensor的shape为[batch_size, max_time, depth]。实验中使用tf.concat(outputs, 2)将其拼接。

output_states为(output_state_fw, output_state_bw)，包含了前向和后向最后的隐藏状态的组成的元组。

output_state_fw和output_state_bw的类型为LSTMStateTuple。

LSTMStateTuple由（c，h）组成，分别代表memory cell和hidden state。

返回值：

元组：(outputs, output_states)

这里还有最后的一个小问题，output_states是一个元组的元组，处理方法是用c_fw,h_fw = output_state_fw和c_bw,h_bw = output_state_bw，最后再分别将c和h状态concat起来，用tf.contrib.rnn.LSTMStateTuple()函数生成decoder端的初始状态

def encoding_layer(rnn_size,sequence_length,num_layers,rnn_inputs,keep_prob):
  # rnn_size: rnn隐层节点数量
  # sequence_length: 数据的序列长度
  # num_layers:堆叠的rnn cell数量
  # rnn_inputs: 输入tensor
  # keep_prob:
  '''Create the encoding layer'''
  for layer in range(num_layers):
    with tf.variable_scope('encode_{}'.format(layer)):
      cell_fw = tf.contrib.rnn.LSTMCell(rnn_size,initializer=tf.random_uniform_initializer(-0.1,0.1,seed=2))
      cell_fw = tf.contrib.rnn.DropoutWrapper(cell_fw,input_keep_prob=keep_prob)
 
      cell_bw = tf.contrib.rnn.LSTMCell(rnn_size,initializer=tf.random_uniform_initializer(-0.1,0.1,seed=2))
      cell_bw = tf.contrib.rnn.DropoutWrapper(cell_bw,input_keep_prob = keep_prob)
 
      enc_output,enc_state = tf.nn.bidirectional_dynamic_rnn(cell_fw,cell_bw,
                                  rnn_inputs,sequence_length,dtype=tf.float32)
 
  # join outputs since we are using a bidirectional RNN
  enc_output = tf.concat(enc_output,2) 
  return enc_output,enc_state

tf.nn.dynamic_rnn()

tf.nn.dynamic_rnn的返回值有两个：outputs和state

为了描述输出的形状，先介绍几个变量，batch_size是输入的这批数据的数量，max_time就是这批数据中序列的最长长度，如果输入的三个句子，那max_time对应的就是最长句子的单词数量，cell.output_size其实就是rnn cell中神经元的个数。

例子来说明其用法，假设你的RNN的输入input是[2,20,128]，其中2是batch_size，20是文本最大长度，128是embedding_size，可以看出，有两个example，我们假设第二个文本长度只有13，剩下的7个是使用0-padding方法填充的。dynamic返回的是两个参数：outputs,state，其中outputs是[2,20,128]，也就是每一个迭代隐状态的输出，state是由(c,h)组成的tuple，均为[batch,128]。

outputs. outputs是一个tensor

如果time_major==True，outputs形状为 [max_time, batch_size, cell.output_size ]（要求rnn输入与rnn输出形状保持一致）

如果time_major==False（默认），outputs形状为 [ batch_size, max_time, cell.output_size ]

state. state是一个tensor。state是最终的状态，也就是序列中最后一个cell输出的状态。一般情况下state的形状为 [batch_size, cell.output_size ]，但当输入的cell为BasicLSTMCell时，state的形状为[2，batch_size, cell.output_size ]，其中2也对应着LSTM中的cell state和hidden state。

这里有关于LSTM的结构问题：

以上这篇浅谈Tensorflow 动态双向RNN的输出问题就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持猪先飞。

[!--infotagslink--]

上一篇: Python入门教程超详细1小时学会Python

下一篇: Python 列表(List)操作方法详解

解决Pycharm 运行后没有输出的问题
这篇文章主要介绍了解决Pycharm 运行后没有输出的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2021-02-06
cmd命令的重定向输出 2>&1详解
这篇文章主要介绍了cmd命令的重定向输出 2>&1详解,需要的朋友可以参考下...2020-08-28
解决tensorflow训练时内存持续增加并占满的问题
今天小编就为大家分享一篇解决tensorflow训练时内存持续增加并占满的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-04-22
Python如何输出警告信息
这篇文章主要介绍了Python如何输出警告信息，文中讲解非常细致，代码帮助大家更好的理解和学习，感兴趣的朋友可以了解下...2020-07-30
win10安装tensorflow-gpu1.8.0详细完整步骤
这篇文章主要介绍了win10安装tensorflow-gpu1.8.0详细完整步骤，本文给大家介绍的非常详细，具有一定的参考借鉴价值,需要的朋友可以参考下...2020-04-22
C# 输出字符串到文本文件中的实现代码
本文通过一个简单的代码给大家介绍C# 输出字符串到文本文件中，代码简单易懂，非常不错，具有一定的参考借鉴价值，需要的朋友参考下吧...2020-06-25
perl从文件中读取数据并输出的实现代码
perl从文件中读取数据并输出，附一个蛋白质序列的读取，有需要的朋友可以参考下...2020-06-29
macOS M1(AppleSilicon) 安装TensorFlow环境
苹果为M1芯片的Mac提供了TensorFlow的支持，本文主要介绍了如何给使用M1芯片的macOS安装TensorFlow的环境，感兴趣的可以了解一下...2021-08-13
python系统指定文件的查找只输出目录下所有文件及文件夹
这篇文章主要介绍了python系统指定文件的查找只输出目录下所有文件及文件夹,本文给大家介绍的非常详细，具有一定的参考借鉴价值，需要的朋友可以参考下...2020-04-22
windows系统Tensorflow2.x简单安装记录(图文)
这篇文章主要介绍了windows系统Tensorflow2.x简单安装记录(图文)，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧...2021-01-18
php输出全部gb2312编码内的汉字方法
本文介绍了php输出全部gb2312编码内的汉字方法，非常实用，有兴趣的同学可以参考一下 php输出全部gb2312编码内的汉字，$area表示分区，$pos表示分区内所在位置。代码...2017-07-06
完美解决TensorFlow和Keras大数据量内存溢出的问题
这篇文章主要介绍了完美解决TensorFlow和Keras大数据量内存溢出的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-07-04
详解PyQt5中textBrowser显示print语句输出的简单方法
这篇文章主要介绍了详解PyQt5中textBrowser显示print语句输出的简单方法，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧...2020-08-07
Tensorflow读取并输出已保存模型的权重数值方式
今天小编就为大家分享一篇Tensorflow读取并输出已保存模型的权重数值方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看不看...2020-04-30
python Popen 获取输出,等待运行完成示例
今天小编就为大家分享一篇python Popen 获取输出,等待运行完成示例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-05-06
C++输入一个字符串,把其中的字符按照逆序输出的两种方法解析
以下是对C++中输入一个字符串,把其中的字符按照逆序输出的两种方法进行了详细的分析介绍，需要的朋友可以过来参考下...2020-04-25
在tensorflow下利用plt画论文中loss,acc等曲线图实例
这篇文章主要介绍了在tensorflow下利用plt画论文中loss,acc等曲线图实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-16
浅谈C++中char型变量的地址输出
下面小编就为大家带来一篇浅谈C++中char 型变量的地址输出。小编觉得挺不错的，现在就分享给大家，也给大家做个参考。一起跟随小编过来看看吧...2020-04-25
Python通过TensorFLow进行线性模型训练原理与实现方法详解
这篇文章主要介绍了Python通过TensorFLow进行线性模型训练原理与实现方法,结合实例形式详细分析了Python通过TensorFLow进行线性模型训练相关概念、算法设计与训练操作技巧,需要的朋友可以参考下...2020-04-27
c#实现输出的字符靠右对齐的示例
下面小编就为大家分享一篇c#实现输出的字符靠右对齐的示例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-25

浅谈Tensorflow 动态双向RNN的输出问题

相关文章

阁下可能感兴趣的内容

推荐阅读