• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • vbs
  • DOS/BAT
  • hta/htc
  • python
  • perl
  • VBA
  • ColdFusion
  • ruby
  • PowerShell
  • Lua
  • Golang
  • linux shell
您的位置:首页 > 脚本语言 >python > 使用tensorflow DataSet实现高效加载变长文本输入

使用tensorflow DataSet实现高效加载变长文本输入

作者:lyg5623 字体:[增加 减小] 来源:互联网

lyg5623 通过本文主要向大家介绍了tensorflow,DataSet,变长,文本输入等相关知识,希望对您有所帮助,也希望大家支持linkedu.com www.linkedu.com

DataSet是tensorflow 1.3版本推出的一个high-level的api,在1.3版本还只是处于测试阶段,1.4版本已经正式推出。

在网上搜了一遍,发现关于使用DataSet加载文本的资料比较少,官方举的例子只是csv格式的,要求csv文件中所有样本必须具有相同的维度,也就是padding必须在写入csv文件之前做掉,这会增加文件的大小。

经过一番折腾试验,这里给出一个DataSet+TFRecords加载变长样本的范例。

首先先把变长的数据写入到TFRecords文件:

def writedata():
 xlist = [[1,2,3],[4,5,6,8]]
 ylist = [1,2]
 #这里的数据只是举个例子来说明样本的文本长度不一样,第一个样本3个词标签1,第二个样本4个词标签2
 writer = tf.python_io.TFRecordWriter("train.tfrecords")
 for i in range(2):
  x = xlist[i]
  y = ylist[i]
  example = tf.train.Example(features=tf.train.Features(feature={
   "y": tf.train.Feature(int64_list=tf.train.Int64List(value=[y])),
   'x': tf.train.Feature(int64_list=tf.train.Int64List(value=x))
  }))
  writer.write(example.SerializeToString())
 writer.close()

然后用DataSet加载:

feature_names = ['x']
 
def my_input_fn(file_path, perform_shuffle=False, repeat_count=1):
 def parse(example_proto):
  features = {"x": tf.VarLenFeature(tf.int64),
    "y": tf.FixedLenFeature([1], tf.int64)}
  parsed_features = tf.parse_single_example(example_proto, features)
  x = tf.sparse_tensor_to_dense(parsed_features["x"])
  x = tf.cast(x, tf.int32)
  x = dict(zip(feature_names, [x]))
  y = tf.cast(parsed_features["y"], tf.int32)
  return x, y
 
 dataset = (tf.contrib.data.TFRecordDataset(file_path)
    .map(parse))
 if perform_shuffle:
  dataset = dataset.shuffle(buffer_size=256)
 dataset = dataset.repeat(repeat_count)
 dataset = dataset.padded_batch(2, padded_shapes=({'x':[6]},[1])) #batch size为2,并且x按maxlen=6来做padding
 iterator = dataset.make_one_shot_iterator()
 batch_features, batch_labels = iterator.get_next()
 return batch_features, batch_labels
 
next_batch = my_input_fn('train.tfrecords', True)
init = tf.initialize_all_variables()
with tf.Session() as sess:
 sess.run(init)
 for i in range(1):
  xs, y =sess.run(next_batch)
  print(xs['x'])
  print(y)

注意变长的数据TFRecords解析要用VarLenFeature,然后用sparse_tensor_to_dense转换。

以上这篇使用tensorflow DataSet实现高效加载变长文本输入就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持脚本之家。

您可能想查找下面的文章:

  • tensorflow模型保存、加载之变量重命名实例
  • tensorflow模型保存、加载之变量重命名实例
  • 使用tensorflow DataSet实现高效加载变长文本输入
  • TensorFlow——Checkpoint为模型添加检查点的实例
  • TensorFlow实现打印每一层的输出
  • tensorflow ckpt模型和pb模型获取节点名称,及ckpt转pb模型实例
  • tensorflow estimator 使用hook实现finetune方式
  • tensorflow查看ckpt各节点名称实例
  • 浅谈tensorflow中Dataset图片的批量读取及维度的操作详解
  • 浅谈Tensorflow 动态双向RNN的输出问题

相关文章

  • python中的__slots__使用示例
  • python中根据字符串调用函数的实现方法
  • Python自定义主从分布式架构实例分析
  • 使用Python对IP进行转换的一些操作技巧小结
  • 使用Python中的greenlet包实现并发编程的入门教程
  • Python translator使用实例
  • Python通过解析网页实现看报程序的方法
  • Python中使用glob和rmtree删除目录子目录及所有文件的例子
  • Scrapy-redis爬虫分布式爬取的分析和实现
  • 使用Python的urllib2模块处理url和图片的技巧两则

文章分类

  • vbs
  • DOS/BAT
  • hta/htc
  • python
  • perl
  • VBA
  • ColdFusion
  • ruby
  • PowerShell
  • Lua
  • Golang
  • linux shell

最近更新的内容

    • itchat和matplotlib的结合使用爬取微信信息的实例
    • Python多进程通信Queue、Pipe、Value、Array实例
    • 关于numpy中np.nonzero()函数用法的详解
    • 布同自制Python函数帮助查询小工具
    • Python聚类算法之基本K均值实例详解
    • 将图片文件嵌入到wxpython代码中的实现方法
    • python多线程操作实例
    • python实现的用于搜索文件并进行内容替换的类实例
    • pycharm安装图文教程
    • Python入门篇之编程习惯与特点

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有