• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > 大师Geoff Hinton关于Deep Neural Networks的建议,geoffhinton

大师Geoff Hinton关于Deep Neural Networks的建议,geoffhinton

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含geoff hinton,geoff,geoff dougmore,geoff fitzpatrick,geoff zanelli等服务器相关知识,网友希望可以进行参考

大师Geoff Hinton关于Deep Neural Networks的建议,geoffhinton


大师Geoff Hinton关于Deep Neural Networks的建议


Note: This covers suggestions from Geoff Hinton’s talk given at UBC which was recorded May 30, 2013. It does not cover bleeding edge techniques.

主要分为如下几点展开:


  • Have a Deep Network.
    1-2个hidden layers被认为是一个shallow network,浅浅的神经网络,当hidden layers数量多时,会造成local optima,缺乏数据等。
    因为deep neural network相比shallow neural network,最大的区别就是greater representational power,这个能力随着layer的增加而增加。

PS:理论上,只有一个单层hidden layer但是有很多unit的神经网络(large breadth,宽度,not deep),具有与deeper network相似的representational power,但是目前还不知道有哪种方法来训练这样的network。


  • Pretrain if you do not have a lot of unlabelled training data. If you do skip it.
    pre-training 又叫做greedy layer-wise training,如果没有足够的标签样本就需要执行greedy layer-wise pretraining,如果有足够多的样本,只需执行正常的full network stack 的训练即可。
    pre-training可以让parameters能够站在一个较好的初始值上,当你有足够的无标签样本时,这一点就无意义了。

Side Note: An interesting paper shows that unsupervised pretraining encourages sparseness in DNN. Link is here.


  • Initialize the weight to sensible values.
    可以将权重设置为小的随机数,这些小随机数权重的分布取决于在network中使用的nonlinearity,如果使用的是rectified linear units,可以设置为小的正数。

  • Use rectified linear units.
    可以参看我的博文《修正线性单元(Rectified linear unit,ReLU)》

It makes calculating the gradient during back propagation trivial. It is 0 if x < 0 and 1 elsewhere. This speeds up the training of the network.
此处输入图片的描述
ReLU units are more biologically plausible then the other activation functions, since they model the biological neuron’s responses in their area of operation. While sigmoid and tanh activation functions are biologically implausible. A sigmoid has a steady state of around 12 and after initlizing with small weights fire at half their saturation potential.


  • Have many more parameters than training examples.
    确保整个参数的数量(a single weight in your network counts as one parameter)超过训练样本的数量一大截,总是使得neural network overfit,然后强力的regularize它,比如,一个例子是有1000个训练样本,须有1百万个参数。

这样做的理由是模仿大脑的机制,突触的数量要比经验多得多,在一次活动中,只不过大部分都没有激活。


  • Use dropout to regularize it instead of L1 and L2 regularization.
    dropout是一项用来在一个隐含层中丢掉或者遗漏某些隐含单元的技术,每当训练样本被送入network时就发生。随机从隐含层中进行子采样。一种不同的架构是all sharing weights。

这是一种模型平均或者近似的形式,是一种很强的regularization方法,不像常用的L1或者L2 regularization将参数拉至0,subsample或者sharing weights使参数拉至合理的值。比较neat。


  • Convolutional Frontend (optional)
    如果数据包含任何空间结构信息,比如voice,images,video等,可以使用卷积前段。
    可以参看我的博文《卷积神经网络(CNN)》

卷积可以看作诗一个滤波器,算子等,可以从原始的pixel等中抽取边缘等特征,或者表示与卷积核的相似度等等。采用卷积可以对空间信息进行编码。

参考文献:
http://343hz.com/general-guidelines-for-deep-neural-networks/


2015-9-11 艺少

版权声明:本文为博主原创文章,未经博主允许不得转载。

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • 大师Geoff Hinton关于Deep Neural Networks的建议,geoffhinton

相关文章

  • Hadoop之——数据类型,hadoop数据类型
  • OpenStack Kilo新特性解读和分析(1),openstackkilo
  • NOSQL(六)集群并发计算模型Map-Reduce,nosqlmap-reduce
  • elasticsearch JAVA客户端操作---搜索的过滤、分组高亮,elasticsearchjava
  • 现代数学的引路人,现代数学引路人
  • 2015.6.8,2015年6月8日
  • CDH集群集成kafka,cdh集群kafka
  • 2015年中国的云计算标准有哪些?,2015年中国标准
  • 企业的云之旅程,企业云之旅程
  • 机器学习数学基础- gradient descent算法(下),gradientdescent

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • Java MapReduce详解--(3),mapreduce详解
    • MapReduce编程之实现多表关联,mapreduce编程关联
    • Zookeeper实践之:通过Zookeeper实现一个消费者进程分配程序,zookeeper消费者
    • 2015年中国的云计算标准有哪些?,2015年中国标准
    • JS查看Object对象的内容,jsobject对象
    • Hadoop之——HDFS随笔,hadoophdfs
    • redis主从同步,redis主从
    • hive join详解,hivejoin
    • [Sqoop]利用sqoop对mysql执行DML操作,sqoopdml
    • MapReduce小文件处理之CombineFileInputFormat实现,mapreducecombine

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有