• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > Andrew Ng机器学习课程9-补充,andrew9-

Andrew Ng机器学习课程9-补充,andrew9-

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含Andrew Ng机器学习课程9-补充,andrew9-等服务器相关知识,网友希望可以进行参考

Andrew Ng机器学习课程9-补充,andrew9-


Andrew Ng机器学习课程9-补充


首先要说的还是这个bias-variance trade off,一个hypothesis的generalization error是指的它在样本上的期望误差,这个样本不一定是在training set中的。所以出现了两部分的误差,bias是指的是偏差,未能捕获由数据展示出的结构,underfit,large bias。variance指的是把碰巧出现在训练集数据的pattern给捕获了,但是有限的训练样本并不能反映wider pattern of the relationship between x and y,overfitting,large variance。


PAC(probably approximately correct)理论中几个非常重要的assumptions:assumption of training and testing on the same distribution、assumption of the independently drawn training examples。如果没有这些假设,就无法从理论上证明machine can learn。PAC的含义就是with high probability (the “probably” part), the selected function will have low generalization error (the “approximately correct” part)。


如何选择参数呢?一种方法是最小化训练误差(training error or empirical risk),称之为empirical risk minimization(ERM)。
剩下就是如何在training error和generalization error之间建立连接,能不能给一个upper-bound?
后面通过了hoeffding inquality,得到了这个upper bound,包含三个感兴趣的变量:训练样本数量,训练误差与泛化误差之间设定的距离,以及error的概率,可以通过固定两个变量来bound另一个。可以得到训练样本数量的下限,可以叫做sample complexity。
最后得到一个如下的公式:
e(h^)≤(minh∈He(h))+212mlog2kδ????????√
这是给出了在一个含有k个hypothesis的set H中,学习算法通过empirical risk minimization给出的h^的泛化误差的upper bound,这个upper bound似乎有两个部分,前面的部分说明的是模型的bias,偏差,即如果找到的hypothesis set中hypothesis个数k比较少,则该项也就比较大,而后一项代表的是variance,则比较大,对应为underfitting,总的来讲也会导致generalization error变大;另一方面,如何k越大,对应的前面的项bias就能做的比较好,而后面的项variance则比较大,对应overfitting。可以这样进行理解bias-variance trade-off.


2015-9-11 艺少

版权声明:本文为博主原创文章,未经博主允许不得转载。

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Andrew Ng机器学习课程9-补充,andrew9-

相关文章

  • storm与hadoop的对比,stormhadoop
  • 云主机跟VPS哪个比较好?哪个稳定安全?,主机vps
  • CDH集群中YARN的参数配置,cdh集群yarn参数
  • Spark DataFrame小试牛刀,sparkdataframe小试
  • 孙其功陪你学之——Spark 正则化和SparkSQL,孙其功sparksql
  • hive之实现列转行,hive列转行
  • 云计算: ERP未来必然趋势,erp未来
  • Spark如何读写hive
  • openstack性能测试用例和测试结果,openstack性能测试
  • Spark MLlib Deep Learning Convolution Neural Network (深度学习-卷积神经网络)3.3,mllibconvolution

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • Flume 配置文件概述
    • 【Spark】弹性分布式数据集RDD概述,sparkrdd概述
    • Linux、hive、sqoop常用脚本,hivesqoop
    • 从Zoho CRM推出本地行业解决方案看洋品牌的落地,zohocrm
    • 初试 Coding.net 在线IDE——WebIDE,coding.netwebide
    • [Hive]Hive分区表新增字段,hive分区表新增字段
    • 一步一步跟我学习hadoop(3)----hadoop命令手册,hadoop----hadoop
    • 每日定时导入hive数据仓库的自动化脚本,hive数据仓库脚本
    • 几本京东上的CISCO云计算相关书籍,cisco相关书籍
    • Hbase:namespace异常处理,hbase异常处理

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有