ImageVerifierCode 换一换
格式:PPT , 页数:58 ,大小:9.92MB ,
资源ID:12147804      下载积分:14 金币
快捷注册下载
登录下载
邮箱/手机:
温馨提示:
快捷下载时,用户名和密码都是您填写的邮箱或者手机号,方便查询和重复下载(系统自动生成)。 如填写123,账号就是123,密码也是123。
特别说明:
请自助下载,系统不会自动发送文件的哦; 如果您已付费,想二次下载,请登录后访问:我的下载记录
支付方式: 支付宝    微信支付   
验证码:   换一换

开通VIP
 

温馨提示:由于个人手机设置不同,如果发现不能下载,请复制以下地址【https://www.zixin.com.cn/docdown/12147804.html】到电脑端继续下载(重复下载【60天内】不扣币)。

已注册用户请登录:
账号:
密码:
验证码:   换一换
  忘记密码?
三方登录: 微信登录   QQ登录  

开通VIP折扣优惠下载文档

            查看会员权益                  [ 下载后找不到文档?]

填表反馈(24小时):  下载求助     关注领币    退款申请

开具发票请登录PC端进行申请

   平台协调中心        【在线客服】        免费申请共赢上传

权利声明

1、咨信平台为文档C2C交易模式,即用户上传的文档直接被用户下载,收益归上传人(含作者)所有;本站仅是提供信息存储空间和展示预览,仅对用户上传内容的表现方式做保护处理,对上载内容不做任何修改或编辑。所展示的作品文档包括内容和图片全部来源于网络用户和作者上传投稿,我们不确定上传用户享有完全著作权,根据《信息网络传播权保护条例》,如果侵犯了您的版权、权益或隐私,请联系我们,核实后会尽快下架及时删除,并可随时和客服了解处理情况,尊重保护知识产权我们共同努力。
2、文档的总页数、文档格式和文档大小以系统显示为准(内容中显示的页数不一定正确),网站客服只以系统显示的页数、文件格式、文档大小作为仲裁依据,个别因单元格分列造成显示页码不一将协商解决,平台无法对文档的真实性、完整性、权威性、准确性、专业性及其观点立场做任何保证或承诺,下载前须认真查看,确认无误后再购买,务必慎重购买;若有违法违纪将进行移交司法处理,若涉侵权平台将进行基本处罚并下架。
3、本站所有内容均由用户上传,付费前请自行鉴别,如您付费,意味着您已接受本站规则且自行承担风险,本站不进行额外附加服务,虚拟产品一经售出概不退款(未进行购买下载可退充值款),文档一经付费(服务费)、不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
4、如你看到网页展示的文档有www.zixin.com.cn水印,是因预览和防盗链等技术需要对页面进行转换压缩成图而已,我们并不对上传的文档进行任何编辑或修改,文档下载后都不会有水印标识(原文档上传前个别存留的除外),下载后原文更清晰;试题试卷类文档,如果标题没有明确说明有答案则都视为没有答案,请知晓;PPT和DOC文档可被视为“模板”,允许上传人保留章节、目录结构的情况下删减部份的内容;PDF文档不管是原文档转换或图片扫描而得,本站不作要求视为允许,下载前可先查看【教您几个在下载文档中可以更好的避免被坑】。
5、本文档所展示的图片、画像、字体、音乐的版权可能需版权方额外授权,请谨慎使用;网站提供的党政主题相关内容(国旗、国徽、党徽--等)目的在于配合国家政策宣传,仅限个人学习分享使用,禁止用于任何广告和商用目的。
6、文档遇到问题,请及时联系平台进行协调解决,联系【微信客服】、【QQ客服】,若有其他问题请点击或扫码反馈【服务填表】;文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“【版权申诉】”,意见反馈和侵权处理邮箱:1219186828@qq.com;也可以拔打客服电话:0574-28810668;投诉电话:18658249818。

注意事项

本文(深度学习概述DL-(2).ppt)为本站上传会员【精***】主动上传,咨信网仅是提供信息存储空间和展示预览,仅对用户上传内容的表现方式做保护处理,对上载内容不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知咨信网(发送邮件至1219186828@qq.com、拔打电话4009-655-100或【 微信客服】、【 QQ客服】),核实后会尽快下架及时删除,并可随时和客服了解处理情况,尊重保护知识产权我们共同努力。
温馨提示:如果因为网速或其他原因下载失败请重新下载,重复下载【60天内】不扣币。 服务填表

深度学习概述DL-(2).ppt

1、单击此处编辑母版标题样式,单击此处编辑母版文本样式,第二级,第三级,第四级,第五级,Institute of Computing Technology,Chinese Academy of Sciences,单击此处编辑母版标题样式,单击此处编辑母版文本样式,第二级,第三级,第四级,第五级,*,机器学习的基本任务,Class label,(Classification),Vector,(Estimation),dog,cat,horse,Object recognition,Super resolution,Low-resolution image,High-resolution ima

2、ge,1,源起,生物神经系统的启示,神经元之间通过突触,(synapse),连接,层级感受野,学习使突触连接增强或变弱甚至消失,Hubel,D.H.&Wiesel,T.N.(1962),2,第一代神经网络,Frank Rosenblatt(1957),The Perceptron-a perceiving and recognizing automaton.Report 85-460-1,Cornell Aeronautical Laboratory.,3,Error Backpropagation,W is the parameter of the network;J is the obje

3、ctive function,Feedforward operation,Back error propagation,David E.,Rumelhart,Geoffrey E.,Hinton,and,Ronald,J.Williams.,(Oct.1986).Learning representations by back-propagating errors.,Nature,323,(6088):533536,Output layer,Hidden layers,Input layer,Target values,2,nd,Generation Neural Networks,理论上多层

4、好,两层权重即可逼近任何连续函数映射,遗憾的是,训练困难,It requires labeled training data,Almost all data is unlabeled.,The learning time does not scale well,It is very slow in networks with multiple hidden layers.,It can get stuck in poor local optima,These are often quite good,but for deep nets they are far from optimal.,7,

5、1990-2006,更流行,Specific methods for specific tasks,Hand-crafted features(SIFT,LBP,HOG),ML methods,SVM,Kernel tricks,Boosting,AdaBoost,kNN,Decision tree,Kruger et al.TPAMI13,8,A Breakthrough Back to 2006,2006,年,通过分层的、无监督预训练,终于获得了训练深层网络结构的能力,9,A Breakthrough Back to 2006,Hinton,G.E.,Osindero,S.and Teh,

6、Y.,A fast learning algorithm for,deep belief nets,.Neural Computation 18:1527-1554,2006,Hinton,G.E.and Salakhutdinov,R.R.(2006),Reducing the dimensionality,of data with neural networks.Science,Vol.313.no.5786,pp.504-507,28 July 2006,Yoshua Bengio,Pascal Lamblin,Dan Popovici and Hugo Larochelle,Greed

7、y,Layer-Wise Training of Deep Networks,Advances in Neural Information Processing Systems 19(NIPS 2006),MarcAurelio Ranzato,Christopher Poultney,Sumit Chopra and,Yann LeCun.,Efficient Learning of Sparse Representations,with an Energy-Based Model,Advances in Neural Information Processing Systems(NIPS

8、2006),10,其实是有例外的,CNN,卷积神经网络,CNN,K.,Fukushima,“Neocognitron:A self-organizing neural network model for a mechanism of pattern recognition unaffected by shift in position,”,Biological,Cybernetics,vol.36,pp.193202,1980,Y.LeCun,B.Boser,J.S.Denker,D.Henderson,R.E.Howard,W.Hubbard,and L.D.Jackel,“Backprop

9、agation applied to handwritten zip code recognition,”Neural Computation,vol.1,no.4,pp.541551,1989,Y.Le Cun,L.Bottou,Y.Bengio,and P.Haffner,“Gradient-based learning applied to document recognition,”Proceedings of the IEEE,vol.86,no.11,pp.22782324,1998,11,其实是有例外的,CNN,Neocognitron 1980,K.,Fukushima,“Ne

10、ocognitron:A self-organizing neural network model for a mechanism of pattern recognition unaffected by shift in position,”,Biological,Cybernetics,vol.36,pp.193202,1980,Local Connection,12,例外:,CNN,用于数字识别,13,例外:,CNN,用于目标检测与识别,14,而且,东风同样重要,大数据,大数据,大数据,语音图像视频,计算能力,并行计算平台,GPU,大量部署,开放的社区,开源,开放数据,15,语音识别,(

11、2011),1986,2006,DBN,Science,Speech,2011,BP,16,2012,年计算机视觉的巨大进步,ImageNet,物体分类任务上,物体分类任务:,1000,类,,1,431,167,幅图像,1986,2006,DBN,Science,Speech,2011,2012,Rank,Name,Error rates(TOP5),Description,1,U.Toronto,0.153,Deep learning,2,U.Tokyo,0.261,Hand-crafted,features and learning models.,Bottleneck.,3,U.,Oxf

12、ord,0.270,4,Xerox/INRIA,0.271,BP,17,ImageNet with Deep CNN,方法:大规模,CNN,网络,A.Krizhevsky,L.Sutskever,and G.E.Hinton,“ImageNet Classification with Deep Convolutional Neural Networks,”NIPS,2012.,18,ImageNet with Deep CNN,方法:大规模,CNN,网络,650K,神经元,60M,参数,Trained with BP on GPU,使用了各种技巧,+,dropout,ReLU,Data aug

13、ment,contrast normalization,.,被,Google,收编,(Jan 2013),Google+Photo Tagging(2013.5),A.Krizhevsky,L.Sutskever,and G.E.Hinton,“ImageNet Classification with Deep Convolutional Neural Networks,”NIPS,2012.,19,ImageNet,物体分类,(2013),1000,类,,1,431,167,幅图像,,Top 5,错误率,1986,2006,DBN,Science,Speech,2011,2012,Rank,

14、Name,Error rates(TOP5),Description,1,NYU,0.11197,Deep learning,2,NUS,0.12535,Deep learning,3,Oxford,0.13555,Deep learning,2013,BP,20,MIT Tech Review,坐不住了,21,ImageNet,物体分类,(2014),1000,类,,1,431,167,幅图像,,Top 5,错误率,1986,2006,DBN,Science,Speech,2011,2012,Rank,Name,Error rates(TOP5),Description,1,Google,0

15、06656,Deep learning,2,Oxford,0.07325,Deep learning,3,MSRA,0.08062,Deep learning,2013,2014,BP,22,ImageNet,物体分类,(2014),GoogLeNet CVPR2015,22,个卷积层,Szegedy C,Liu W,Jia Y,et al.Going deeper with convolutions.CVPR 2015,1986,2006,DBN,Science,Speech,2011,2012,BP,2014,2013,23,ImageNet,物体分类,(2010-2014),Image

16、Net Top 5 Error Rate,上的持续进步,1986,2006,DBN,Science,Speech,2011,2012,BP,2014,2013,24,ImageNet,物体检测任务,200,类,,456,567,幅图像,检测率,传统方法,SIFT+BOW+SPM,深度方法,R-CNN+GoogLeNet,1986,2006,DBN,Science,Speech,2011,2012,BP,2014,2013,25,物体分割,/,语义标注进步迅速,Jonathan Long,Evan Shelhamer,Trevor Darrell.,Fully Convolutional Net

17、works for Semantic Segmentation.CVPR2015,26,DL,有多热,Deep Learning for Vision,602,篇文章中,仅标题中出现,Deep,的就有,87,篇,出现,Convolution,的,47,篇,出现,Neural,的,40,篇,出现,Network,的,51,篇,,Recurrent,7,篇,Going deeper,,优化,无监督、自主学习,Fully Convolutional Network,(,for segmentation,等),Vision and Language(for,看图说话,Google,Fei-fei,Mi

18、crosoft,UCB),RNN with LSTM,(,for,时序处理),Deep Learning for X(detection,metric learning,attribute,hash,),27,计算机视觉的重大进步,Vision and Language(Google,Microsoft,UCB),看图说话:,Minsky 60,年前布置的作业,Show and Tell:A Neural Image Caption Generator(a work from Google),From Captions to Visual Concepts and Back(a work fr

19、om Microsoft),Long-term Recurrent Convolutional Networks for Visual Recognition and Description(a work from UTA/UML/UCB),28,人脸识别上的进步,正确率,95.17,%,D.Chen,X.Cao,F.Wen,J.Sun,CVPR13,正确率,97.35%,Y.Taigman,M.Yang,M.Ranzato,L.Wolf,CVPR14,正确率,99.47%,Y.Sun,X.Wang,and X.Tang,CVPR14,正确率,99.63,%,F.Schroff,D.Kalen

20、ichenko,and J.Philbin,CVPR15,1986,2006,DBN,Science,Speech,2011,2012,Face,2014,2015,BP,在,LFW,上,过去,2,年错误率从,5%,下降到,0.5%,(,错,300,对,错,30,对,),29,人脸识别上的进步,Labeled Face in the Wild(LFW),非限定条件下的人脸识别,数据来源于因特网,国外名人,,Yahoo,新闻,广为人知的测试模式,训练集:,无限制,验证任务测试集,共,6000,图像对,Huang G B,Ramesh M,Berg T,et al.Labeled faces in

21、 the wild:A database for studying face recognition in unconstrained environments.Technical Report,University of Massachusetts,Amherst,2007.,30,人脸识别上的进步,2014:DeepFace 1(Facebook),大数据:,4K,人,,4.4M,图像,1 Taigman Y,Yang M,Ranzato M A,et al.Deepface:Closing the gap to human-level performance in face verifi

22、cation.CVPR,2014.,2 Sun Y,Wang X,Tang X.Deeply learned face representations are sparse,selective,and robust.arXiv preprint,2014.,31,人脸识别上的进步,香港中文大学,DeepID2+,在,25,个人脸,Patch,上分别训练,CNN,(,4,个卷积层,,4,个全连接层,,4,个,verification,损失信号和,1,个,identification,损失信号),训练数据:,10K,人,,202K,名人图像,Y.Sun,X.Wang,and X.Tang,CVPR

23、14,人脸识别上的进步,Google,最新的,FaceNet,深层网络(,22,层),+,海量数据,(800,万人,,2,亿张图像),+Triplet Loss(,不需要额外占用显存,),F.Schroff,D.Kalenichenko,and J.Philbin,CVPR15,提纲,深度学习,(DL),及其应用前沿,DL,在,CV,领域应用的启示,关键算法介绍,BP,算法,Auto-Encoder,CNN,CNN,主要变种,关于,DL,的思考与讨论,34,DL,之前的视觉处理方法,分步处理背后的哲学,分而治之,Divide and Conquer,Knowledge-driven,Hand-

24、crafted feature,I think it should be solved by methods like,35,DL,及其之后的视觉处理方法,36,DL,及其之后的视觉处理方法,学习到接近期望的底层、中层和高层特征,37,DL,之前的视觉处理方法,任务,人工设计,F,(部分学习,F,),领域知识:分步处理,滤波器,局部特征,(SIFT),,,BoW,,直方图,,Max/Sum,汇聚,,判别分析,,Kernel,技巧,分段线性,流形学习,测度学习,类标签,(,分类问题,),向量,(,回归,/,估计,),预处理,特征设计,特征降维,分类,/,回归,38,DL,时代的视觉处理方法,任务

25、人工设计,F,(部分学习,F,),End-to-end,地学习,F,(全步骤学习),Representation learning,Feature learning,Nonlinear transform learning,离散类标签,(,分类问题,),连续向量,(,回归,/,估计,),Credit to Dr.Xiaogang Wang,39,DL,时代的视觉处理方法,Collect data,Preprocessing 1,Feature design,Classifier,Evaluation,Preprocessing 2,Collect data,Feature transform

26、Feature transform,Classifier,Deep neural network,Evaluation,vs.,Credit to Dr.Xiaogang Wang,40,DL,时代的视觉处理方法,方法论上的变化,从分治,协同(,joint,),多步骤,end-to-end learning,更广义的,检测与识别,分割与识别,41,提纲,深度学习,(DL),及其应用前沿,DL,在,CV,领域应用的启示,关键算法介绍,Perceptron,算法,BP,算法,Auto-Encoder,CNN,及其主要变种,关于,DL,的思考与讨论,42,Perceptron,Frank Rose

27、nblatt(1957),The Perceptron-a perceiving and recognizing automaton.Report 85-460-1,Cornell Aeronautical Laboratory.,43,Perceptron,算法,F.Rosenblatt.The perceptron:A probabilistic model for informationstorage and organization in the brain.,Psychological Review,65:386-408,1958,44,Perceptron,算法,45,前馈神经网络

28、的,BP,学习算法,David E.,Rumelhart,Geoffrey E.,Hinton,and Ronald J.,Williams,.(Oct.1986).Learning representations by back-propagating errors.,Nature,323,(6088):533536,(单独,slides,),卷积神经网络及其变种,(单独,slides,),47,提纲,深度学习,(DL),及其应用前沿,DL,在,CV,领域应用的启示,关键算法介绍,Perceptron,及学习算法,MLP,及其,BP,算法,Auto-Encoder,CNN,及其主要变种,关于

29、DL,的思考与讨论,48,关于,DL,的更多讨论,DL,带来观念的变革,DL,是类脑信息处理方法吗?,DL,有理论吗?,DL,不能做什么?,数据驱动的学习不再需要领域知识?,工业界抢了学术界的饭碗?,CV,研究者沦为,ML,研究者的实验员?,DL,未来工作?,49,DL,带来观念的变革,人工领域知识驱动,数据驱动的学习思想,小数据,控制模型复杂度避免过拟合,大数据,提高模型复杂度避免欠拟合,“大数据,+,简单模型”是错误的!,维数灾难,(,降维,),高维有益,(,升维,),分步、分治思想,协同学习,(joint learning),思想,End-to-end,的全过程学习,软硬件更优的协同,

30、50,DL,是类脑信息处理方法吗?,DL,受到脑信息处理方式启发,分层逐级抽象,初级视觉神经元的“类,Gabor,小波编码”,并不“类脑”,本质上,脑的计算“机制”尚不清晰,脑的连接更多样、更复杂,Top-down,,反馈机制,学习过程未必需要大量数据,先天,生物进化的结果(大数据长期训练),后天学习,更多演绎推理,迁移学习,51,DL,有理论吗?,DL,理论匮乏,收敛性,,bound,局部极值,初值很重要,复杂度理论,但不完全是,black box,与传统“分步”做法的关系,比,Kernel,更“显式”,层级可视化提供了很多线索,逐层抽象,or,分层“非线性”?,52,DL,不能做什么?,用

31、做“特征学习”或“非线性变换”最成功,学到的特征具有良好的通用性,传统分类器或回归似乎还可用,非常倚重大数据,小数据深度学习不可靠,需要引入领域知识,深度模型的迁移学习,难以演绎推理,DL,是归纳学习,难以举一反三,更难无师自通,在一些简单问题上未必需要深度学习,人脸识别的例子,目前的,DL,不学习“自身结构”,调试经验很重要,53,数据驱动的学习不需要领域知识?,大数据驱动确实减少了对领域知识的依赖,CNN,在,CV,领域的成功,本身就说明了领域知识的重要性,卷积操作,,Pooling,操作,小数据条件下,领域知识尤其重要,Data is king,and DL is queen?,54,工

32、业界抢了学术界的饭碗?,工业界看不起学术界?,工业界重视大数据收集和并行实现,学术界重视理论和新的模型,CV,学术界应该更,smart,更前瞻,新的模型设计,网络结构学习,优化方法,训练加速,更,Smart,的数据收集,大而脏乱差数据的高效利用,55,CV,研究者沦为,ML,研究者的实验员?,有这个危险,CV,本身缺少理论体系,“分步”法主宰,CV,太多年,CV,仍有机会,实际上,ML,也从,CV,获益良多,基于学习的,CV,理论?,CV,研究者应该与,ML,有更多互动,“几何”和“结构”的可学习性?,56,DL,领域的未来工作,DL,理论,网络结构本身的学习,小数据条件下的,DL,领域知识的嵌入,带反馈的深度网络,大而脏乱差数据条件下的,DL,深度模型的迁移与适应,面向视频分析的,DL,模型,“非线性”的更多来源,新的优化和训练算法,57,总结和警告!,神经网络兴衰史的教训,是复兴不是创新,历史经常重演,相比,CV,等应用领域对,DL,的狂热,,ML,领域很冷静,他强由他强,清风拂山冈;,他横由他横,明月照大江。,建议,要会,DL,,但不要只会,DL,经验知识驱动,数据驱动,混合驱动,58,

移动网页_全站_页脚广告1

关于我们      便捷服务       自信AI       AI导航        抽奖活动

©2010-2026 宁波自信网络信息技术有限公司  版权所有

客服电话:0574-28810668  投诉电话:18658249818

gongan.png浙公网安备33021202000488号   

icp.png浙ICP备2021020529号-1  |  浙B2-20240490  

关注我们 :微信公众号    抖音    微博    LOFTER 

客服