财讯中国

干货:深度学习 vs 机器学习 vs 模式识别三种技术对比

来源:网络 2022-01-20 15:00:04

【编者按】本文来自CMU的博士,MIT的博士后,vision.ai的联合创始人Tomasz Malisiewicz的个人博客文章,阅读本文,你可以更好的理解计算机视觉是怎么一回事,同时对机器学习是如何随着时间缓慢发展的也有个直观的认识。

以下为正文:

本文我们来关注下三个非常相关的概念(深度学习机器学习和模式识别),以及他们与2015年最热门的科技主题(机器人和人工智能)的联系。

图1 人工智能并非将人放入一台计算机中(图片来源于 WorkFusion 的博客)

环绕四周,你会发现不缺乏一些初创的高科技公司招聘机器学习专家的岗位。而其中只有一小部分需要深度学习专家。我敢打赌,大多数初创公司都可以从最基本的数据分析中获益。那如何才能发现未来的数据科学家?你需要学习他们的思考方式。

三个与“学习”高度相关的流行词汇

模式识别(Pattern recogniTIon)、机器学习(machine learning)和深度学习(deep learning)代表三种不同的思想流派。模式识别是最古老的(作为一个术语而言,可以说是很过时的)。机器学习是最基础的(当下初创公司和研究实验室的热点领域之一)。而深度学习是非常崭新和有影响力的前沿领域,我们甚至不会去思考后深度学习时代。我们可以看下图所示的谷歌趋势图。可以看到:

1)机器学习就像是一个真正的冠军一样持续昂首而上;

2)模式识别一开始主要是作为机器学习的代名词;

3)模式识别正在慢慢没落和消亡;

4)深度学习是个崭新的和快速攀升的领域。

2004年至今三个概念的谷歌搜索指数(图来源于 谷歌趋势 )

1. 模式识别:智能程序的诞生

模式识别是70年代和80年代非常流行的一个术语。它强调的是如何让一个计算机程序去做一些看起来很“智能”的事情,例如识别“3”这个数字。而且在融入了很多的智慧和直觉后,人们也的确构建了这样的一个程序。例如,区分“3”和“B”或者“3”和“8”。早在以前,大家也不会去关心你是怎么实现的,只要这个机器不是由人躲在盒子里面伪装的就好(图2)。不过,如果你的算法对图像应用了一些像滤波器、边缘检测和形态学处理等等高大上的技术后,模式识别社区肯定就会对它感兴趣。光学字符识别就是从这个社区诞生的。因此,把模式识别称为70年代,80年代和90年代初的“智能”信号处理是合适的。决策树、启发式和二次判别分析等全部诞生于这个时代。而且,在这个时代,模式识别也成为了计算机科学领域的小伙伴搞的东西,而不是电子工程。从这个时代诞生的模式识别领域最著名的书之一是由Duda Hart执笔的“模式识别(Pattern ClassificaTIon)”。对基础的研究者来说,仍然是一本不错的入门教材。不过对于里面的一些词汇就不要太纠结了,因为这本书已经有一定的年代了,词汇会有点过时。

图2 一个字符“3”的图像被划分为16个子块。

自定义规则、自定义决策,以及自定义“智能”程序在这个任务上,曾经都风靡一时(更多信息,可以查看这个 OCR 网页)

小测试:计算机视觉领域最著名的会议叫CVPR,这个PR就是模式识别。你能猜出第一届CVPR会议是哪年召开的吗?

2. 机器学习:从样本中学习的智能程序

在90年代初,人们开始意识到一种可以更有效地构建模式识别算法的方法,那就是用数据(可以通过廉价劳动力采集获得)去替换专家(具有很多图像方面知识的人)。因此,我们搜集大量的人脸和非人脸图像,再选择一个算法,然后冲着咖啡、晒着太阳,等着计算机完成对这些图像的学习。这就是机器学习的思想。“机器学习”强调的是,在给计算机程序(或者机器)输入一些数据后,它必须做一些事情,那就是学习这些数据,而这个学习的步骤是明确的。相信我,就算计算机完成学习要耗上一天的时间,也会比你邀请你的研究伙伴来到你家然后专门手工得为这个任务设计一些分类规则要好。

图3 典型的机器学习流程(图来源于 Natalia KonstanTInova 博士的博客)。

在21世纪中期,机器学习成为了计算机科学领域一个重要的研究课题,计算机科学家们开始将这些想法应用到更大范围的问题上,不再限于识别字符、识别猫和狗或者识别图像中的某个目标等等这些问题。研究人员开始将机器学习应用到机器人(强化学习,操控,行动规划,抓取)、基因数据的分析和金融市场的预测中。另外,机器学习与图论的联姻也成就了一个新的课题---图模型。每一个机器人专家都“无奈地”成为了机器学习专家,同时,机器学习也迅速成为了众人渴望的必备技能之一。然而,“机器学习”这个概念对底层算法只字未提。我们已经看到凸优化、核方法、支持向量机和BoosTIng算法等都有各自辉煌的时期。再加上一些人工设计的特征,那在机器学习领域,我们就有了很多的方法,很多不同的思想流派,然而,对于一个新人来说,对特征和算法的选择依然一头雾水,没有清晰的指导原则。但,值得庆幸的是,这一切即将改变……

延伸阅读:要了解更多关于计算机视觉特征的知识,可以看看原作者之前的博客文章:“ 从特征描述子到深度学习:计算机视觉的20年 ”。

3. 深度学习:一统江湖的架构

快进到今天,我们看到的是一个夺人眼球的技术---深度学习。而在深度学习的模型中,受宠爱最多的就是被用在大规模图像识别任务中的卷积神经网络(Convolutional Neural Nets,CNN),简称ConvNets。

图4 ConvNet框架(图来源于 Torch的教程)

深度学习强调的是你使用的模型(例如深度卷积多层神经网络),模型中的参数通过从数据中学习获得。然而,深度学习也带来了一些其他需要考虑的问题。因为你面对的是一个高维的模型(即庞大的网络),所以你需要大量的数据(大数据)和强大的运算能力(图形处理器,GPU)才能优化这个模型。卷积被广泛用于深度学习(尤其是计算机视觉应用中),而且它的架构往往都是非浅层的。

如果你要学习Deep Learning,那就得先复习下一些线性代数的基本知识,当然了,也得有编程基础。我强烈推荐Andrej Karpathy的博文:“ 神经网络的黑客指南 ”。另外,作为学习的开端,可以选择一个不用卷积操作的应用问题,然后自己实现基于CPU的反向传播算法。

对于深度学习,还存在很多没有解决的问题。既没有完整的关于深度学习有效性的理论,也没有任何一本能超越机器学习实战经验的指南或者书。另外,深度学习不是万能的,它有足够的理由能日益流行,但始终无法接管整个世界。不过,只要你不断增加你的机器学习技能,你的饭碗无忧。但也不要对深度框架过于崇拜,不要害怕对这些框架进行裁剪和调整,以得到和你的学习算法能协同工作的软件框架。未来的Linux内核也许会在Caffe(一个非常流行的深度学习框架)上运行,然而,伟大的产品总是需要伟大的愿景、领域的专业知识、市场的开发,和最重要的:人类的创造力。

其他相关术语

1)大数据(Big-data):大数据是个丰富的概念,例如包含大量数据的存储,数据中隐含信息的挖掘等。对企业经营来说,大数据往往可以给出一些决策的建议。对机器学习算法而言,它与大数据的结合在早几年已经出现。研究人员甚至任何一个日常开发人员都可以接触到云计算、GPU、DevOps和PaaS等等这些服务。

2)人工智能(Artificial Intelligence):人工智能应该是一个最老的术语了,同时也是最含糊的。它在过去50年里经历了几度兴衰。当你遇到一个说自己是做人工智能的人,你可以有两种选择:要么摆个嘲笑的表情,要么抽出一张纸,记录下他所说的一切。

延伸阅读:原作者2011的博客:“ 计算机视觉当属人工智能 ”。

结论

关于机器学习的讨论在此停留(不要单纯的认为它是深度学习、机器学习或者模式识别中的一个,这三者只是强调的东西有所不同),然而,研究会继续,探索会继续。我们会继续构建更智能的软件,我们的算法也将继续学习,但我们只会开始探索那些能真正一统江湖的框架。

如果你也对深度学习的实时视觉应用感兴趣,特别是那些适合机器人和家居智能化的应用,欢迎来我们的网站 vision.ai 交流。希望未来,我能说的再多一点……

作者简介:Tomasz Malisiewicz,CMU的博士,MIT的博士后,vision.ai的联合创始人。关注计算机视觉,在这个领域也做了大量的工作。另外,他的博客也富含信息量和价值,感兴趣的可以浏览他个人主页和博客。

关键词: 深度学习 机器学习 人工智能

相关新闻

干货:深度学习 vs 机器学习 vs 模式识别三种技术对比
2022-01-20 15:00:04
1480元起 Ultrasone 极致推出三款耳机
2022-01-20 13:38:46
抖音PC版正式发布 用电脑刷视频更方便了
2022-01-20 13:38:39
搭载骁龙 8 Gen 1!红魔 7游戏手机将于2月发布
2022-01-20 13:38:33
老是记不住别人的名字?好记性需要的可能只是好好睡一觉
2022-01-20 13:38:27
惠普发布新款二合一平板 11寸2.1K仅需4799元
2022-01-20 13:38:18
扎克伯格三“抄”TikTok
2022-01-20 13:38:15
首发4799元 惠普宣布星 11 x2二合一平板电脑全新上市
2022-01-20 13:38:03
TikTok营销主管被开除:因策划进军餐饮等虚假营销
2022-01-20 13:38:01
wap业务是什么
2022-01-20 13:30:37
超简单RS232转RS485电路
2022-01-20 13:30:28
PA是什么
2022-01-20 13:30:19
通用串行总线控制器(USB控制器)
2022-01-20 13:30:10
值得收藏的常见电压比较器电路
2022-01-20 13:30:01
伽玛刀进藏! 西部大棋局又拱一卒
2022-01-20 13:22:04
网友编写了个代码 就能上班摸鱼年薪还超过570000元
2022-01-20 12:12:11
120Hz居中单打孔屏 小米Redmi新品规格曝光
2022-01-20 12:12:00
毁童年之作:饭制宝可梦可以打皮卡丘!
2022-01-20 12:11:49
中兴手机官宣2022年代言人:吴京
2022-01-20 12:11:38
微软收购暴雪失败的违约金超过19100000000元!
2022-01-20 12:11:26
在Win11上畅玩安卓游戏!谷歌商店PC版开服
2022-01-20 12:11:15
699元!影驰B660主板今日正式开售:更实惠的优质选择
2022-01-20 12:11:04
传美光将在德克萨斯州奥斯汀新建晶圆厂
2022-01-20 12:10:56
新iPhone SE屏幕量产,但我劝你别等
2022-01-20 12:10:52
[视频]耗时2年 大神DIY《星际迷航》中的三录仪
2022-01-20 12:10:45
玻璃盖板被取消 iPad Pro 2022实机图曝光
2022-01-20 12:10:40
微软改进Voice Access功能:可语音交互使用触控键盘
2022-01-20 12:10:35
首销到手4399元 realme Book 增强版 Air明日零点开售
2022-01-20 12:10:28
Verizon分享首批C波段5G超宽带网络测速截图 成绩喜人
2022-01-20 12:10:24
不做手机和元宇宙!罗永浩称年后回归科技界
2022-01-20 12:10:17
PowerToys新特性:可帮用户快速锁定鼠标位置
2022-01-20 12:10:14
Safari曝重大漏洞 用户隐私可能泄露
2022-01-20 12:10:05
携手Curve:华为在欧洲推出基于手机NFC的非接触店内支付服务
2022-01-20 12:10:03
中国科学技术大学成为ASC22世界超算大赛东道主
2022-01-20 12:09:54
Google正组建区块链小组 由搜索广告业务老将带队
2022-01-20 12:09:53
1300万一针 “史上最贵药”将落地中国
2022-01-20 12:09:41
只需49元 魅蓝正式发布66W快充线
2022-01-20 12:09:41
“宁王”最大对手引爆韩国资本市场 LG新能源IPO获创纪录需求
2022-01-20 12:09:30
联发科发布Wi-Fi 7技术 预计2023年正式搭载
2022-01-20 12:09:29
贝尔金开售Boost Charge Pro:支持15W MagSafe充电 售60美元
2022-01-20 12:09:19
2021居民收入榜出炉:快来看看有没有拖后腿
2022-01-20 12:09:17
半年狂赚300亿 打疫苗送房?科兴生物回应进军房地产
2022-01-20 12:09:07
不到3000元 苹果最便宜新机最快4月上市
2022-01-20 12:09:02
溢价近20倍!隐藏款盲盒为何那么贵?有商家私藏隐藏款哄抬价格
2022-01-20 12:08:55
红魔布局元宇宙,红魔7游戏手机2月发布
2022-01-20 12:08:48
如何跳出“知网怪圈”?
2022-01-20 12:08:43
摊上事儿了 微软687亿美元收购动视暴雪或面临反垄断调查
2022-01-20 12:08:35
马斯克再次警告人口崩溃:我要做个好榜样
2022-01-20 12:08:31
小米推儿童智能马桶:599元宝妈必看
2022-01-20 12:08:20
市值仅次于苹果 微软收购动视暴雪为何未遭反垄断讨伐?
2022-01-20 12:08:17
工信部:2021年累计建成开通5G基站142.5万个
2022-01-20 12:08:05
又要翻拍?网曝《还珠格格》3.0组讯图
2022-01-20 12:08:02
Windows Mobile 5中的新特性
2022-01-20 12:00:20
罗永浩“凭什么”还清四个亿?
2022-01-20 12:00:11
英特尔光纤接口Light Peak 创意来自苹果
2022-01-20 12:00:01
医疗版块遭遇黑天鹅,进入调整期
医疗版块遭遇黑天鹅,进入调整期
2022-01-20 11:23:22
BMJ:在对新冠疫苗调查的“事实核查”出错后 FB未能采取行动
2022-01-20 10:41:27
Cynerio报告:医院中一半的联网设备容易受到黑客攻击
2022-01-20 10:41:18
AT&T开始5G C-band部署 初期仅限8个美国城市
2022-01-20 10:41:07
苹果公司削减了一批Android手机的以旧换新冲抵价格
2022-01-20 10:40:58
美国苹果商店教育优惠现需通过UNiDAYS验证
2022-01-20 10:40:48
英国首相约翰逊宣布将取消大部分防疫限制措施
2022-01-20 10:40:38
RX 6500 XT显卡4GB显存惹争议 被AMD删除的文章又回来了
2022-01-20 10:40:28
九部门联合发文 推动平台经济规范健康持续发展
2022-01-20 10:40:18
折叠屏5079元?荣耀Magic V维修价曝光
2022-01-20 10:40:07
[组图]北极熊占领了废弃岛屿并搬进了空房子里
2022-01-20 10:40:07
美国FTC主席:面对脸书、亚马逊等科技巨头恐吓 反垄断绝不退缩
2022-01-20 10:39:56
一眼看出外挂?战地2042更新全体计分板
2022-01-20 10:39:54
放弃进军金融服务业 谷歌聘请PayPal资深高管负责支付业务
2022-01-20 10:39:44
新一代爆款神机!新版Redmi Note 11 Pro曝光 配备处理器绝了
2022-01-20 10:39:41
领克01被曝疑似虚假宣传 官方回应称车身结构示意无统一规范
2022-01-20 10:39:33
罗永浩将回归科技界,强调不学扎克伯格
2022-01-20 10:39:29
研究称30%流通中比特币的买家现在正在赔钱
2022-01-20 10:39:21
碰瓷iPad mini?联想拯救者Y700高刷支持
2022-01-20 10:39:15
伊利诺伊州新法将要求苹果谷歌允许开发者使用其他支付系统
2022-01-20 10:39:08
定档2月下旬 OPPO新品发布会日期曝光
2022-01-20 10:39:01
红十字国际委员会遭受网络攻击 超51.5万名“高危人群”的数据遭泄露
2022-01-20 10:38:55
微信官方揭秘:要买的微信红包封面都是骗局
2022-01-20 10:38:47
微软CEO:改革动视暴雪工作文化将是一项重要的工作
2022-01-20 10:38:42
搭载10nm赛扬处理器 英特尔发布NUC 11 Essential迷你主机
2022-01-20 10:38:32
通用汽车EV电解决方案:在电网不足的地方使用氢气
2022-01-20 10:38:29
【手慢无】联想拯救者主机即将促销 11600KF+30T0Ti仅售7989元
2022-01-20 10:38:17
2021居民收入榜出炉:北京上海人均可支配收入超7万
2022-01-20 10:38:16
包括4G和5G版 Redmi Note 11系列将在海外登场
2022-01-20 10:38:02
[图]Windows 11设置应用即将可以管理微软和Office账号了
2022-01-20 10:38:01
振荡器自生振荡分析之反馈理论与barkhausen准则
2022-01-20 10:30:37
LCD1602.h头文件下载(完美液晶驱动文件)
2022-01-20 10:30:28
GPS-GPRS定位定向导航系统
2022-01-20 10:30:18
编码器的作用
2022-01-20 10:30:09
什么是MMDS系统
2022-01-20 10:30:00
美国5G部署为航空让步 美国闹停飞监管要担责
2022-01-20 09:10:49
俄罗斯搜索巨头Yandex和解反垄断诉讼
2022-01-20 09:10:40
Facebook批评人士呼吁该公司公布印度人权评估报告
2022-01-20 09:10:32
苹果公司未来可能停止iOS 14安全更新 以促使更多人升级iOS 15
2022-01-20 09:10:23
巴菲特旗下伯克希尔拟39亿美元投资可再生能源项目
2022-01-20 09:10:15
港交所上了第一家SPAC“空壳公司”
2022-01-20 09:10:07
战投部解散 复盘字节跳动7年出手200次的“投资版图”
2022-01-20 09:09:58
网友吐槽手机行业没进步 罗永浩回应称其年后回归科技业界
2022-01-20 09:09:50
美国一军嫂用AirTags追踪黑心搬家公司
2022-01-20 09:09:41
微软正用Fluent Design升级任务管理器 新版截图已曝光
2022-01-20 09:09:32

热门文章

热点专题