『云计算』终于有人把云计算、大数据和人工智能讲明白了( 七 )
很多人说双十一我都想断网了 , 我老婆在上面不断地买买买 , 买了A又推荐B , 老婆大人说 , “哎呀 , B也是我喜欢的啊 , 老公我要买” 。 你说这个程序怎么这么牛 , 这么有智慧 , 比我还了解我老婆 , 这件事情是怎么做到的呢?
本文插图
2数据如何升华为智慧
数据的处理分几个步骤 , 完成了才最后会有智慧 。
第一个步骤叫数据的收集 。 首先得有数据 , 数据的收集有两个方式:
- 第一个方式是拿 , 专业点的说法叫抓取或者爬取 。 例如搜索引擎就是这么做的:它把网上的所有的信息都下载到它的数据中心 , 然后你一搜才能搜出来 。 比如你去搜索的时候 , 结果会是一个列表 , 这个列表为什么会在搜索引擎的公司里面?就是因为他把数据都拿下来了 , 但是你一点链接 , 点出来这个网站就不在搜索引擎它们公司了 。 比如说新浪有个新闻 , 你拿百度搜出来 , 你不点的时候 , 那一页在百度数据中心 , 一点出来的网页就是在新浪的数据中心了 。
- 第二个方式是推送 , 有很多终端可以帮我收集数据 。 比如说小米手环 , 可以将你每天跑步的数据 , 心跳的数据 , 睡眠的数据都上传到数据中心里面 。
第三个步骤是数据的存储 。 现在数据就是金钱 , 掌握了数据就相当于掌握了钱 。 要不然网站怎么知道你想买什么?就是因为它有你历史的交易的数据 , 这个信息可不能给别人 , 十分宝贵 , 所以需要存储下来 。
第四个步骤是数据的处理和分析 。 上面存储的数据是原始数据 , 原始数据多是杂乱无章的 , 有很多垃圾数据在里面 , 因而需要清洗和过滤 , 得到一些高质量的数据 。 对于高质量的数据 , 就可以进行分析 , 从而对数据进行分类 , 或者发现数据之间的相互关系 , 得到知识 。
比如盛传的沃尔玛超市的啤酒和尿布的故事 , 就是通过对人们的购买数据进行分析 , 发现了男人一般买尿布的时候 , 会同时购买啤酒 , 这样就发现了啤酒和尿布之间的相互关系 , 获得知识 , 然后应用到实践中 , 将啤酒和尿布的柜台弄的很近 , 就获得了智慧 。
第五个步骤是对于数据的检索和挖掘 。 检索就是搜索 , 所谓外事不决问Google , 内事不决问百度 。 内外两大搜索引擎都是将分析后的数据放入搜索引擎 , 因此人们想寻找信息的时候 , 一搜就有了 。
另外就是挖掘 , 仅仅搜索出来已经不能满足人们的要求了 , 还需要从信息中挖掘出相互的关系 。 比如财经搜索 , 当搜索某个公司股票的时候 , 该公司的高管是不是也应该被挖掘出来呢?如果仅仅搜索出这个公司的股票发现涨的特别好 , 于是你就去买了 , 其实其高管发了一个声明 , 对股票十分不利 , 第二天就跌了 , 这不坑害广大股民么?所以通过各种算法挖掘数据中的关系 , 形成知识库 , 十分重要 。
本文插图
本文插图
3大数据时代 , 众人拾柴火焰高
当数据量很小时 , 很少的几台机器就能解决 。 慢慢的 , 当数据量越来越大 , 最牛的服务器都解决不了问题时 , 怎么办呢?这时就要聚合多台机器的力量 , 大家齐心协力一起把这个事搞定 , 众人拾柴火焰高 。
对于数据的收集:就IoT来讲 , 外面部署这成千上万的检测设备 , 将大量的温度、湿度、监控、电力等数据统统收集上来;就互联网网页的搜索引擎来讲 , 需要将整个互联网所有的网页都下载下来 。 这显然一台机器做不到 , 需要多台机器组成网络爬虫系统 , 每台机器下载一部分 , 同时工作 , 才能在有限的时间内 , 将海量的网页下载完毕 。
推荐阅读
- |小米快跟进!华为新专利曝光:屏下摄像头终于要来了
- 电热汇|科普:冷却塔的选择、配置与安装详解
- 微信号|微信终于有这个功能了!网友:一个重新做人的机会
- 信号微信号终于能改了?
- 空间站龙飞船与国际空间站对接成功,直播五位宇航员太空汇合!马斯克终于松了一口气
- 科技小语|iPhone大降1629元,苹果A13+iOS系统+IP68防水,网友:终于等到了
- 科技小旦|现在为啥没有人刷机了?大神:没必要,还不如换新的
- 浅说科技|新支付方式兴起后,有人用马云照片当“密码”,界面却显示4个字!
- 搞机小帝|iPhone12概念图:对iPhone11说再见吧,苹果终于不再保守
- 南桥科技|为什么有人宁愿买二手苹果也不愿意买全新安卓机?原因终于找到了
