您的位置:网站首页 > 技术前沿 > 正文

一文读懂:云计算、大数据和人工智到底是什么?

类别:技术前沿 日期:2018-4-26 10:03:53 人气: 来源:

  一开始这个大数据并不大。原来才有多少数据?现在大家都去看,上网看新闻了,在我们80后小时候,信息量没有那么大,也就看看书、看看报,一个星期的加起来才有多少字?如果你不在一个大城市,一个普通的学校的图书馆加起来也没几个书架,是后来随着信息化的到来,信息才会越来越多。

  首先我们来看一下大数据里面的数据,就分三种类型,一种叫结构化的数据,一种叫非结构化的数据,还有一种叫半结构化的数据。

  结构化的数据 : 即有固定格式和有限长度的数据。例如填的表格就是结构化的数据,国籍:中华人民国,民族:汉,性别:男,这都叫结构化数据。

  非结构化的数据 : 现在非结构化的数据越来越多,就是不定长、无固定格式的数据,例如网页,有时候非常长,有时候几句话就没了;例如语音,视频都结构化的数据。

  半结构化数据 : 是一些XML或者HTML的格式的,不从事技术的可能不了解,但也没有关系。

  其实数据本身不是有用的,必须要经过一定的处理。例如你每天跑步带个手环收集的也是数据,网上这么多网页也是数据,我们称为Data。数据本身没有什么用处,但数据里面包含一个很重要的东西,叫做信息(Information)。

  数据十分杂乱,经过梳理和清洗,才能够称为信息。信息会包含很多规律,我们需要从信息中将规律总结出来,称为知识(Knowledge),而知识改变命运。信息是很多的,但有人看到了信息相当于白看,但有人就从信息中看到了电商的未来,有人看到了直播的未来,所以人家就牛了。如果你没有从信息中提取出知识,天天看朋友圈也只能在互联网滚滚大潮中做个看客。

  有了知识,然后利用这些知识去应用于实战,有的人会做得非常好,这个东西叫做智慧(Intelligence)。有知识并不一定有智慧,例如 好多学者很有知识,已经发生的事情可以从各个角度分析得头头是道,但一到实干就歇菜,并不能成为智慧。而很多的创业家之所以伟大,就是通过获得的知识应用于实践,最后做了很大的生意。

  最终的阶段是很多商家都想要的。你看我收集了这么多的数据,能不能基于这些数据来帮我做下一步的决策,改善我的产品。 例如让用户看视频的时候旁边弹出广告,正好是他想买的东西;再如让用户听音乐时,另外推荐一些他非常想听的其他音乐。

  用户在我的应用或者网站上随便点点鼠标,输入文字对我来说都是数据,我就是要将其中某些东西提取出来、指导实践、形成智慧,让用户陷入到我的应用里面不可自拔,上了我的网就不想离开,手不停地点、不停地买。

  很多人说双十一我都想断网了,我老婆在不断地买买买,买了A又推荐B,老婆大人说,“哎呀,B也是我喜欢的啊,老公我要买”。你说这个程序怎么这么牛,这么有智慧,比我还了解我老婆,这件事情是怎么做到的呢?

  第一个方式是拿,专业点的说法叫抓取或者爬取。例如搜索引擎就是这么做的:它把网上的所有的信息都下载到它的数据中心,然后你一搜才能搜出来。比如你去搜索的时候,结果会是一个列表,这个列表为什么会在搜索引擎的公司里面?就是因为他把数据都拿下来了,但是你一点链接,点出来这个网站就不在搜索引擎它们公司了。比如说新浪有个新闻,你拿百度搜出来,你不点的时候,那一页在百度数据中心,一点出来的网页就是在新浪的数据中心了。

  第二个方式是推送,有很多终端可以帮我收集数据。比如说小米手环,可以将你每天跑步的数据,心跳的数据,睡眠的数据都上传到数据中心里面。

  第二个步骤是数据的传输。 一般会通过队列方式进行,因为数据量实在是太大了,数据必须经过处理才会有用。可系统处理不过来,只好排好队,慢慢处理。

  第三个步骤是数据的存储 。现在数据就是,掌握了数据就相当于掌握了钱。要不然网站怎么知道你想买什么?就是因为它有你历史的交易的数据,这个信息可不能给别人,十分宝贵,所以需要存储下来。

  第四个步骤是数据的处理和分析。 存储的数据是原始数据,原始数据多是杂乱无章的,有很多垃圾数据在里面,因而需要清洗和过滤,得到一些高质量的数据。对于高质量的数据,就可以进行分析,从而对数据进行分类,或者发现数据之间的相互关系,得到知识。

  比如盛传的沃尔玛超市的啤酒和尿布的故事,就是通过对人们的购买数据进行分析,发现了男人一般买尿布的时候,会同时购买啤酒,这样就发现了啤酒和尿布之间的相互关系,获得知识,然后应用到实践中,将啤酒和尿布的柜台弄的很近,就获得了智慧。

  第五个步骤是对于数据的检索和挖掘。 检索就是搜索,所谓外事不决问Google,内事不决问百度。内外两大搜索引擎都是将分析后的数据放入搜索引擎,因此人们想寻找信息的时候,一搜就有了。

  另外就是挖掘,仅仅搜索出来已经不能满足人们的要求了,还需要从信息中挖掘出相互的关系。比如财经搜索,当搜索某个公司股票的时候,该公司的高管是不是也应该被挖掘出来呢?如果仅仅搜索出这个公司的股票发现涨的特别好,于是你就去买了,其实其高管发了一个声明,对股票十分不利,第二天就跌了,这不广大股民么?所以通过各种算法挖掘数据中的关系,形成知识库,十分重要。

  今天(4月25日),由硬科技第一产业镁客网主办,苏州市科学技术局指导,苏州工业园区人工智能产业协会、苏州国际科技园、蒲公英孵化器协办的“M-TECH主题论坛——AI创新带来的智能”在苏州南园宾馆落幕。

  018年4月16日上午,由世界著名人工智能专家余凯博士团队,大学张钹院士领衔的国内著名AI学者团队和南京三方倾力打造的南京人工智能高等研究院正式成立,落户于南京国家级经济技术开发区。政企校三方依托自身优势,紧密响应“两落地,一融合”号召,深化产学研传统合作模式,共同建设一个“创新人才、创新、创新产业”三位一体的人工智能高等

  如果说人工智能是一辆飞奔的豪华跑车,那么数据就是提供强劲动力的燃料,这种能源不仅要充沛,还要确保质量。否则,就会产生瑕疵影响跑车的速度和行进轨道,甚至会引发AI的“生命”。

  对于中兴来说,能否在这次“没有核心竞争力就别不老实”的命题课中真正反思不得而知。而众人工智能企业通过这次围观,究竟是大多选择老老实实和巨头们合作,还是发愤图强、自觉自醒,结局或许只有风云激荡三十年之后才能知晓了。

  4月21日,万众瞩目的《雄安新区规划纲要》正式发布,为人们勾画出这座“未来之城”的具体画面。“数字化城市”、“大数据”、“物联网”、“云计算”、“人工智能”、“工业互联网”、“网络安全”等关键词在纲要中反复出现。

  近日,列入2018年科创中心建设重点项目清单的燕东微电子8英寸集成电研发产业化及封测平台项目举办上梁仪式,该项目预计于今年底在开发区投产。

  国际半导体产业协会(SEMI)日前公布半导体设备制造商3月出货金额为24.2亿美元,比2月微增,创17年多以来新高。SEMI指出,今年在内存及晶圆代工投资持续带动下,对于半导体设备市场成长续航力道仍维持乐观态度。

  台积电不愧是晶圆代工的绝对王者,2017年销售再次称霸,营收足足是第二名的五倍。与此同时,陆厂急起直追,华虹集团(Huahong Group)的成长率傲视全球主要业者。

  继4月18日阿里达摩院宣布正在研发一款用于图像视频分析、机器学习等AI推理计算领域的神经网络芯片——Ali-NPU之后;4月20日,阿里宣布收购芯片公司杭州中天微系统有限公司。

  紫光股份发布2017年财报,财报显示,公司去年实现营业收入390.71亿元,同比增长41%;归属于上市公司股东的净利润15.75亿元,同比增长93.35%。

  

0
0
0
0
0
0
0
0
下一篇:没有资料

相关阅读

网友评论 ()条 查看

姓名: 验证码: 看不清楚,换一个

推荐文章更多

热门图文更多

最新文章更多

关于联系我们 - 广告服务 - 友情链接 - 网站地图 - 版权声明 - 人才招聘 - 帮助

声明:网站数据来源于网络转载,不代表站长立场,如果侵犯了你的权益,请联系站长删除。

CopyRight 2010-2016 微商网络家园- All Rights Reserved