预览加载中,请您耐心等待几秒...
1/10
2/10
3/10
4/10
5/10
6/10
7/10
8/10
9/10
10/10

亲,该文档总共33页,到这已经超出免费预览范围,如果喜欢就直接下载吧~

如果您无法下载资料,请参考说明:

1、部分资料下载需要金币,请确保您的账户上有足够的金币

2、已购买过的文档,再次下载不重复扣费

3、资料包下载后请先用软件解压,在使用对应软件打开

.探索大数据和人工智能1、2012年7月,为挖掘大数据的价值,阿里巴巴集团在管理层设立()一职,负责全面推进“数据分享平台”战略,并推出大型的数据分享平台。A首席数据官B.首席科学家C.首席执行官D.首席架构师2、整个MapReduce的过程大致分为Map、Shuffle、Combine、()?A.ReduceB.HashC.CleanD.Loading3、在Spak的软件栈中,用于交互式查询的是A.SparkSQLB.MllibC.GraphXD.SparkStreaming..4、在数据量一定的情况下,MapReduce是一个线性可扩展模型,请问服务器数量与处(理时间是什么关系)?A数量越多处理时间越长B.数量越多处理时间越短C.数量越小处理时间越短D.没什么关系5、下列选项中,不是kafka适合的应用场景是?A.日志收集B.消息系统C.业务系统D.流式处理6、大数据的多样性使得数据被分为三种数据结构,那么以下不是三种数据结构之一的是A.结构化数据B.非结构化数据C.半结构化数据D.全结构化数据7、下列选项中,不是人工智能的算法中的学习方法的是?A.重复学习..B.深度学习C.迁移学习D.对抗学习8、自然语言处理难点目前有四大类,下列选项中不是其中之一的是A.机器性能B.语言歧义性C.知识依赖D.语境9、传統的机器学习方法包括监督学习、无监督学习和半监督学习,其中监督学习是学习给定标签的数据集。请问标签为离散的类型,称为分类,标签为连续的类型,称为什么?A.给定标签B.离散C.分类D.回归10、中国移动自主研发、发布的首个人工智能平台叫做()A.九天B.OneNETC.移娃..D.大云11、HDFS中Namenodef的Metadata的作用是?A.描述数据的存储位置等属性B.存储数据C.调度数据D.12、电信行业的客户关系管理中,客服中心优化可以实现严重问题及时预警,请问是用的什么技术实现的?A大数据技术B.互联网技术C.游戏技术D.影像技术13、随着闭源软件在数据分析领域的地盘不断缩小,老牌IT厂商正在改变商业模式,向着什么靠拢?A.闭源B.开源C.独立D.封闭..14、以下不是非结构化数据的项是?A.图片B.音频C.数据库二维表数据D.视频15、以下数据单位换算错误的是?A.1KB=1024BB.1GB=1024MBC.1TB=1000GBD.1MB=1024KB16、下列选项中,不是Flume的特点的是?A.可靠性B.集中式架构C.可扩展性D.可管理性17、BP神经网络模型拓扑结构不包括A.输入层B.隐层C.翰出层..D.显层18、以下哪个不是语音识别的范畴?A.语音听写B.语音台成C.语音转写D.语音唤醒19、以下哪个场景可以称为大数据场景?A.故宫游客人B.故宫门票收入C.美团APP的定位信息D.文章内容20、2011年5月是哪家全球知名咨询公司在《Bigdata:Thenextfrontierforinnovation,competitionandproductivity》研究报告中指出,数据已经渗透到每一个行业和业务职能之中,逐渐成为重要的生产因素的?A.比尔恩门B.麦肯锡C.扎克伯格D.乔图斯..21、下列选项中,哪项是分布式文件存储系统?A.HDFSB.FlumeC.KafkaD.Zookeeper22、下列选项中,正确描述Flume对数据源的支持的是A.只能使用HDFS数据源B.可以配置数据源C.不能使用文件系统D.不能使用目录方式23、机器学习研究如何通过计算的手段,利用经验来改善系统自身的性能,请问机器学习利用数据训练出什么?A.模型B.表结构C.结果D.报表24、下列选项中,不是人工智能的算法中的学习方法的是A.重复学习B.深度学习..C.迁移学习D.对抗学习25、语音识别产品体系有四部分,下列哪项不是体系之一?A.语音合成B.语音播放C.语音识别D.语义理解26、今年,大数据分析将出现革命性的新方法,从前的很多算法和基础理论可能会产生理论級别的突破。而哪项技术将继续成为大数据智能分析的核心技术A机器学习B.智能物流C.脑科学D.智能终端27、以下哪个不属于大数据在电信行业的数据商业化方面的应用A.精准广告B.网络管理C.营销洞察D.大数据检测和决策..28、RDD是由多个什么组成?A.partitionB.computerC.ActionD.Transformation29、下列选项中,不是大数据的一部分的是?A.海量计算B.大量数据管理C.数据分析D.单机计算30、属于“人造智能”,具有意识,达到或超越人类智慧水平的人工看能称为()A.高人工智能B.低人工智能C.强人工智能D.弱人工智能31、mapreduce计算模型适用于哪种任务?A.多线程处理B.有关联的行处理..C.批处理D.实时数据