大数据处理技术ppt讲课稿(共24页).doc

上传人:晟*** 文档编号:8645523 上传时间:2021-11-25 格式:DOC 页数:24 大小:6.06MB
下载 相关 举报
大数据处理技术ppt讲课稿(共24页).doc_第1页
第1页 / 共24页
大数据处理技术ppt讲课稿(共24页).doc_第2页
第2页 / 共24页
大数据处理技术ppt讲课稿(共24页).doc_第3页
第3页 / 共24页
大数据处理技术ppt讲课稿(共24页).doc_第4页
第4页 / 共24页
大数据处理技术ppt讲课稿(共24页).doc_第5页
第5页 / 共24页
点击查看更多>>
资源描述

精选优质文档-倾情为你奉上大数据处理技术ppt讲课稿科信办 刘伟第一节 Mapreduce编程模型:1.技术背景:分布式并行计算是大数据(pb)处理的有效方法,编写正确高效的大规模并行分布式程序是计算机工程领域的难题:分布式并行计算是大数据(pb)处理的有效方法,编写正确高效的大规模并行分布式程序是计算机工程领域的难题。 并行计算的模型、计算任务分发、计算机结果合并、计算节点的通讯、计算节点的负载均衡、计算机节点容错处理、节点文件的管理等方面都要考虑。 谷歌的关于mapreduce论文里这么形容他们遇到的难题:由 于输入的数据量巨大,因此要想在可接受的时间内完成运算,只有将这些计算分布在成百上千的主机上。如何处理并行计算、如何分发数据、如何处理错误?所有这 些问题综合在一起,需要大量的代码处理,因此也使得原本简单的运算变得难以处理,普通程序员无法进行大数据处理。为了解决上述复杂的问题,谷歌设计一个新的抽象模型,使用这个抽象模型,普通程序员只要表述他们想要执行的简单运算即可,而不必关心并行计算、容错、 数据分布、负载均衡等复杂的细节,这些问题都被

展开阅读全文
相关资源
相关搜索

当前位置:首页 > 实用文档资料库 > 公文范文

Copyright © 2018-2021 Wenke99.com All rights reserved

工信部备案号浙ICP备20026746号-2  

公安局备案号:浙公网安备33038302330469号

本站为C2C交文档易平台,即用户上传的文档直接卖给下载用户,本站只是网络服务中间平台,所有原创文档下载所得归上传人所有,若您发现上传作品侵犯了您的权利,请立刻联系网站客服并提供证据,平台将在3个工作日内予以改正。