基于Hadoop、Spark及Flink大规模数据分析的性能评价下载

【文件属性】：

文件名称：基于Hadoop、Spark及Flink大规模数据分析的性能评价

文件大小：2.05MB

文件格式：PDF

更新时间：2021-07-19 10:44:59

hadoop

针对目前缺少大型数据分析框架间的横向比较问题,使用有代表性的大数据工作负载,对Hadoop、Spark和Flink进行性能和可扩展性等因素的比较评价。此外,通过调整工作负载的一些主要参数,例如HDFS块大小、输入数据大小、互连网络或线程配置等,描述了这些框架的行为模式特征。实验结果分析表明,对于非排序的基准测试程序,使用Spark或Flink替代Hadoop,分别带来平均77%和70%执行时间的降低。整体上,Spark的性能结果最好;而Flink通过使用的显式迭代程序,极大提高了迭代算法的性能。

立即下载

秒客网

基于Hadoop、Spark及Flink大规模数据分析的性能评价

网友评论

相关文章