论文研究-基于Hadoop Streaming的Last比对软件并行化的研究与实现.pdf

时间:2022-10-02 04:34:36
【文件属性】:

文件名称:论文研究-基于Hadoop Streaming的Last比对软件并行化的研究与实现.pdf

文件大小:542KB

文件格式:PDF

更新时间:2022-10-02 04:34:36

论文研究

随着下一代测序技术的到来,单机版Last比对软件已经不能满足海量数据的处理需求。使用Hadoop Streaming技术将Last比对软件快速部署到云计算环境中,解决当前单机版Last比对软件处理大数据能力差的问题。通过自定义的基于NFS 文件系统的数据集切分方法和基于Partitioner的任务分配方式能够实现均衡高效的数据切分,并保证并行化粒度可控。实验结果表明,在保证与单机运行结果一致的情况下,这种方法能有效缩减软件运行时间,具有较高的加速比。


网友评论