您的位置: 专家智库 > >

袁玉

作品数:1 被引量:10H指数:1
供职机构:中国科学院合肥智能机械研究所更多>>
发文基金:国家自然科学基金更多>>
相关领域:自动化与计算机技术更多>>

文献类型

  • 1篇中文期刊文章

领域

  • 1篇自动化与计算...

主题

  • 1篇单机
  • 1篇性能分析
  • 1篇分布式
  • 1篇分布式文件
  • 1篇分布式文件系...
  • 1篇HADOOP
  • 1篇HDFS
  • 1篇MAPRED...

机构

  • 1篇中国科学院
  • 1篇中国科学技术...
  • 1篇中国科学院研...

作者

  • 1篇陈祝红
  • 1篇崔超远
  • 1篇乌云
  • 1篇袁玉

传媒

  • 1篇计算机工程与...

年份

  • 1篇2013
1 条 记 录,以下是 1-1
排序方式:
单机下Hadoop小文件处理性能分析被引量:10
2013年
Hadoop主要是针对大量数据进行分布式处理的软件框架,即适合于处理大文件,但它们是否也适合处理小文件值得商榷。以词频统计为例,通过在单机环境下一些典型文件测试集的实验,对比了不同文件输入格式对Hadoop处理小文件性能的差异。从Hadoop的工作流程和原理上解释了出现此性能差异的原因。通过分析得出多个小文件整合为一个数据片split有助于改善Hadoop处理小文件性能。
袁玉崔超远乌云陈祝红
关键词:HADOOPMAPREDUCE
共1页<1>
聚类工具0