基于Flume和HDFS的大数据采集系统的研究与实现
摘要(Abstract):
在充分研究大数据采集、大数据存储、HDFS和Flume基础上,综合分析并利用相关领域知识,给出了一种基于Flume和HDFS相结合的大数据采集系统BDAS的概念模型和体系结构.并根据BDAS的体系结构,可以明确实现一种大数据采集的具体工作,即:Flume Agent的配置.根据体系结构,给出一个实现Web Server日志采集的具体实现方法和步骤. BDAS概念模型和体系结构在大数据分析和研究领域具有重要的理论意义和实际意义,也为大数据领域的研究提供了一种通用的大数据获取手段.
关键词(KeyWords): HDFS;Flume;大数据采集系统;Web Server;BDAS
基金项目(Foundation):
作者(Author): 方中纯;赵江鹏;