B.大规模并行计算:在分布式并行环境中将一个任务分解成更多份细粒度的子任务,这些子任务在空闲的处理节点之间被调度和快速处理之后,最终通过特定的规则进行合并生成最终的结果。典型技术为MapReduce
C.结构化分布式数据存储:类似文件系统采用数据库来存储结构化数据,云计算也需要采用特殊技术实现结构化数据存储,典型技术为BigTable/Dynamo等
D.分布式文件系统:可扩展的支持海量数据的分布式文件系统,用于大型的、分布式的、对大量数据进行访问的应用。它运行于廉价的普通硬件上,提供容错功能(通常保留数据的3份拷贝),典型技术为GFS/HDFS/KFS等
A.HDFS并不是一个单机文件系统,它是分布在多个集群节点上的文件系统
B.仅仅对数据进行冗余备份还不够,HDFS要有一个更有效的副本存放策略
C.对于HDFS来说,丢失一个Data Node意味着丢失了存储在它的硬盘上的数据块的副本
D.如果要存放数据的节点宕机,HDFS会再分配三个节点给数据块
A.HDFS:分布式文件系统,是Hadoop项目的两大核心之一,是谷歌GFS的开源实现
B.HBase:提供高可靠性、高性能、分布式的行式数据库,是谷歌Big Table的开源实现
C.Hive:一个基于Hadoop的数据仓库工具,用于对Hadoop文件中的数据集进行数据整理、特殊查询和分析存储
D.Zookeeper:针对谷歌Chubby的一个开源实现,是高效可靠的协同工作系统
A.只能存贮固定格式的文件
B.只能运行在单机服务器上
C.需要购买昂贵的专业服务器
D.成本低,可扩展性强