借阅:0 收藏:0

/汤姆

ISBN/ISSN::978-7-302-22424-2

出版: :清华 ,2010年2月

载体形态:510页 go异16开

中图分类号:TP274-62

    • 评分:
    • 加入暂存架

    豆瓣内容简介:

    本书是您纵情享用数据之美的得力助手。作为处理海量数据集的理想工具,Apache Hadoop架构是MapReduce算法的一种开源应用,是Google(谷歌)开创其帝国的重要基石。本书内容丰富,展示了如何使用Hadoop构建可靠、可伸缩的分布式系统,程序员可从中探索如何分析海量数据集,管理员可以了解如何建立与运行Hadoop集群。.
    本书完全通过案例学习来展示如何用Hadoop解决特殊问题,它将帮助您:
    使用Hadoop分布式文件系统(HDFS)来存储海量数据集,通过MapReduce对这些数据集运行分布式计算..
    熟悉Hadoop的数据和I/O构件,用于压缩、数据集成、序列化和持久处理
    洞悉编写MapReduce实际应用程序时常见陷阱和高级特性
    设计、构建和管理专用的Hadoop集群或在云上运行Hadoop
    使用Pig这种高级的查询语言来处理大规模数据
    利用HBase这个Hadoop数据库来处理结构化和半结构化数据
    学习Zookeeper,这是一个用于构建分布式系统的协作原语工具箱
    如果您拥有海量数据,无论是GB级还是PB级,Hadoop都是完美的选择。本书是这方面最全面的参考。

    豆瓣作者简介:

    分馆名 馆藏部门 图书条码 索书号 登录号 状态 馆员代借
    序号 图书条码 索书号 登录号 藏书部门 流通状态 年卷期 装订册 装订方式 装订颜色
      类型 说明 URL
      评 论
      评分:
      发表

      北京创讯未来软件技术有限公司 版权所有 ALL RIGHTS RESERVED 京ICP备 09032139

      欢迎第117631位用户访问本系统