Storm技术内幕与大数据实践
Storm技术内幕与大数据实践 内容简介: 《Storm技术内幕与大数据实践》内容主要围绕实时大数据系统的各个方面展开,从实时平台总体介绍到集群源码、运维监控、实时系统扩展、以用户画像为主的数据平台,最后到推荐、广告、搜索等具体的大数据应用。书中提到的不少问题是实际生产环境中因为数据量增长而遇到的一些真实问题,对即将或正在运用实时系统处理大数据问题的团队会有所帮助。 资源目录: 第1章 绪论 1.1 Storm的基本组件 1.1.1 集群组成 1.1.2 核心概念 1.1.3 Storm的可靠性 1.1.4 Storm的特性 1.2 其他流式处理框架 1.2.1 Apache S4 1.2.2 Spark Streaming 1.2.3 流计算和Storm的应用 第2章 实时平台介绍 2.1 实时平台架构介绍 2.2 Kafka架构 2.2.1 Kafka的基本术语和概念 2.2.2 Kafka在实时平台中的应用 2.2.3 消息的持久化和顺序读写 2.2.4 sendfile系统调用和零复制 2.2.5 Kafka的客户端 2.2.6 Kafka的扩展 2.3 大众点评实时平台 2.3.1 相关数据 2.3.2 实时平台简介 2.3.3 Blackhole 2.4 1号店实时平台 第3章 Storm集群部署和配置 3.1 Storm的依赖组件 3.2 Storm的部署环境 3.3 部署Storm服务 3.3.1 部署ZooKeeper 3.3.2 部署Storm 3.3.3 配置Storm 3.4 启动Storm 3.5 Storm的守护进程 3.6 部署Storm的其他节点 3.7 提交Topology 第4章 Storm内部剖析 4.1 Storm客户端 4.2 Nimbus 4.2.1 启动Nimbus服务 4.2.2 Nimbus服务的执行过程 ...