Spark高级数据分析
龚少成 译
出版时间:2015年11月
页数:226
本书是使用Spark进行大规模数据分析的实战宝典,由大数据公司Cloudera的数据科学家撰写。四位作者首先结合数据科学和大数据分析的广阔背景讲解了Spark,然后介绍了用Spark和Scala进行数据处理的基础知识,接着讨论了如何将Spark用于机器学习,同时介绍了常见应用中几个常用的算法。此外还收集了一些更加新颖的应用,比如通过文本隐含语义关系来查询Wikipedia或分析基因数据。
本书适合从事大数据分析的各大类专业人员阅读。
书名:Spark高级数据分析
译者:龚少成 译
国内出版社:人民邮电出版社
出版时间:2015年11月
页数:226
书号:978-7-115-40474-9
原版书书名:Advanced Analytics with Spark
原版书出版商:O'Reilly Media
Sandy Ryza
Sandy Ryza是Cloudera公司数据科学家,Apache Spark项目的活跃代码贡献者。领导了Cloudera公司的Spark开发工作。他还是Hadoop项目管理委员会委员。
Uri Laserson
Uri Laserson是Cloudera公司数据科学家,专注于Hadoop生态系统中的Python部分。
Sean Owen
Sean Owen是Cloudera公司EMEA地区的数据科学总监,也是Apache Spark项目的代码提交者。他创立了基于Spark、Spark Streaming和Kafka的Hadoop实时大规模学习项目Oryx(之前称为Myrrix)。
Josh Wills
Josh Wills是Cloudera公司的高级数据科学总监,Apache Crunch项目的发起者和副总裁。