作者:(印) 普拉莫德·辛格著
索书号:TP181/10054
馆藏地:
校本部馆 - 科技新书展示架(3楼)
编辑推荐
本书阐释了如何构建有监督机器学习模型,比如线性回归、逻辑回归、决策树和随机森林,还介绍了无监督机器学习模型,比如K均值和层次聚类。本书重点介绍特征工程,以便使用PySpark创建有用的特征,从而训练机器学习模型。自然语言处理的相关章节将介绍文本处理、文本挖掘以及用于分类的嵌入。
在阅读完本书之后,读者将了解如何使用PySpark的机器学习库构建和训练各种机器学习模型。此外,还将熟练掌握相关的PySpark组件,从而进行数据获取、数据处理和数据分析,开发数据驱动的智能应用。
内容简介
本书旨在教会读者构建一系列有监督和无监督机器学习算法、如何使用Spark MLlib库实现机器学习算法和使用Spark MLlib库开发推荐系统,以及如何处理与特征工程、分类平衡、偏差和方差以及交叉验证有关的问题,以便构建最好的拟合模型。
作者简介
Pramod Singh是Publicis.Sapient公司数据科学部门的经理,目前正作为数据科学跟踪负责人与梅赛德斯奔驰的一个项目进行合作。他在机器学习、数据工程、编程,以及为各种业务需求设计算法方面拥有丰富的实践经验,领域涉及零售、电信、汽车以及日用消费品等行业。他在Publicis.Sapient主导了大量应对机器学习和AI的战略计划。他在孟买大学获得了电气与电子工程的学士学位,并且在印度共生国际大学获得了MBA学位(运营&财务),还在IIM Calcutta(印度管理学院加尔各答分校)获得了数据分析认证。
在过去八年中,他一直在跟进多个数据项目。在大量客户项目中,他使用R、Python、Spark和TensorFlow应用机器学习和深度学习技术。他一直是各重大会议和大学的演讲常客。他会在Publicis.Sapient举办数据科学聚合并且定期出席关于ML和AI的网络研讨会。
周一至周日 8:00-22:00
周一至周日 8:00-22:00
电话:020-62789014(本部)
0757-29985219(顺德)
电话:020-61648543
电话:020-61648053
电话:020-62789012
电话:020-61648051
电话:020-62789012
邮政编码:510515
邮政编码:528305
当前IP地址:3.138.116.1