爱丽丝·郑(Alice Zheng)
亚马逊广告平台建模和优化团队负责人,应用机器学习、生成算法和平台开发领域的技术领导者,前微软研究院机器学习研究员。
阿曼达·卡萨丽(Amanda Casari)
谷歌云开发者关系工程经理,曾是Concur Labs的产品经理和数据科学家,在数据科学、机器学习、复杂系统和机器人等多个领域都有丰富经验。
发表于2024-11-23
精通特征工程 2024 pdf epub mobi 电子书
我直言不讳,在我撰写本文的时候,本书在豆瓣评分偏低。不忍好书蒙尘,忍不住撰写此文。 工程领域的书籍不好写,实践性太强。工程中要处理的问题总是一个例子一个例子组成的,一个项目一个项目实操干出来的,具体例子和具体例子之间差异非常之大,方法论难以提炼。判断工程技术...
评分特征工程是数据科学工程的核心,目前关于这个话题专门的书籍不多。本书通过概念(不是理论)和案例代码相结合的方式,还该了特征工程中的一些基础技术。包括分类型变量编码,数值型数据的分箱,变换。文本处理,PCA以及基于模型的特征工程。模型堆叠和k-均值特征化。最后简单介...
评分[https://github.com/apachecn/feature-engineering-for-ml-zh] ==========================================================================================================================================================
评分特征工程是数据科学工程的核心,目前关于这个话题专门的书籍不多。本书通过概念(不是理论)和案例代码相结合的方式,还该了特征工程中的一些基础技术。包括分类型变量编码,数值型数据的分箱,变换。文本处理,PCA以及基于模型的特征工程。模型堆叠和k-均值特征化。最后简单介...
评分[https://github.com/apachecn/feature-engineering-for-ml-zh] ==========================================================================================================================================================
图书标签: 机器学习 特征工程 Python 大数据 数据科学 计算机 数据挖掘 数据分析与机器学习
特征工程是机器学习流程中至关重要的一个环节,然而专门讨论这个话题的著作却寥寥无几。本书旨在填补这一空白,着重阐明特征工程的基本原则,介绍大量特征工程技术,教你从原始数据中提取出正确的特征并将其转换为适合机器学习模型的格式,从而轻松构建模型,增强机器学习算法的效果。
然而,本书并非单纯地讲述特征工程的基本原则,而是通过大量示例和练习将重点放在了实际应用上。每一章都集中研究一个数据问题:如何表示文本数据或图像数据,如何为自动生成的特征降低维度,何时以及如何对特征进行标准化,等等。最后一章通过一个完整的例子演示了多种特征工程技术的实际应用。书中所有代码示例均是用Python编写的,涉及NumPy、Pandas、scikit-learn和Matplotlib等程序包。
- 数值型数据的特征工程:过滤、分箱、缩放、对数变换和指数变换
- 自然文本技术:词袋、n元词与短语检测
- 基于频率的过滤和特征缩放
- 分类变量编码技术:特征散列化与分箱计数
- 使用主成分分析的基于模型的特征工程
- 模型堆叠与k-均值特征化
- 图像特征提取:人工提取与深度学习
虽然没读完也不配读懂但是感谢分类标签这一章救我于水深火热peace&love我又好起来了嘤嘤嘤
评分作为单独介绍特征处理的书不是很多, 这本书还是不错的。 和模型构建相对紧密是最大的优点,给出了实例代码,不过没有提供直接数据下载, 而且从数据网站上下载的数据往往和实例代码上的数据格式有冲突,无法直接边运行边学习。 扣一颗星
评分虽然没读完也不配读懂但是感谢分类标签这一章救我于水深火热peace&love我又好起来了嘤嘤嘤
评分实战里更多是糙猛快,堆数据。书里不少方法和思路开阔眼界了,以后比赛里试试看
评分看一下开源版本
精通特征工程 2024 pdf epub mobi 电子书