文章详情页

python中sklearn的pipeline模块实例详解

浏览：245日期：2022-07-25 08:33:43

最近在看《深度学习：基于Keras的Python实践（魏贞原）》这本书，书中8.3创建了一个Scikit-Learn的Pipeline，首先标准化数据集，然后创建和评估基线神经网络模型，代码如下：

# 数据正态化，改进算法steps = []steps.append((’standardize’, StandardScaler()))steps.append((’mlp’, model))pipeline = Pipeline(steps)kfold = KFold(n_splits=10, shuffle=True, random_state=seed)results = cross_val_score(pipeline, x, Y, cv=kfold)print(’Standardize: %.2f (%.2f) MSE’ % (results.mean(), results.std()))

而PipeLine是什么来的呢？

Pipelines and composite estimators（官方文档）

转换器通常与分类器，回归器或其他估计器组合在一起，以构建复合估计器。最常用的工具是Pipeline。Pipeline通常与FeatureUnion结合使用，FeatureUnion将转换器的输出连接到一个复合特征空间中。 TransformedTargetRegressor处理转换目标（即对数变换y）。相反，Pipelines仅转换观察到的数据（X）。

Pipeline可用于将多个估计器链接为一个。这很有用，因为在处理数据时通常会有固定的步骤顺序，例如特征选择，归一化和分类。Pipeline在这里有多种用途：

方便和封装：只需调用一次fit并在数据上进行一次predict即可拟合整个估计器序列。联合参数选择：可以一次对Pipeline中所有估计器的参数进行网格搜索（grid search ）。安全性：通过确保使用相同的样本来训练转换器和预测器，Pipeline有助于避免在交叉验证中将测试数据的统计信息泄漏到经过训练的模型中。

Pipeline是使用 （key，value） 对的列表构建的，其中key是包含要提供此步骤名称的字符串，而value是一个估计器对象：

from sklearn.pipeline import Pipelinefrom sklearn.svm import SVCfrom sklearn.decomposition import PCAestimators = [(’reduce_dim’, PCA()), (’clf’, SVC())]pipe = Pipeline(estimators)pipe

output:

python中sklearn的pipeline模块实例详解

函数make_pipeline是构建pipelines的简写;它接受不同数量的估计器，并返回一个pipeline。它不需要也不允许命名估计器。而是将其名称自动设置为其类型的小写字母：

from sklearn.pipeline import make_pipelinefrom sklearn.naive_bayes import MultinomialNBfrom sklearn.preprocessing import Binarizermake_pipeline(Binarizer(), MultinomialNB())

output:

python中sklearn的pipeline模块实例详解

总结

到此这篇关于python中sklearn的pipeline模块的文章就介绍到这了,更多相关python pipeline模块内容请搜索好吧啦网以前的文章或继续浏览下面的相关文章希望大家以后多多支持好吧啦网！

Python 编程

上一条：Python中的xlrd模块使用原理解析下一条：Python使用re模块验证危险字符

相关文章：

1. python操作mysql、excel、pdf的示例2. Vue实现电梯样式锚点导航效果流程详解3. PHP中的闭包function() use() {}使用场景和技巧4. Python制作简单的剪刀石头布游戏5. Matplotlib可视化之添加让统计图变得简单易懂的注释6. 解析原生JS getComputedStyle7. Vue2 中的数据劫持简写示例8. js中textContent、innerText和innerHTML的用法以及区别9. uni-app结合.NET 7实现微信小程序订阅消息推送10. Python爬虫+Tkinter制作一个翻译软件的示例

排行榜

					
					PHP下防止单引号,双引号在接受页面转义的设置方法
解析原生JS getComputedStyle
js中textContent、innerText和innerHTML的用法以及区别
20款最优秀的JavaScript编辑器 哪家强你说了算！
简单的理解java集合中的HashSet和HashTree几个重写方法
uni-app结合.NET 7实现微信小程序订阅消息推送
PHP中的闭包function() use() {}使用场景和技巧
Vue2 中的数据劫持简写示例
python操作mysql、excel、pdf的示例
Docker 容器健康检查机制
Matplotlib可视化之添加让统计图变得简单易懂的注释
				

热门标签