博客
关于我
《机器学习与实践》读书笔记及代码(三)
阅读量:146 次
发布时间:2019-02-27

本文共 2260 字,大约阅读时间需要 7 分钟。

#波士顿地区,用线性回归,去预测房价from sklearn.datasets import load_bostonboston = load_boston()print boston.DESCRfrom sklearn.cross_validation import train_test_splitimport numpy as npX = boston.datay = boston.target#如果没有这里的话,下一步会报错# X.shapeX_train, X_test, y_train, y_test = train_test_split(X,y,random_state=33,test_size = 0.25)print"The max target value is:",np.max(boston.target)print"The min target value is:",np.min(boston.target)print"The average target value is:",np.mean(boston.target)# print X_train.shape# print y_train.shape#从上面当中,显然发现预测目标房价之间,差距很大,因此,应该先标准化处理from sklearn.preprocessing import StandardScalerss_X = StandardScaler()#分别对训练和测试数据的特征,以及目标值进行标准化处理X_train = ss_X.fit_transform(X_train)X_test = ss_X.transform(X_test)ss_y = StandardScaler()#这里一定要有reshape(-1,1)这样一个过程,否则会报错,y_train = ss_y.fit_transform(y_train.reshape(-1, 1))y_test = ss_y.transform(y_test.reshape(-1, 1))#此处使用十分简单的LinearRegression和SGDRegression分别对美国波士顿地区的房价进行预测from sklearn.linear_model import LinearRegressionlr = LinearRegression()lr.fit(X_train,y_train)lr_y_predict = lr.predict(X_test)from sklearn.linear_model import SGDRegressorsgdr = SGDRegressor()sgdr.fit(X_train,y_train)sgdr_y_predict = sgdr.predict(X_test)#使用LinearRegression模型自带的评估模块。并输出结果print 'The value of default measurement of LinearRegression is:',lr.score(X_test,y_test)from sklearn.metrics import r2_score,mean_squared_error,mean_absolute_errorprint 'The value of R-squared of LinearRegression is:',r2_score(y_test,lr_y_predict)print 'The mean squared error of LinearRegression is:',mean_squared_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(lr_y_predict))print 'The mean absolute error of LinearRegression is:',mean_absolute_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(lr_y_predict))#使用SGDRegression模型自带的评估模块。并输出结果print 'The value of default measurement of SGDRegressor is:',sgdr.score(X_test,y_test)print 'The value of R-squared of LinearRegression is:',r2_score(y_test,sgdr_y_predict)print 'The mean squared error of LinearRegression is:',mean_squared_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(sgdr_y_predict))print 'The mean absolute error of LinearRegression is:',mean_absolute_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(sgdr_y_predict))

支持向量机(回归)

 

转载地址:http://ixjb.baihongyu.com/

你可能感兴趣的文章
NIFI从MySql中增量同步数据_通过Mysql的binlog功能_实时同步mysql数据_配置数据路由_生成插入Sql语句_实际操作02---大数据之Nifi工作笔记0041
查看>>
NIFI从MySql中离线读取数据再导入到MySql中_03_来吧用NIFI实现_数据分页获取功能---大数据之Nifi工作笔记0038
查看>>
NIFI从MySql中离线读取数据再导入到MySql中_不带分页处理_01_QueryDatabaseTable获取数据_原0036---大数据之Nifi工作笔记0064
查看>>
NIFI从MySql中离线读取数据再导入到MySql中_无分页功能_02_转换数据_分割数据_提取JSON数据_替换拼接SQL_添加分页---大数据之Nifi工作笔记0037
查看>>
NIFI从Oracle11G同步数据到Mysql_亲测可用_解决数据重复_数据跟源表不一致的问题---大数据之Nifi工作笔记0065
查看>>
NIFI从PostGresql中离线读取数据再导入到MySql中_带有数据分页获取功能_不带分页不能用_NIFI资料太少了---大数据之Nifi工作笔记0039
查看>>
nifi使用过程-常见问题-以及入门总结---大数据之Nifi工作笔记0012
查看>>
NIFI分页获取Mysql数据_导入到Hbase中_并可通过phoenix客户端查询_含金量很高的一篇_搞了好久_实际操作05---大数据之Nifi工作笔记0045
查看>>
NIFI分页获取Postgresql数据到Hbase中_实际操作---大数据之Nifi工作笔记0049
查看>>
NIFI同步MySql数据_到SqlServer_错误_驱动程序无法通过使用安全套接字层(SSL)加密与SQL Server_Navicat连接SqlServer---大数据之Nifi工作笔记0047
查看>>
NIFI同步MySql数据源数据_到原始库hbase_同时对数据进行实时分析处理_同步到清洗库_实际操作06---大数据之Nifi工作笔记0046
查看>>
Nifi同步过程中报错create_time字段找不到_实际目标表和源表中没有这个字段---大数据之Nifi工作笔记0066
查看>>
NIFI大数据进阶_FlowFile拓扑_对FlowFile内容和属性的修改删除添加_介绍和描述_以及实际操作---大数据之Nifi工作笔记0023
查看>>
NIFI大数据进阶_FlowFile生成器_GenerateFlowFile处理器_ReplaceText处理器_处理器介绍_处理过程说明---大数据之Nifi工作笔记0019
查看>>
NIFI大数据进阶_FlowFile生成器_GenerateFlowFile处理器_ReplaceText处理器_实际操作---大数据之Nifi工作笔记0020
查看>>
NIFI大数据进阶_Json内容转换为Hive支持的文本格式_实际操作_02---大数据之Nifi工作笔记0032
查看>>
NIFI大数据进阶_Json内容转换为Hive支持的文本格式_操作方法说明_01_EvaluteJsonPath处理器---大数据之Nifi工作笔记0031
查看>>
NIFI大数据进阶_Kafka使用相关说明_实际操作Kafka消费者处理器_来消费kafka数据---大数据之Nifi工作笔记0037
查看>>
NIFI大数据进阶_Kafka使用相关说明_实际操作Kafka生产者---大数据之Nifi工作笔记0036
查看>>
NIFI大数据进阶_NIFI的模板和组的使用-介绍和实际操作_创建组_嵌套组_模板创建下载_导入---大数据之Nifi工作笔记0022
查看>>