关于数据挖掘:SQL-Server-Analysis-Services数据挖掘聚类分析职业地区餐饮消费水平数据附代码数据

全文链接：http://tecdat.cn/?p=31887

最近咱们被客户要求撰写对于聚类的钻研报告，包含一些图形和统计输入。

本文通过 SQL Server Analysis Services数据挖掘的剖析模块，帮忙客户对一个职业、地区、餐饮消费水平的数据挖掘，并用可视化剖析图表显示数据

该后果可为餐饮业的管理者提供决策依据，进而使餐饮企业取得更多利润。同时，挖掘出与该职业绝对应的地区及消费水平，能够为职业倒退布局、餐饮市场的开辟提供无效根据。

筹备工作：数据.xls 数据导入数据库中。

将表格命名

在相应数据库中找到对应的数据

商业智能我的项目

抉择商业智能我的项目，analysis services我的项目，并抉择指标文件夹

在解决方案资源管理器中，右键单击数据源，抉择新建数据源

在解决方案资源管理器中，右键单击开掘构造，抉择新建开掘构造

设置输出数据与键Id

设置训练集和测试集的百分比

点击部署模型

看到右下角部署实现

查看后果

从聚类后果能够看到，聚类将所有用户分成了2个聚类后果。

从不同类别的依赖图能够看到，类别10、4、8、6、7、5之间具备较强的相干关系。阐明这几个类别中的变量特色是相似的。上面能够具体看下每个类别中的各个属性的散布的比例。

点击题目查阅往期内容

PYTHON用户散失数据挖掘：建设逻辑回归、XGBOOST、随机森林、决策树、反对向量机、奢侈贝叶斯和KMEANS聚类用户画像

左右滑动查看更多

另外一个聚类中，1、2、9为一个聚类簇，阐明这几类别中的变量特色相似。

同时能够看到每个变量再每个类别中的散布状况

能够看到消费水平很低的样本次要散布在分类10中

从上图能够看到餐饮消费水平较高的类别是1，2,9类别中。

上面能够看到各个分类的剖面图

能够看到每个分类中各个level所占的比例。中餐次要散布在分类1、2中。拍档次要散布在分类6、10中。

年龄的散布也非常明显。大多数散布在26岁左右，分类10的样本年龄最大。同时能够看到分类1 和9 的支出最高，同时他们常去的餐厅类型为中餐。同时能够看到所在城市在分类3中次要是通辽和根河市。他们次要去的餐厅类型是西餐和排档。在分类9中，能够看到医生职业的样本次要去的也是西餐类型。分类1中能够看到，去中餐的样本次要是少了的医生。

而后能够看到总体的分类特色。最常去的餐厅类型为西餐，其次是中餐。年收入最多的区间是51900到67000之间。餐饮生产在10元到18元之间。样本的次要年龄段在20岁到25岁。所在城市次要为根河市，其次是乌兰浩特。样本的职业中，最多的是客服专员。

从每个类别的偏向水平来看，分类1中，次要的样本区的是中餐餐厅。每次的生产在20到30元之间。年收入在8万到12万之间，阐明这些样本的支出较高。其中，行政主管所占的百分比较高。有大量的创意总监。

从每个类别的偏向水平来看，分类1中，次要的样本区的是中餐餐厅。他们所在的城市次要在鄂尔多斯。

从每个类别的偏向水平来看，分类3中，次要的样本支出在3万3到3万6之间。他们的职业次要是文案策动，常去的餐厅为非中餐餐厅。

从每个类别的偏向水平来看，分类4中，次要的样本区的是西餐餐厅。次要的职业为市场总监。

从每个类别的偏向水平来看，分类5中，次要的样本区的是西餐餐厅。次要的职业为电工和电话销售以及老师。

从每个类别的偏向水平来看，分类6中，次要的样本去的是排挡餐厅。次要的职业为学生和服务员及会计师。该群体大部分支出较低或者没有支出。因而每次的餐厅生产也较低。

点击文末 “浏览原文”

获取全文残缺代码数据资料。

本文选自《SQL Server Analysis Services数据挖掘聚类分析职业、地区、餐饮消费水平数据》。

点击题目查阅往期内容

Python对商店数据进行lstm和xgboost销售量工夫序列建模预测剖析
PYTHON集成机器学习：用ADABOOST、决策树、逻辑回归集成模型分类和回归和网格搜寻超参数优化
R语言集成模型：晋升树boosting、随机森林、束缚最小二乘法加权均匀模型交融剖析工夫序列数据
Python对商店数据进行lstm和xgboost销售量工夫序列建模预测剖析
R语言用主成分PCA、逻辑回归、决策树、随机森林剖析心脏病数据并高维可视化
R语言基于树的办法：决策树，随机森林，Bagging，加强树
R语言用逻辑回归、决策树和随机森林对信贷数据集进行分类预测
spss modeler用决策树神经网络预测ST的股票
R语言中应用线性模型、回归决策树主动组合特色因子程度
R语言中自编基尼系数的CART回归决策树的实现
R语言用rle，svm和rpart决策树进行工夫序列预测
python在Scikit-learn中用决策树和随机森林预测NBA获胜者
python中应用scikit-learn和pandas决策树进行iris鸢尾花数据分类建模和穿插验证
R语言里的非线性模型：多项式回归、部分样条、平滑样条、狭义相加模型GAM剖析
R语言用规范最小二乘OLS，狭义相加模型GAM ，样条函数进行逻辑回归LOGISTIC分类
R语言ISLR工资数据进行多项式回归和样条回归剖析
R语言中的多项式回归、部分回归、核平滑和平滑样条回归模型
R语言用泊松Poisson回归、GAM样条曲线模型预测骑自行车者的数量
R语言分位数回归、GAM样条曲线、指数平滑和SARIMA对电力负荷工夫序列预测R语言样条曲线、决策树、Adaboost、梯度晋升(GBM)算法进行回归、分类和动静可视化
如何用R语言在机器学习中建设集成模型？
R语言ARMA-EGARCH模型、集成预测算法对SPX理论稳定率进行预测在python 深度学习Keras中计算神经网络集成模型R语言ARIMA集成模型预测工夫序列剖析R语言基于Bagging分类的逻辑回归(Logistic Regression)、决策树、森林剖析心脏病患者
R语言基于树的办法：决策树，随机森林，Bagging，加强树
R语言基于Bootstrap的线性回归预测置信区间预计办法
R语言应用bootstrap和增量法计算狭义线性模型（GLM）预测置信区间
R语言样条曲线、决策树、Adaboost、梯度晋升(GBM)算法进行回归、分类和动静可视化
Python对商店数据进行lstm和xgboost销售量工夫序列建模预测剖析
R语言随机森林RandomForest、逻辑回归Logisitc预测心脏病数据和可视化剖析
R语言用主成分PCA、逻辑回归、决策树、随机森林剖析心脏病数据并高维可视化
Matlab建设SVM，KNN和奢侈贝叶斯模型分类绘制ROC曲线
matlab应用分位数随机森林（QRF）回归树检测异样值

关于数据挖掘:SQL-Server-Analysis-Services数据挖掘聚类分析职业地区餐饮消费水平数据附代码数据

全文链接：http://tecdat.cn/?p=31887

筹备工作：数据.xls 数据导入数据库中。

将表格命名

商业智能我的项目

查看后果

评论

发表回复取消回复

更多文章

DDN HPC 存储硬件架构设计深度分析

探秘IO500：从Lustre并行文件系统出发，开启HPC存储性能新征程

苹果iOS打包的ipa应用无法安装？一篇文章带你了解可能的原因及排查方法

图解Golang：从零开始实现简易版过期LRU缓存

关于数据挖掘:SQL-Server-Analysis-Services数据挖掘聚类分析职业地区餐饮消费水平数据附代码数据

全文链接：http://tecdat.cn/?p=31887

筹备工作：数据.xls 数据导入数据库中。

将表格命名

商业智能我的项目

查看后果

评论

发表回复 取消回复

更多文章

DDN HPC 存储硬件架构设计深度分析

探秘IO500：从Lustre并行文件系统出发，开启HPC存储性能新征程

苹果iOS打包的ipa应用无法安装？一篇文章带你了解可能的原因及排查方法

图解Golang：从零开始实现简易版过期LRU缓存

发表回复取消回复