三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

实验报告二

实验报告二

筛选:设置筛选数据筛选标准

第一步:点击“源”,右击打开“编辑”,将“数据预处理”表格导入;将“输出”中的“表格”拖进显示窗口,连接二者,右击表格,点击“运行”。

第二步:将“字段选项”中的“类型”拖进显示窗口,将“建模”中的“特征选择”拖进显示窗口。

第三步:依“数据预处理”、“类型”、“特征选择”的顺序进行连接,右击“特征选择”,点击“编辑”,点击“字段”,选择“使用定制字段分配”,在“目标”中选择“Class”,在“输入”中选择“全部”,删掉“Class”,点击“应用”。

第四步:右击“Class”,点击“编辑”,点击“模型”。

数据字段重要性程度计算方法的设置:

不同字段的重要性指标计算方法:

目标输入排序方法
分类分类Prarson,似然比,克莱姆系数,Lambda
分类分类和数值Pearson,似然比
数值分类F统计量
数值数值T统计量

第五步:右击“class”,点击“运行”,即可出现黄色光标的“class”,右击黄色光标的“class”,点击“编辑”,即可出现如图所示的表格。

这个代表每个字段重要性的排名(>0.95,<=0.95,<0.9的那一格)

第六步:右击黄色光标的“class”,点击“编辑”,点击“生成”,点击“过滤器”,选择“重要”,点击“应用”。

第七步:将“类型”和“已生成”进行连接,右击“已生成”,点击“编辑”。

“×”代表过滤掉的字段

第八步:右击“已生成”,点击“预览”。

发现已过滤掉两个字段,目前只有15个字段。

← 返回列表