1. 随机森林-特征重要性¶
## 参数
名称 |
类型 |
是否必传 |
备注 |
inputarg |
array |
Y |
字段集合 |
inputarg.#.tbname1 |
string |
Y |
表名 |
inputarg.#.labelcol |
string |
Y |
目标特征列 |
inputarg.#.maxdepth |
int |
Y |
最大树深度 |
inputarg.#.mininfogain |
double |
Y |
最小信息收益 |
inputarg.#.impurity |
string |
Y |
计算信息增益的准则,entropy,gini,variance |
inputarg.#.numtrees |
int |
Y |
随机森林树数目 |
inputarg.#.rate |
double |
Y |
设置采样率(0,1] |
inputarg.#.columnArray |
array |
Y |
字段名称集合 |
## 返回
名称 |
类型 |
是否必传 |
备注 |
result |
String |
Y |
所有输出的JSON,按节点类型解析 |
## 算法入口及参数
名称 |
示例 |
备注 |
args[0] |
tmptb2019062511473300088201 |
输入表名 |
args[1] |
sepal_length,sepal_width,petal_length,petal_width |
字段集合 |
args[2] |
result |
目标列 |
args[3] |
6 |
最大树深度 |
args[4] |
0.1 |
最小信息增益 |
args[5] |
gini |
计算信息增益的准则 |
args[6] |
2 |
随机森林树的数量 |
args[7] |
1 |
设置采样率 |
args[8] |
hdfs://namenode:9000/ispatial/sysfile/tmpv2019062605545200088311 |
结果输出地址 |