1.一种孤立树模型建立的方法,其特征在于,所述方法包括:获取多组数据样本,其中,每组数据样本包括多个特征分别对应的特征值,所述多个特征中包括类别型特征;
生成目标孤立树模型的根节点,将所述根节点作为目标父节点,将所述多组数据样本确定为所述目标父节点对应的数据样本;
在所述多个特征中,选取所述目标父节点对应的分割参考特征;
当所述分割参考特征为类别型特征时,在所述目标父节点对应的数据样本中所述分割参考特征对应的各特征值中,选取所述目标父节点对应的分割参考特征值;
生成所述目标父节点对应的第一子节点和第二子节点,将所述目标父节点对应的数据样本中包括所述分割参考特征值的数据样本,作为所述第一子节点对应的数据样本,将所述目标父节点对应的数据样本中不包括所述分割参考特征值的数据样本,作为所述第二子节点对应的数据样本;
确定所述目标父节点的各子节点是否满足作为所述目标孤立树模型的叶节点的预设条件,将满足所述预设条件的子节点确定为所述目标孤立树模型的叶节点,将不满足所述预设条件的子节点作为目标父节点,转至执行在所述多个特征中选取所述目标父节点对应的分割参考特征的处理,如果所述各子节点全部满足作为所述目标孤立树模型的叶节点的预设条件,则将所述各子节点全部确定为目标孤立树模型的叶节点,生成所述目标孤立树模型。
2.根据权利要求1所述的方法,其特征在于,所述获取数据样本集之后,所述方法还包括:
对于每个类别型特征对应的每个特征值,确定包括所述特征值的数据样本的组数,作为所述特征值的频数;
建立并存储类别型特征、特征值和频数之间的对应关系;
所述确定所述目标父节点的各子节点是否满足作为叶节点的预设条件,将满足所述预设条件的子节点确定为所述目标孤立树模型的叶节点,包括:根据所述对应关系,确定所述目标父节点的子节点对应的数据样本包括的所述分割参考特征对应的目标特征值的频数,当所述目标特征值的频数为所述分割参考特征对应的各特征值的频数中的最小值时,将所述目标特征值对应的子节点确定为所述目标孤立树模型的叶节点;
所述方法还包括:
在所述对应关系中,删除所述目标特征值及所述目标特征值的频数。
3.根据权利要求1所述的方法,其特征在于,所述确定所述目标父节点的各子节点是否满足作为叶节点的预设条件,将满足所述预设条件的子节点确定为所述目标孤立树模型的叶节点,包括:
当所述目标父节点的子节点和所述待建立的孤立树模型的根节点之间的节点数,达到预设数值时,将所述目标父节点的子节点确定为所述待建立的孤立树模型的叶节点。
4.根据权利要求1所述的方法,其特征在于,所述确定所述目标父节点的各子节点是否满足作为叶节点的预设条件,将满足所述预设条件的子节点确定为所述目标孤立树模型的叶节点,包括:
当所述目标父节点的子节点只对应一组数据样本时,将所述目标父节点的子节点确定为所述待建立的孤立树模型的叶节点。
5.根据权利要求1-5中任一项所述的方法,其特征在于,所述方法还包括:生成多个孤立树模型,组成孤立森林模型。
6.根据权利要求5所述的方法,其特征在于,所述多组数据样本为多组卡口过车数据,多个特征包括卡口名称、车主年龄、车速,其中,所述卡口名称为类别型特征,所述方法还包括;
将待检测卡口过车数据,输入所述孤立森林模型,确定所述待检测卡口过车数据在所述孤立森林模型中的每个孤立树模型中的路径长度;
基于所述路径长度,确定所述待检测卡口过车数据是否为异常过车数据。
7.一种孤立树模型建立的装置,其特征在于,所述装置包括:获取模块,用于获取多组数据样本,其中,每组数据样本包括多个特征分别对应的特征值,所述多个特征中包括类别型特征;
确定模块,用于生成目标孤立树模型的根节点,将所述根节点作为目标父节点,将所述多组数据样本确定为所述目标父节点对应的数据样本;
选取模块,用于在所述多个特征中,选取所述目标父节点对应的分割参考特征;当所述分割参考特征为类别型特征时,在所述目标父节点对应的数据样本中所述分割参考特征对应的各特征值中,选取所述目标父节点对应的分割参考特征值;
分割模块,用于生成所述目标父节点对应的第一子节点和第二子节点,将所述目标父节点对应的数据样本中包括所述分割参考特征值的数据样本,作为所述第一子节点对应的数据样本,将所述目标父节点对应的数据样本中不包括所述分割参考特征值的数据样本,作为所述第二子节点对应的数据样本;
生成模块,用于确定所述目标父节点的各子节点是否满足作为所述目标孤立树模型的叶节点的预设条件,将满足所述预设条件的子节点确定为所述目标孤立树模型的叶节点,将不满足所述预设条件的子节点作为目标父节点,转至执行在所述多个特征中选取所述目标父节点对应的分割参考特征的处理,如果所述各子节点全部满足作为所述目标孤立树模型的叶节点的预设条件,则将所述各子节点全部确定为目标孤立树模型的叶节点,生成所述目标孤立树模型。
8.根据权利要求7所述的装置,其特征在于,所述装置还包括,建立模块,用于:对于每个类别型特征对应的每个特征值,确定包括所述特征值的数据样本的组数,作为所述特征值的频数;
建立并存储类别型特征、特征值和频数之间的对应关系;
所述生成模块,用于:
根据所述对应关系,确定所述目标父节点的子节点对应的数据样本包括的所述分割参考特征对应的目标特征值的频数,当所述目标特征值的频数为所述分割参考特征对应的各特征值的频数中的最小值时,将所述目标特征值对应的子节点确定为所述目标孤立树模型的叶节点;
所述装置还包括,删除模块,用于:在所述对应关系中,删除所述目标特征值及所述目标特征值的频数。
9.根据权利要求7所述的装置,其特征在于,所述生成模块,用于:当所述目标父节点的子节点和所述待建立的孤立树模型的根节点之间的节点数,达到预设数值时,将所述目标父节点的子节点确定为所述待建立的孤立树模型的叶节点。
10.根据权利要求7所述的装置,其特征在于,所述生成模块,用于:当所述目标父节点的子节点只对应一组数据样本时,将所述目标父节点的子节点确定为所述待建立的孤立树模型的叶节点。
11.根据权利要求7-5中任一项所述的装置,其特征在于,所述装置还包括:组成模块,用于生成多个孤立树模型,组成孤立森林模型。
12.根据权利要求11所述的装置,其特征在于,所述多组数据样本为多组卡口过车数据,多个特征包括卡口名称、车主年龄、车速,其中,所述卡口名称为类别型特征,所述装置还包括;
检测模块,用于将待检测卡口过车数据,输入所述孤立森林模型,确定所述待检测卡口过车数据在所述孤立森林模型中的每个孤立树模型中的路径长度;
基于所述路径长度,确定所述待检测卡口过车数据是否为异常过车数据。