当前位置: 首页 > 图灵资讯 > 行业资讯> python特征生成中字符类型有哪些?

python特征生成中字符类型有哪些?

来源:图灵python
时间: 2024-09-04 19:55:21

python特征生成中的字符类型截取、字符长度和频次。

一、python特征生成中的字符类型

1、截取

当字符类型的值过多时,通常可以截取字符类型的变量,以减少模型的过拟合。如果具体的家庭住址,可以截取字符串到城市级的粒度。

2、字符长度

统计字符串的长度。例如,在转账场景中,转账信息的字数可以在一定程度上描述转账的类型。

3、频次

在python特征类型中使用字符

1、截取第一个字符串

df['I1_0']=df['I1'].map(lambdax:str(x)[:1])

2、字符长度

df['I1_len']=df['I1'].apply(lambdax:len(str(x)))

display(df.head())

3、字符串频次

df['I1'].value_counts()