导语:
本文主要介绍了关于python特征生成中字符类型有哪些?的相关知识,包括python特征选择,以及c语言转义字符这些编程知识,希望对大家有参考作用。
python特征生成中字符类型有
截取、
字符长度和
频次。
一、python特征生成中字符类型
1、截取
当字符类型的值过多时,通常可以截取字符类型变量,以减少模型的过拟合。例如,可以将特定的家庭住址截取到城市级别的粒度。
2、字符长度
统计字符串长度。例如,在转账场景中,转账消息中的字数可以在一定程度上描述转账的类型。
3、频次
二、python特征类型中字符使用
1、截取第一位字符串
df['I1_0'] = df['I1'].map(lambda x:str(x)[:1])
2、字符长度
df['I1_len'] = df['I1'].apply(lambda x:len(str(x)))
display(df.head())
3、字符串频次
df['I1'].value_counts()
本文为原创文章,版权归知行编程网所有,欢迎分享本文,转载请保留出处!
你可能也喜欢
- ♥ Python脚本如何调用外部命令12/11
- ♥ 如何干净地删除python12/24
- ♥ 如何写一个让python输错3次的函数12/26
- ♥ 如何在python中编写延迟函数08/19
- ♥ python函数接收不同类型的参数10/20
- ♥ 如何在python中打印没有换行符和空格的输出09/24
内容反馈