news 2026/4/30 22:32:25

机器学习-特征工程

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
机器学习-特征工程

可以增加,减少,转换特征

特征选择:(减少)

定义一个标准,选择与目标变量最密切的特征,剔除冗余无关的特征

过滤法:基于某种标准评估该特征重要性(卡方检验,相关系数,信息增益,低方差过滤法)

包裹法:在模型训练过程中进行特征选择,每次模型迭代就进行特征筛除

(特征干扰法:给一些特征加上一些相同噪声进行干扰,如果模型越差说明该特征越重要,影响越小或者模型反而更加好之后,说明该特征重要性越小或者呈现反作用)

嵌入法:利用模型本身的特征选择机制决策树L1正则化

特征转换:(转换)

对数据进行数学或者统计处理

归一化:把特征缩放到一个特定范围内(0~1之间),适用于KNN,SVM

标准化:将特征值减去均值除以标准差,是特征的分布具有均值0,标准差1(标准正态分布),只是将原有的分布转换为了标准分布

对数变换:针对有偏态的分布,原有数据差别特别大,比如1万和1亿,此时取10为底的对数,得到的结果为4和8,差别变小了很多

类别变量的编码

独热编码:将类别型变量映射为二进制序列,常用于无序类别特征

标签编码:将类别型变量映射为整数,常用于有序类别特征

目标编码:换成平均数

频率编码:换成出现次数

特征构造:(增加)

通过组合,转换,聚合现有特征,形成能够更好反映数据规律的特征

交互特征:乘积,和,差之类的

统计特征:算平均数,方差,最大最小值

日期和时间特征:收集如周几,某月,节假日等特征

特征降维(与特征选择类似):(减少)

做出特征转换,提取出本质和重要的再删减

降低特征数量,减少计算复杂度,并且保持数据本质

主成分分析PCA

通过线性变换,将原始特征映射到一个新的空间,使得新的特征尽可能保留原数据方差

线性判别分析LDA,t-SNE,自编码器等等

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/4/30 22:29:30

海康设备型号代码(H5/H7/KT2/G5)在Python/Node.js项目中的自动化处理技巧

海康设备型号代码(H5/H7/KT2/G5)在Python/Node.js项目中的自动化处理技巧 在安防系统开发和设备管理平台构建中,海康设备的型号代码处理是个高频需求。当项目需要对接上百台不同型号的设备时,如何优雅地处理这些型号标识符&#x…

作者头像 李华
网站建设 2026/4/30 22:28:02

创建自定义属性模板及高版本向低版本兼容——SolidWorks

文章目录创建自定义属性模板及高版本向低版本兼容创建自定义属性模板新旧模板修兼容问题:The template file being opened is created in a newer version of....(您正在打开的模板文件是由**更高版本的属性选项卡生成器**创建的。并非所有新功能都能被当前版本支持…

作者头像 李华
网站建设 2026/4/30 22:27:37

以平常心观AI,以主动力赴时

当自媒体博主用AI分析竹林土壤找到春笋,当海外侨胞借助AI解读模糊碑文寻根圆梦,当职场人用AI梳理工作思路、普通人用AI挑选榴莲,人工智能早已走出实验室,融入烟火日常。如今,AI不再是科幻电影中的遥远概念,…

作者头像 李华