数据分析面试 - ML(1-SVM)

简介:
- 支持向量机是一种机器学习算法,主要用于分类和回归问题。
- 基于统计理论的结构风险最小化原则,通过寻找最优超平面将数据集划分成不同的类别,让不同类别之间的边界最大化。
- 核心思想:通过寻找最大间隔超平面将数据分成不同的类,同时用kernel function将数据映射到高维空间,以解决非线性分类问题。

优点:
1. 可以处理高维度数据&非线性分类问题
2. 用不同的kernel function适应不同的问题(线性KF- 线性可分问题;高斯KF-非线性可分问题)
3. 对噪声数据的鲁棒性比较强,可以通过设置软间隔来避免过于依赖噪声数据

缺点:
1. 二分类模型,对于多分类需要进行多次训练
2. 对于参数选择和KF选择敏感,要进行反复实验和调整
3. 不适合处理大规模的数据集,需要进行降维度/使用随机采样的方法
4. 不直接给出概率估计,需要使用间接的方法进行概率估计,eg: Platt缩放

对噪声和缺失值敏感:
1. 噪声:对于噪声数据的鲁棒性强,如果噪声数据太多,会影响模型性能,导致过拟合/欠拟合。为了避免过拟合可以使用软间隔来降低对噪声数据的依赖性。
2. 缺失值:svm需要对整个数据集进行训练,如果存在缺失值,就要对缺失值进行处理,否则回影响模型的性能。
全部评论
哪个公司
点赞 回复 分享
发布于 2023-08-27 11:32 广东

相关推荐

10-29 22:30
吉林大学 Java
同专业学长学姐,去互联网大厂的起薪 15k+,去国企 IT 岗的也有 12k+,就连去中小厂的都基本 13k 起步😤 我投的传统行业技术岗,拼死拼活拿到 1Woffer,本来还挺开心,结果逛了圈牛客直接破防,同是校招生,行业差距怎么就这么大啊!
喵喵喵6_6:应该哪里不对吧,大厂都是20k以上的,10k那种对于985本的学生基本就是点击一下过了笔试就送的,我前两天刚拿了一个11k,笔试完第2天就打电话了,非科班。坏消息是c++岗开这么低真是刷新认知了
校招生月薪1W算什么水平
点赞 评论 收藏
分享
09-19 13:59
门头沟学院 Java
用微笑面对困难:Trae一下,如果真成了,他用了直接发字节起诉代码版权,,这个代码不商用是没问题的如果没成也是情理之中的。
点赞 评论 收藏
分享
迷茫的大四🐶:看来已经准备换人了
点赞 评论 收藏
分享
评论
3
28
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务