数据分析面试 - ML(1-SVM)

简介:
- 支持向量机是一种机器学习算法,主要用于分类和回归问题。
- 基于统计理论的结构风险最小化原则,通过寻找最优超平面将数据集划分成不同的类别,让不同类别之间的边界最大化。
- 核心思想:通过寻找最大间隔超平面将数据分成不同的类,同时用kernel function将数据映射到高维空间,以解决非线性分类问题。

优点:
1. 可以处理高维度数据&非线性分类问题
2. 用不同的kernel function适应不同的问题(线性KF- 线性可分问题;高斯KF-非线性可分问题)
3. 对噪声数据的鲁棒性比较强,可以通过设置软间隔来避免过于依赖噪声数据

缺点:
1. 二分类模型,对于多分类需要进行多次训练
2. 对于参数选择和KF选择敏感,要进行反复实验和调整
3. 不适合处理大规模的数据集,需要进行降维度/使用随机采样的方法
4. 不直接给出概率估计,需要使用间接的方法进行概率估计,eg: Platt缩放

对噪声和缺失值敏感:
1. 噪声:对于噪声数据的鲁棒性强,如果噪声数据太多,会影响模型性能,导致过拟合/欠拟合。为了避免过拟合可以使用软间隔来降低对噪声数据的依赖性。
2. 缺失值:svm需要对整个数据集进行训练,如果存在缺失值,就要对缺失值进行处理,否则回影响模型的性能。
全部评论
哪个公司
点赞 回复 分享
发布于 2023-08-27 11:32 广东

相关推荐

UtopianYou...:这个简历排版真的不太行哦,去找免费的或者花点小钱,把排版弄整齐一点吧,看着舒服。
点赞 评论 收藏
分享
评论
3
28
分享

创作者周榜

更多
正在热议
更多
# 春招至今,你的战绩如何? #
10869次浏览 93人参与
# 你的实习产出是真实的还是包装的? #
1932次浏览 42人参与
# 巨人网络春招 #
11358次浏览 223人参与
# 军工所铁饭碗 vs 互联网高薪资,你会选谁 #
7605次浏览 43人参与
# 简历第一个项目做什么 #
31715次浏览 338人参与
# 重来一次,我还会选择这个专业吗 #
433498次浏览 3926人参与
# 米连集团26产品管培生项目 #
5999次浏览 216人参与
# 当下环境,你会继续卷互联网,还是看其他行业机会 #
187171次浏览 1122人参与
# 牛客AI文生图 #
21442次浏览 238人参与
# 不考虑薪资和职业,你最想做什么工作呢? #
152410次浏览 888人参与
# 研究所笔面经互助 #
118938次浏览 577人参与
# 简历中的项目经历要怎么写? #
310283次浏览 4216人参与
# AI时代,哪些岗位最容易被淘汰 #
63707次浏览 826人参与
# 面试紧张时你会有什么表现? #
30507次浏览 188人参与
# 你今年的平均薪资是多少? #
213108次浏览 1039人参与
# 你怎么看待AI面试 #
180081次浏览 1258人参与
# 高学历就一定能找到好工作吗? #
64329次浏览 620人参与
# 你最满意的offer薪资是哪家公司? #
76513次浏览 374人参与
# 我的求职精神状态 #
448102次浏览 3129人参与
# 正在春招的你,也参与了去年秋招吗? #
363440次浏览 2638人参与
# 腾讯音乐求职进展汇总 #
160661次浏览 1112人参与
# 校招笔试 #
471038次浏览 2964人参与
牛客网
牛客网在线编程
牛客网题解
牛客企业服务