《机器学习高频面试题详解》1.2:逻辑回归(上)

前言

大家好,我是鬼仔。今天带来《机器学习高频面试题详解》专栏第1.2节:逻辑回归,因为内容比较多,所以本节分为了上下两篇。鬼仔希望写的每篇专栏文章能够将一个知识点讲透、讲深,也希望读者能从鬼仔的文章中有所收获。

欢迎大家订阅该专栏,目前这篇是试读,后续的文章需要订阅才能查看哦(每周一更/两更),专栏预计更新30篇文章(只增不减),具体内容可以看专栏介绍,大家的支持是鬼仔更新的动力!

一、原理

1. 线性回归模型

(1)讲到逻辑回归,我们首先要先了解线性回归模型。

线性回归模型假设输入特征和输出结果满足线性关系:,此时的是连续值,所以是回归模型。如果想要转化为分类模型,那么需要将做一次函数变换,令的值在某个特定区间的时候属于特定类别即可,逻辑回归模型的出发点即来源于此。

(2)线性回归模型经过最⼤似然估计推导出来的待优化⽬标函数与平⽅损失函数是等价的。

(3)为了解决过拟合问题,线性回归模型可以引入正则化的方法:

  • 岭回归

加入L2正则项,等价于对参数w引入协方差为a的零均值高斯先验,不能做variable selection。

  • LASSO回归

加入L1正则项,等价于对参数w引入拉普拉斯先验,可以做variable selection。

2. 逻辑回归模型

逻辑回归是一种常见的用于分类的模型,虽然是分类模型,但原理上还是和回归紧密相关。

一句话总结逻辑回归模型:先把特征线性组合,然后使用sigmoid函数(单调可微)将结果约束到0~1之间,结果用于二分类预测。

  • 模型参数估计:最大似然估计法估计模型参数,使用梯度下降或者拟牛顿法进行学习。
    • 损失函数:最小化交叉熵误差(等价于最大似然估计)。
  • 防止过拟合:L1正则化和L2正则化。
  • 处理非线性数据:加核函数或特征变换,显式地把特征映射到高维空间。

二、面试真题

1. 逻辑回归怎么实现多分类?

传统的逻辑回归是二分类模型,但很容易推广到多分类任务上,具体有两大类做法:

  • 修改逻辑回归的损失函数:sigmoid->softmax;
  • 不妨把这个问题抽象为:二分类模型怎么实现多分类任务?将多分类任务分解为多个二分类任务即可!

下面稍微展开讲解下:

(1)修改逻辑回归的损失函数

sigmoid函数只能输出两种类别的概率,要想输出多种类别的预测概率,我们需要将损失函数修改为softmax,具体公式如下:

sigmoid中的参数θ是一个向量,而softmax将参数θ拓展成了一个矩阵,矩阵中每一行向量为对应类别的参数,输出的数表示该类别的预测概率,总和为1。也即,将一个样本输入到softmax回归模型中,会输出不同类别对应的预测概率,最后取概率最高的类别作为预测结果。

(2)将多分类任务分解为多个二分类任务

具体的分解方法有以下三类:

  • OvR(One vs Rest)

每次将一个类别样本作为正类,其他类别样本统一作为负类,这样 N 个类别可以生成 N 个二分类器,输入一个测试数据会

剩余60%内容,订阅专栏后可继续查看/也可单篇购买

机器学习高频面试题详解 文章被收录于专栏

专栏作者曾在校招期间拿到包括字节、微信和华为等多家大厂的SSP offer,该专栏主要是为了帮助同学们系统性地学习和掌握机器学习中的基础知识。专栏详细地整理了各大厂的算法岗面经,力争深入浅出地讲解重要知识点,适合人群为准备校招或者实习,且目标岗位为算法岗、数据挖掘岗或者数据分析岗的同学。

全部评论
最后一个的意思是 逻辑回归只能处理离散特征?
点赞 回复 分享
发布于 2022-10-31 13:42 北京
最后一个问题, 是不是等价于 "对特征作离散化的好处?"
点赞 回复 分享
发布于 2023-09-12 16:49 福建

相关推荐

不愿透露姓名的神秘牛友
09-28 20:50
投递中兴通讯等公司10个岗位 > 你都收到了哪些公司的感谢信?
点赞 评论 收藏
分享
一面:自我介绍面试分为Unity相关知识:1.对Unity了解多少?2.Unity开发有多久的经验?3.Unity的生命周期,及每个部分的作用4.如何控制脚本的执行顺序?5.为什么物理效果放到FixedUpdate里面去运行?6.动画状态机中有哪些组件,以及如何使用7.如何去实现分层的动画效果?8.遮罩有哪些属性?9.用动画机实现八方向的移动10.物理碰撞有哪些接口11.rigedBody需要怎么挂才能生效?C#相关:1.GC的简要原理以及如何使用?2.怎么防止过渡的GC产生?3.怎么去设计一个对象池?(用具体的程序逻辑、数据结构、对外提供哪些接口)项目经历:1.在3D空间下怎么描述点A到点B做的矩阵变换2.点积和叉乘的几何意义3.摄像机的右前方有个敌人,怎么用点积和叉乘去计算敌人和摄像机的垂直距离4.角色移动的移动方程怎么写?5.Unity有多少种方式去实现角色移动?6.不使用方法,手动实现角色的移动(口述公式)7.加载配置文件的流程(数据持久化)数据结构:1.链表和数组的应用与区别2.双向链表与循环链表的原理1.指针与指针数组的应用与区别游戏经历:1.平时学习与如何去驱动自己的进步2.平时有去破解游戏查看源码吗?3.有去复刻游戏的玩法吗(举个例子)无二面北京水泠喵主问项目和技术没问八股会shader,lua的可以投一下【内推链接】https://join.xmfunny.com/【内推码】NTA7ULy(内推简历优先筛选)「关于真有趣」真有趣(So Funny)成立于 2012 年,秉承着 “创作长期有效的快乐,赢得百万人热爱” 的愿景驱动,致力于为全球用户提供健康有趣的游戏体验。目前,已推出《香肠派对》、《不休的乌拉拉》、《仙侠道》等 9 款游戏,累计服务超 2 亿用户。「在这里,你的日常体验是」◇  1 对 1 导师,伴你丝滑融入职场生活◇  培训、沙龙、技术月刊等多种成长补给,助你快速成长◇  简单纯粹的工作氛围,贴心的福利关怀,让你健康快乐米哈游地工作与生活「校招岗位」初级Unity3D工程师、Unity3D工程师(不休的乌拉拉)、服务端工程师、系统策划(不休的乌拉拉)、游戏设计师(萌宠肉鸽)、玩法策划(夺金射击)、技术美术(动画向)、原画设计师、场景原画设计师、AIGC设计师、初级数据分析师(香肠派对)「如何加入真有趣」◇  招聘对象:2025 届毕业生◇  工作地点:厦门【内推链接】https://join.xmfunny.com/【内推码】NTA7ULy(内推简历优先筛选)投递的uu留下姓名和岗位~
真有趣游戏
|
校招
|
超多精选岗位
点赞 评论 收藏
分享
46 124 评论
分享
牛客网
牛客企业服务