腾讯-混元大模型面经-华5硕-附内推链接

需要内推码的可以用下面这个链接:
内推链接:https://join.qq.com/resume.html?k=ANQI6RfQ3rhPS2dpyIkeSw
#26届实习##大模型##八股##面经##腾讯##内推#

腾讯-混元大模型面经-华5硕

部门与岗位:TEG - 混元大模型团队 - 大模型对齐
一面
自我介绍,过实习,讲论文,论文过的比较细,有说的笼统的地方面试官会实时进行询问交流
了解哪些大模型,简要挑一两个介绍一下,当时说了 Qwen 和 DeepSeek,然后面试官又问了这两个有什么区别
接着上一问,为什么大家都开始探索 MoE 架构,MoE 相比 Dense 有什么好处
在之前实习的时候用 LoRA 微调过 Qwen,于是问了有没有全量微调过,有没有对比过两者的性能表现
讲一下大模型训练和推理的流程,SFT 和 RLHF 的作用分别是什么
在 RLHF 中,目前主流的强化学习算法有哪几个,写一下损失函数的表达式
代码:22. 括号生成
代码:多头自注意力
一面问的八股还是比较多的,问的也比较细,而且还写了两道代码题,整个面试花的时间也比较多,大概一个半小时左右
二面
自我介绍,过实习和论文,面试官会一起进行探讨,包括工作的动机、贡献和结果,也会提一些问题和建议
之前实习用 DeepSpeed 微调过 Qwen2-72B,于是面试官问了 ZeRO-1,ZeRO-2,ZeRO-3 三个模式的区别
当时你用 DeepSpeed ZeRO-3 来微调 Qwen2-72B,每一张卡占用的显存大概是多少,估算一下为什么是占这么多的显存

除了 DeepSpeed,还用过其他的什么优化方法吗
我看你也用到了 LoRA,知道 LoRA 的原理吗,A 和 B 两个矩阵怎么初始化,有了解过其他的初始化方法吗
对 RLHF 了解的多吗
代码:3. 无重复字符的最长子串
二面更多的是结合具体的工作来问的,从用到的东西来引出问题,问的也比较灵活。当然因为部门主要是做对齐的,所以也大概聊了聊 RLHF
三面
自我介绍,挑一个觉得做的比较好的论文和实习讲一下,面试官问的比较详细,为什么选现在这种方案,为什么 work,其他方案有考虑吗
在微调 Qwen 的时候,数据是怎么构造的,有用到什么数据清洗方法吗,数据配比是怎么做的
讲一下 RLHF 的流程,之前有用 RLHF 做过模型对齐吗
在做对齐的时候,为什么 SFT 之后还要做 RLHF,只用 SFT 可以吗
知道哪些强化学习算法,除了 PPO 和 DPO 这些呢,DeepSeek 用的 GRPO 相比于 GPT 的 PPO 做了哪些改进
开放题:对目前大模型的发展有什么看法
代码:零钱的两个题 322. 零钱兑换518. 零钱兑换 II
三面面试官更聚焦于对齐这一块的内容,考的比较深。由于之前没有接触过强化学习,答得还是比较吃力的,不过面试官还挺好的,会一起讨论来做引导
四面
自我介绍,过论文和实习,问的也比较细,这里能明显的感受出来面试官的视角更系统,会把这些工作串起来问我看你简历上没写 RLHF,平常有用过 RLHF 吗
推导一下神经网络反向传播的过程一道排列组合的概率题
开放题:你觉得大模型目前还有哪些可以改进的点
四面整体更看重思维和基础,没有考察什么八股
总结
一共四轮技术面,整体来说强度比较大,对于大模型八股的考察比较细,对大模型的理解问的也比较深刻,包括一些数理逻辑基础,考察的比较全面
全部评论

相关推荐

2024-06-08,投递简历:提前批-机械结构工程师2024-06-30,专业笔试:使用的牛客题库,20道选择题+2道简答题,考察范围包括机设、机原、材料、力学、工艺等2024-07-24,HR面试邀约2024-08-02,HR面试,腾讯会议,约20min。面试流程如下:    1. 自我介绍    2. 人事问答:    (1)你的研究方向?你们课题组的研究方向有哪些?    (2)分工?    (3)项目简述:项目背景?解决什么问题?你做了哪些工作?结构怎样设计的?工作过程中有探索性学习?动手实践吗?项目进展?    (4)实验室有多少人?    (5)博士有吗?    (6)做项目会有老师或者博士师兄师姐指导?    (7)往届师兄他们毕业的去向?就业方向?    (8)有投递其他公司的提前批或者暑期实习?投了哪些公司?投的什么岗位?到什么流程了?    (9)期望薪资?    (10)选择企业考量的因素?    (11)谈谈对公司的了解?    (12)通过什么途径了解到我们公司?    (13)我们公司哪些方面比较吸引你?    (14)平时一些运动爱好吗?3. 反问:    (1)面试流程?(一面HR面,二面技术面,三面综合面,发意向书,座谈,谈薪,签约)    (2)今年hc有多少?(只说了公司业绩在成倍增长,招聘人数也在扩张)待遇:和官方一样(很不错了),包住宿,下午茶常供 刚入职那几天,mentor就给了一筐竞品和运动手表让熟悉熟悉hhh,总价值约5位数的东西就粗暴地给一个实习生了hhh 工作强度:看部门而定。我的mentor小姐姐人很好,从来不push,很多事给了我们足够的空间和商量的余地 -🎈为什么要去韶音实习?1.自己是运动女孩er,也很喜欢跑马,对于运动可穿戴本来就很感兴趣2.韶音增长势头很猛,自己希望体会下小而精的公司的扁平化氛围3.听说韶音work life balance ,想去看看是否属实4.从好朋友那打听到实习氛围确实不错5.岗位是目标岗位,工资不错,还包住 由于当时自己没有打算把职业选择all in互联网,所以也没有随大流去互联网行业 -🎈实习体验如何? 结果基本符合上述预期,公司真的不太加班,研发中心6点就走了至少70%的人了hhh 而且公司的运动俱乐部是真的精英化!!! 具体其他细节根据岗位和带教不同有所出入,在此不做分享,意义不大 -🎈学到了什么? 产品从0-1需要验证和探索的东西往往比从1-1.5还多而杂 产品、用研都不是所谓高大上的工作,需要处理很多细节和验证各种需求,更应该脚踏实地 占领一片蓝海领域的背后,是多年来的耕耘和积累,以及正确战略的引导全球运动耳机销量第一!骨传导耳机领导者!一路领先,等你加入! 国家级专精特新重点小巨人,近7年100%营收增速,高速发展中的企业!⏰ 我们倡导工作生活平衡,拒绝996!!【多领域招才,与你同行】研究类、开发类、产品类、工程技术类、供应链运营类、营销运营类、品质管理类、设计策划类、职能类、IT类【立即投递,内推助力】https://app.mokahr.com/m/campus-recruitment/aftershokzhr/36940?recommendCode=DSe1vF9A&hash=%23%2Fjobs#/jobs【内推码】DSe1vF9A(内推简历优先筛选,抓紧投递,有25届补招和26届实习!) #春招#                                                                 #内推#                                                                 #内推码#                                       【工作地点】深圳,部分岗位全国分布投递的uu评论一下姓名缩写加岗位(HFG+产品经理),我会尽力跟进~ #内推码#               #春招#               #校招#               #内推#        
点赞 评论 收藏
分享
评论
2
3
分享

创作者周榜

更多
牛客网
牛客企业服务