暑期offer求建议

投票
#饿了么#  #字节实习#  #腾讯音乐26届实习# 后台开发,目前几个oc或在流程的公司如下,希望各位牛友给些建议

字节:广告业务,已oc。优点是业务核心,0 landing成本;缺点就是转正率不好说

饿了么:物流团队,做骑手调度的,目前hr面结束。优点是业务核心;缺点是饿了么前景一般

TME:qq音乐,目前有第三轮技术面没面。优点是业务核心,团队氛围好,公司wlb;缺点是现在还在流程中,有变数

蚂蚁:平台技术事业群,应该是做整个企业基础设施的建设,hr流程可以选团队,目前已进入hr流程,基本等于有offer。蚂蚁这个业务感觉比较tob,我意向一般。

阿里控股-达摩院:做一些ai产品的研发,目前刚面完三面,表现不错,能进hr面应该问题不大。优点是阿里转正率一般都不错,做ai产品的方向也比较顺应潮流;缺点是这个ai产品不一定完全是大模型,可能还有一些cv等方向。

美团:核心本地商业,做外卖自取商家端,目前有第二轮技术面没面。优点是美团转正率比较高,缺点是感觉业务一般。

我目前首选是tme,但是还有第三轮技术面要面,仍有变数,可能考虑先接一个offer,还是希望在转正率,业务前景等方向上去做考虑,希望各位牛油们能给一些建议,感谢大家
全部评论
佬最后去哪了
点赞 回复 分享
发布于 2025-10-31 15:52 北京
tme的转正率听hr说还可以
点赞 回复 分享
发布于 2025-04-20 18:58 广东
羡慕打牌
点赞 回复 分享
发布于 2025-04-14 22:28 北京
经典打牌
点赞 回复 分享
发布于 2025-04-14 21:12 北京

相关推荐

2025-11-20 18:15
山东大学 算法工程师
1.实习介绍2. Lora 原理(核心是低秩分解:将原始权重更新近似为两个低秩矩阵乘积,减少参数量,保留主导方向,训练高效)3.了解 DeepSpeed 吗,ZeRO -1, ZeRO -2和 ZeRO3分别做了哪些优化(1优化优化器状态,2优化梯度,3切分参数,全面节省显存)4. Qwen的模型结构是怎么样的,相比于 LLaMA,DeepSeek 有什么区别(Qwen采用GQA+SwiGLU+RMSNorm,和LLaMA架构非常相似,差异在训练数据和tokenizer中文支持更好;DeepSeek只用MoE/MLA架构,Qwen系列主要是Dense模型)5.怎么缓解大模型的幻觉问题(RAG,RLHF对齐,事实监督)6.大模型的 MoE 结构相比于 Dense 结构训练的难点在什么地方,DeepSeekMoE为什么效果好,有什么值得我们借鉴创新点(MoE面临负载不均衡、训练不稳定问题;DeepSeekMoE通过细粒度专家和共享专家设计提升稳定性和效果)7.知道FP16和BF16有什么区别吗,包括FP32和INT8这些,在训练大模型的时候,应该怎么选择(FP16精度高但易溢出,BF16动态范围大;训练常用BF16混合精度,推理用INT8量化加速)8.讲-下 RLHF 的流程,写-下 PPO和 DPO的 Loss表达式(训练奖励模型后用PPO/DPO优化策略:PPO Loss: policy ratio + KL 约束/ DPO Loss: logit preference diff + sigmoid binary loss)9.对于超长上下文业界一般是怎么做的,你知道 Qwen是怎么做的吗(业界常用ROPE 变体/滑动窗口注意力/稀疏注意力等:Qwen使用YaRN和窗口注意力扩展上下文)10.开放题:你觉得目前大模型的上限在哪里(推理能力、长期记忆、具身交互和能耗效率,需要架构创新和多模态融合突破)11.代码:152.乘积最大子数组
查看9道真题和解析
点赞 评论 收藏
分享
评论
2
3
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务