阿里国际 研发 4.17 初面

笑死回答问题中途以为我网卡了,我挥了挥手,没想到没卡,面试官看到了,也跟我挥了挥手有点可爱面试官
经典模型应用简单八股 Rag Functioncall MCP 轮轮都问,都快问烂了库库吟唱就对了
1.自我介绍 个人情况
2.AI的项目是什么背景?
3.详细介绍FunctionCall的原理?什么是智能路由开发?
4.怎么实现的记忆功能?说说ZSET相关数据结构和使用场景?
5.知道MCP么,谈谈你的理解
6.RAG怎么理解的?大模型的幻觉是什么?
7.知识库搭建中有什么挑战么?提供的文档有做过处理么?有对数据去进行一些处理么?
8.pgvector的底层存储,存储原理,检索调参有了解么?
9.文生图和图生文是怎么实现的?
10.用了什么大模型,有集群部署么?qps怎么样?
11.网盘项目说说吧,断点续传怎么实现的?
12.多级缓存一致性?canal的原理?多级缓存解决什么问题?
13.讲讲布隆过滤器?
14.AOP的实现原理?
闲聊:
1.具体的业务是什么?Bravo102 实习生计划,海外的电商场景 说有102个项目让我们去选择感兴趣的
2.AI体系下的搜推提效,AI的选品相关,我看你还是对这方面还是比较有经验的
3.笔试做了么?快快做哦 (又是你,笔试,这一次我所失去的,我一定要加倍拿回来!!!!!!#牛客AI配图神器#)
全部评论
你简历中写了ai吗
点赞 回复 分享
发布于 2025-05-17 19:09 陕西
大佬ai相关的知识都是在哪学哒
点赞 回复 分享
发布于 2025-05-14 10:53 浙江
大佬有后续嘛 这个bravo102你投的算是开发岗嘛 感觉ai想关的问的也不少
点赞 回复 分享
发布于 2025-05-02 21:21 黑龙江
Bravo 102 原来是这个意思吗
点赞 回复 分享
发布于 2025-04-21 09:41 北京
ai 八股好多
点赞 回复 分享
发布于 2025-04-18 17:06 浙江

相关推荐

2025-11-20 18:15
山东大学 算法工程师
1.实习介绍2. Lora 原理(核心是低秩分解:将原始权重更新近似为两个低秩矩阵乘积,减少参数量,保留主导方向,训练高效)3.了解 DeepSpeed 吗,ZeRO -1, ZeRO -2和 ZeRO3分别做了哪些优化(1优化优化器状态,2优化梯度,3切分参数,全面节省显存)4. Qwen的模型结构是怎么样的,相比于 LLaMA,DeepSeek 有什么区别(Qwen采用GQA+SwiGLU+RMSNorm,和LLaMA架构非常相似,差异在训练数据和tokenizer中文支持更好;DeepSeek只用MoE/MLA架构,Qwen系列主要是Dense模型)5.怎么缓解大模型的幻觉问题(RAG,RLHF对齐,事实监督)6.大模型的 MoE 结构相比于 Dense 结构训练的难点在什么地方,DeepSeekMoE为什么效果好,有什么值得我们借鉴创新点(MoE面临负载不均衡、训练不稳定问题;DeepSeekMoE通过细粒度专家和共享专家设计提升稳定性和效果)7.知道FP16和BF16有什么区别吗,包括FP32和INT8这些,在训练大模型的时候,应该怎么选择(FP16精度高但易溢出,BF16动态范围大;训练常用BF16混合精度,推理用INT8量化加速)8.讲-下 RLHF 的流程,写-下 PPO和 DPO的 Loss表达式(训练奖励模型后用PPO/DPO优化策略:PPO Loss: policy ratio + KL 约束/ DPO Loss: logit preference diff + sigmoid binary loss)9.对于超长上下文业界一般是怎么做的,你知道 Qwen是怎么做的吗(业界常用ROPE 变体/滑动窗口注意力/稀疏注意力等:Qwen使用YaRN和窗口注意力扩展上下文)10.开放题:你觉得目前大模型的上限在哪里(推理能力、长期记忆、具身交互和能耗效率,需要架构创新和多模态融合突破)11.代码:152.乘积最大子数组
查看9道真题和解析
点赞 评论 收藏
分享
评论
7
35
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务