美团数据一面凉经

面了很久,有100分钟,面试官很认真。
介绍项目
MR的shuffle流程
数据倾斜怎么处理,实际处理过数据倾斜吗(我特老实,我说我没有)
spark的宽窄依赖,为什么要划分stage
抽象类和接口的区别
hive的四种排序(简历也没写hive,为啥逮着我问)
问了mysql相关
我简历上所有的组件问了个遍,redis spring druid mybatis,可我当时没准备,就没答出来。。。
设计模式,我巴拉巴拉了一通单例,面试官直接让我说工厂和建造者的区别,不知道建造者。。。
做数据处理最深的感受
项目遇到的困难怎么解决的
两道编程题:一道滑动窗口的,一道sql的。我sql不熟练,面试官还帮我改sql,真是个好人。

总结:
面试官人真的很好,很耐心,很感谢他,我学到了很多东西。
全部评论
这是什么岗位的面试?
1 回复 分享
发布于 2023-05-10 10:57 山东
面试官大概有几个?
点赞 回复 分享
发布于 2023-05-10 10:48 甘肃
这是大数据开发?
点赞 回复 分享
发布于 2023-05-12 17:37 上海

相关推荐

1.  简单介绍一下项目2.  在中间层建设中遇到过什么问题3.  数仓中状态的更新是比较及时的,如何记录这些状态,最核心是关心最终的状态还是流转的状态4.  拉链表是什么,怎么实现的,执行过程中怎么解决效率的问题5.  用的什么计算引擎,sql在spark上怎么执行的6.  spark的提交流程7.  uv和pv的含义,计算uv在spark上的运行原理8.  MapReduce的原理,快排的目的是什么,有序的目的是什么,知道每个过程才能知道如何去调优9.  sql转ast是怎么转的10. ast做逻辑执行计划优化做了哪些11. 逻辑执行计划和物理执行计划大概有什么区别12. 写sql过程中有没有遇到过执行时间特别长的,引出数据倾斜相关内容(问的很细,基本所有的都问了)13. 不同数据类型join为什么导致数据倾斜14. mapjoin和正常join的区别,mapjoin原理是什么,怎么实现的15. 加随机数打散,两阶段聚合怎么做的16. new一个线程怎么做,thread和runnable的区别是什么17. java集合类用过哪些(说没怎么用过java,就没再问了)18. sql在不同执行引擎下有什么区别,答有些语法不通用,为什么不通用,如何造成这种问题的19. sql中所有关键字的执行顺序20. a join b where条件写在join里面和join外面 有什么区别21. 4道sql22. 一道mid算法做的是计算引擎调优,一直在问spark底层,顶不住顶不住。当晚挂...
查看20道真题和解析
点赞 评论 收藏
分享
查看53道真题和解析
点赞 评论 收藏
分享
评论
2
7
分享

创作者周榜

更多
牛客网
牛客企业服务