美团数据开发实习面经

26届Java选手,面了很多大厂后端实习基本都挂了,稀里糊涂接了大数据的实习,总体比较顺利,先去沉淀了

9.27
美团数开一面  30min
介绍一个项目
项目中的难点
sql 求每月最大和最少的订单数量
二分查找
面完10分钟打电话约二面

9.30
美团数开二面  50min
介绍两个项目
MySQL 索引
介绍一下Hadoop
HDFS有几个个副本,为什么
深挖Shuffle原理
sql 面试官自己出的 一个表找一下互相关注的人,只能输出一列
算法:复原ip地址

10.8
oc
#打杂的实习你会去吗?# #不给转正的实习,你还去吗# #美团# #大数据# #数据开发# #后端开发#
全部评论
不会是到店吧
1 回复 分享
发布于 10-14 03:06 湖南
base 哪里呀
点赞 回复 分享
发布于 10-11 22:19 北京
望京➕1
点赞 回复 分享
发布于 10-14 18:19 北京
日常实习吗,佬最后去了没有
点赞 回复 分享
发布于 10-26 09:47 北京

相关推荐

数开面试题使用的hive,tez计算引擎1.如何建模、以及数据开发过程中需要注意的问题(数据探查、数据开发、数据质量监测、数据核对)2.页面数据有问题、如何排查3.抽数、推数数据量异常如何自动停止任务(要有工作日、非工作日的判断,非工作日不生效,UDF函数)4.hive表生命周期管理失效,如何进行生命周期管理(设成自动任务的话可能会使用shell脚本)(3个月前每月保留第一天与最后一天的数据,注意是业务时间第一天与最后一天,非调度时间)5.数据量大的表推数慢影响页面展示怎么解决6.根据2个日期计算工作日天数7.去重方式(开窗函数如何控制窗口的大小)8.列转行(清洗、分隔符统一、注意有些业务数据(比如一条数据楼栋面积字段(可能是总面积)对应多个房屋或多个楼栋)、LATERAL VIEW explode)9.明细表数据量大,每月还要都保留一份,怎处理?怎么优化?达梦分区(范围分区、哈希分区、列表分区、组合(多级)分区、间隔分区(属于范围分区)INTERVAL <间隔表达式>)10.更新数据效率更高的方式update采用的类似nested loop的方式,对更新的每一行,都会对查询的表扫描一次;merge into这里选择的是hash join,则针对每张表都是做了一次 full table scan,对每张表都只是扫描一次。11、筛选的时候in(不适合B大)、exists不适合B大)、join的底层以及效率12.常用的分析函数13.连续3天及以上连续出现的次数(减序号) #实习#  #校招#  #大厂#  #数开#  #数仓#
查看13道真题和解析
点赞 评论 收藏
分享
8 18 评论
分享
牛客网
牛客企业服务