字节面试-大数据开发实习

视频ms

前三分钟 自我介绍
数据仓库的了解
怎样设计数据分层
了解的大数据组件
spark用于解决什么问题
spark底层逻辑
sql的join实现方式
举例A(3) join B (5) 有几条数据
join底层逻辑
sql题 查询用户峰值

全程不到30分钟 **我就是一个小菜鸡。问就是面试凉凉 问的其实感觉没有特别难 但就是啥都不会。还是学的太过浅层次。总的来说 项目拷打 底层深挖。G
全部评论
这边有群友提供的面试资料可以看看,语兴小灶数据面试汇总https://oxtwry26ao.feishu.cn/mindnotes/bmncnvd5ZN4z5Rpaf5A6MQN79Rh
4 回复 分享
发布于 2023-08-04 15:08 浙江
这。。。有时间还是多看下面试题
1 回复 分享
发布于 2023-08-02 23:19 湖南
挺简单的
点赞 回复 分享
发布于 2023-08-07 15:34 上海
请问是社招的问题吗
点赞 回复 分享
发布于 2023-08-09 12:43 上海

相关推荐

02-22 23:29
已编辑
门头沟学院 数据分析师
大家保险子公司大家信科 数据仓库 11.3k*15 双非统计学硕士
点赞 评论 收藏
分享
1.  简单介绍一下项目2.  在中间层建设中遇到过什么问题3.  数仓中状态的更新是比较及时的,如何记录这些状态,最核心是关心最终的状态还是流转的状态4.  拉链表是什么,怎么实现的,执行过程中怎么解决效率的问题5.  用的什么计算引擎,sql在spark上怎么执行的6.  spark的提交流程7.  uv和pv的含义,计算uv在spark上的运行原理8.  MapReduce的原理,快排的目的是什么,有序的目的是什么,知道每个过程才能知道如何去调优9.  sql转ast是怎么转的10. ast做逻辑执行计划优化做了哪些11. 逻辑执行计划和物理执行计划大概有什么区别12. 写sql过程中有没有遇到过执行时间特别长的,引出数据倾斜相关内容(问的很细,基本所有的都问了)13. 不同数据类型join为什么导致数据倾斜14. mapjoin和正常join的区别,mapjoin原理是什么,怎么实现的15. 加随机数打散,两阶段聚合怎么做的16. new一个线程怎么做,thread和runnable的区别是什么17. java集合类用过哪些(说没怎么用过java,就没再问了)18. sql在不同执行引擎下有什么区别,答有些语法不通用,为什么不通用,如何造成这种问题的19. sql中所有关键字的执行顺序20. a join b where条件写在join里面和join外面 有什么区别21. 4道sql22. 一道mid算法做的是计算引擎调优,一直在问spark底层,顶不住顶不住。当晚挂...
查看20道真题和解析
点赞 评论 收藏
分享
评论
14
87
分享

创作者周榜

更多
牛客网
牛客企业服务