25届日常实习面试 - 数据开发 & 后端开发

字节跳动 - 数据研发 一面(40min)

  • 学过的数据结构,并分别讲下它们的特点
  • 进程和线程的区别
  • TCP和UDP的区别
  • JAVA的面向对象的三大特性,并详细介绍应用场景
  • MySQL的事务隔离级别
  • MySQL的binlog的运用
  • 数据仓库的的特点、数据治理
  • 范式建模、维度建模
  • Hive内外部表的使用场景
  • HQL底层执行逻辑
  • Hive数据存储在哪,分区和分桶的区别
  • Sort by 和 Order by的区别
  • HQL语句运行的很慢,怎么定位到哪个语句 SQL语句:近一个月来,连续三天登录的用户 总结:体验感不好,上来就是八股轰炸,而且问的比较深入
全部评论
uu哪个部门
点赞 回复 分享
发布于 2023-10-13 06:37 上海

相关推荐

1.  简单介绍一下项目2.  在中间层建设中遇到过什么问题3.  数仓中状态的更新是比较及时的,如何记录这些状态,最核心是关心最终的状态还是流转的状态4.  拉链表是什么,怎么实现的,执行过程中怎么解决效率的问题5.  用的什么计算引擎,sql在spark上怎么执行的6.  spark的提交流程7.  uv和pv的含义,计算uv在spark上的运行原理8.  MapReduce的原理,快排的目的是什么,有序的目的是什么,知道每个过程才能知道如何去调优9.  sql转ast是怎么转的10. ast做逻辑执行计划优化做了哪些11. 逻辑执行计划和物理执行计划大概有什么区别12. 写sql过程中有没有遇到过执行时间特别长的,引出数据倾斜相关内容(问的很细,基本所有的都问了)13. 不同数据类型join为什么导致数据倾斜14. mapjoin和正常join的区别,mapjoin原理是什么,怎么实现的15. 加随机数打散,两阶段聚合怎么做的16. new一个线程怎么做,thread和runnable的区别是什么17. java集合类用过哪些(说没怎么用过java,就没再问了)18. sql在不同执行引擎下有什么区别,答有些语法不通用,为什么不通用,如何造成这种问题的19. sql中所有关键字的执行顺序20. a join b where条件写在join里面和join外面 有什么区别21. 4道sql22. 一道mid算法做的是计算引擎调优,一直在问spark底层,顶不住顶不住。当晚挂...
查看20道真题和解析
点赞 评论 收藏
分享
评论
8
43
分享

创作者周榜

更多
牛客网
牛客企业服务