SQL面试常考十大问题之留存问题【最简单的解题思路】

推荐阅读文章列表

大数据开发面经汇总【持续更新...】

我的大数据学习之路

大数据开发面试笔记V6.0

SQL题目

来自字节、阿里、腾讯、pdd等数据研发一面二面

  • 有一张用户登录日志表ods_usr_login_log, 包含user_id(用户id)、login_dt(登录日期),一个用户当天可能登录多次
  • 问题:计算存在新用户登录的日期的次日留存率以及3日留存率
    • N日留存用户数:某日活跃的用户在之后的第N日活跃用户数

答案解析

模拟数据

INSERT INTO ods_usr_login_log VALUES 
('001','20240701'),
('001','20240701'),
('002','20240701'),
('003','20240701'),
('001','20240702'),
('002','20240702'),
('002','20240702'),
('001','20240703'),
('002','20240704'),
('004','20240704')
;

alt

思路分析

  1. 首先按照用户和登录日期进行去重,因为每个用户在当天可能登录多次
  2. 题干要求是有新用户登录,等价于求用户的首次登录日期
  3. 如果用户登录时间和用户首次登录时间相差N天即为N日留存用户

具体代码

with t1 as (
    select user_id, cast(min(login_dt) as date) as dt
    from ods_usr_login_log
    group by user_id
),
t2 as (
    select user_id, cast(login_dt as date) as dt
    from ods_usr_login_log
    group by user_id, cast(login_dt as date) 
)
select 
    t1.dt
    ,count(distinct case when datediff(t2.dt, t1.dt) = 1 then t2.user_id else null end) / count(distinct t1.user_id) as retain_1d_rate
    ,count(distinct case when datediff(t2.dt, t1.dt) = 3 then t2.user_id else null end) / count(distinct t1.user_id) as retain_3d_rate
from t1
left join t2
on t1.user_id = t2.user_id
group by t1.dt
;

alt

#数据人的面试交流地##校招过来人的经验分享##sql##数据库#
全部评论
感谢分享
1 回复 分享
发布于 2024-08-29 23:55 黑龙江
这样对吗 select login_dt ,count(case when datediff(next_day,login_dt)=1 then 1 else null)/count(distinct user_id) as next_rate ,count(case when datediff(next_day,login_dt)=2 then 1 else null)/count(distinct user_id) as 3_rate FROM( select user_id ,login_dt ,lead(login_dt,1,'9999-12-31')over(partition by user_id order by login_dt) as next_day ,lead(login_dt,2,'9999-12-31')over(partition by user_id order by login_dt) as 3_day ,row_number()over(partition by user_id order by login_dt) as rn from ( select distinct user_id ,cast(login_dt as date) as login_dt from ods_usr_login_log ) as t1 where rn = 1 ) t2 group by login_dt ;
点赞 回复 分享
发布于 2024-08-03 20:42 河北
这题窗口函数也可以实现好像
点赞 回复 分享
发布于 2024-08-02 17:55 北京

相关推荐

06-13 17:33
门头沟学院 Java
顺序不记了,大致顺序是这样的,有的相同知识点写分开了1.基本数据类型2.基本数据类型和包装类型的区别3.==和equals区别4.ArrayList与LinkedList区别5.hashmap底层原理,put操作时会发生什么6.说出几种树型数据结构7.B树和B+树区别8.jvm加载类机制9.线程池核心参数10.创建线程池的几种方式11.callable与runnable区别12.线程池怎么回收线程13.redis三剑客14.布隆过滤器原理,不要背八股,说说真正使用时遇到了问题没有(我说没有,不知道该怎么回答了)15.堆的内存结构16.自己在写项目时有没有遇见过oom,如何处理,不要背八股,根据真实经验,我说不会17.redis死锁怎么办,watchdog机制如何发现是否锁过期18.如何避免redis红锁19.一个表性别与年龄如何加索引20.自己的项目的QPS怎么测的,有没有真正遇到大数量表21.说一说泛型22.springboot自动装配原理23.springmvc与springboot区别24.aop使用过嘛?动态代理与静态代理区别25.spring循环依赖怎么解决26.你说用过es,es如何分片,怎么存的数据,1000万条数据怎么写入库中27.你说用limit,那么在数据量大之后,如何优化28.rabbitmq如何批次发送,批量读取,答了延迟队列和线程池,都不对29.计网知不知道smtp协议,不知道写了对不对,完全听懵了30.springcloud知道嘛?只是了解反问1.做什么的?短信服务,信息量能到千万级2.对我的建议,基础不错,但是不要只背八股,多去实际开发中理解。面试官人不错,虽然没露脸,但是中间会引导我回答问题,不会的也只是说对我要求没那么高。面完问我在济宁生活有没有困难,最快什么时候到,让人事给我聊薪资了。下午人事打电话,问我27届的会不会跑路,还在想办法如何使我不跑路,不想扣我薪资等。之后我再联系吧,还挺想去的😭,我真不跑路哥😢附一张河科大幽默大专图,科大就是大专罢了
查看30道真题和解析
点赞 评论 收藏
分享
评论
9
42
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务