当前位置: 首页> 娱乐> 明星 > SQL面试题练习 —— 用户行为路径分析

SQL面试题练习 —— 用户行为路径分析

时间:2025/7/14 15:01:43来源:https://blog.csdn.net/hu_wei123/article/details/141024714 浏览次数:0次

目录

  • 1 题目
  • 2 建表语句
  • 3 题解

题目来源:拼多多。

1 题目


有一张用户行为日志表 ods_usr_log, 包含用户id(user_id)和页面id(page_id)以及进入页面时间(in_ts)

问题:统计每天进入A页面后,立刻进入B页面,又进入C页面的用户数(注意:进入C页面之前可能进入过其他页面)

样例数据

在这里插入图片描述

2 建表语句


insert into ods_usr_log(user_id, page_id, in_ts) values 
(1, 'A', '2020-1-1 12:01:03'),
(2, 'A', '2020-1-1 12:01:04'),
(3, 'A', '2020-1-1 12:01:05'),
(1, 'B', '2020-1-1 12:03:03'),
(1, 'A', '2020-1-1 12:04:03'),
(1, 'C', '2020-1-1 12:06:03'),
(1, 'D', '2020-1-1 12:11:03'),
(2, 'A', '2020-1-1 12:07:04'),
(3, 'C', '2020-1-1 12:02:05'),
(2, 'C', '2020-1-1 12:09:03'),
(2, 'A', '2020-1-1 12:10:03'),
(4, 'A', '2020-1-1 12:01:03'),
(4, 'C', '2020-1-1 12:11:05'),
(4, 'D', '2020-1-1 12:15:05'),
(1, 'A', '2020-1-2 12:01:03'),
(2, 'A', '2020-1-2 12:01:04'),
(3, 'A', '2020-1-2 12:01:05'),
(1, 'B', '2020-1-2 12:03:03'),
(1, 'A', '2020-1-2 12:04:03'),
(1, 'C', '2020-1-2 12:06:03'),
(2, 'A', '2020-1-2 12:07:04'),
(3, 'B', '2020-1-2 12:08:05'),
(3, 'E', '2020-1-2 12:09:05'),
(3, 'D', '2020-1-2 12:11:05'),
(2, 'C', '2020-1-2 12:09:03'),
(4, 'E', '2020-1-2 12:05:03'),
(4, 'B', '2020-1-2 12:06:03'),
(4, 'E', '2020-1-2 12:07:03'),
(2, 'A', '2020-1-2 12:10:03');

3 题解


要想求按照 A->B->C 序列的用户,就需要知道每个用户的行为路径。这个不难求得,只需要将每个用户进入的页面按照进入时间进行concat即可。那么如何保证A到B是直接到达的,并且B到C是可能间接到达的呢?显然可以使用正则匹配 like %A,B%C%

select date(in_ts) as dt,count(distinct user_id) as cnt
from
(select user_id,in_ts,concat_ws(',',collect_set(page_id) over(partition by user_id order by in_ts)) as page_listfrom ods_usr_log
) t
where page_list like '%A,B%C%'
group by date(in_ts)
;
关键字:SQL面试题练习 —— 用户行为路径分析

版权声明:

本网仅为发布的内容提供存储空间,不对发表、转载的内容提供任何形式的保证。凡本网注明“来源:XXX网络”的作品,均转载自其它媒体,著作权归作者所有,商业转载请联系作者获得授权,非商业转载请注明出处。

我们尊重并感谢每一位作者,均已注明文章来源和作者。如因作品内容、版权或其它问题,请及时与我们联系,联系邮箱:809451989@qq.com,投稿邮箱:809451989@qq.com

责任编辑: