随着互联网的迅速发展,Web系统在满足大量用户访问的同时,几乎每天都在产生大量的用户行为数据(用户在使用系统时通过点击、浏览等行为产生的日志数据)及业务交互数据,通过对这些行为数据进行分析可以获取用户的浏览行为,从而挖掘数据中的潜在价值,更好地、有针对性地进行系统的运营。而随着每天日志数据上百GB的增长,传统的单机处理架构已经不能满足需求,此时就需要使用大数据技术并行计算来解决。
本系列文章从0到1手把手讲解如何使用大数据技术对搜索引擎海量用户搜索日志数据进行用户行为分析。最终实现以下需求:
京公网安备 11010502049817号