fengchi66 / bigdataLinks
大数据笔记整理
☆54Updated 3 years ago
Alternatives and similar repositories for bigdata
Users that are interested in bigdata are comparing it to the libraries listed below
Sorting:
- 大数据相关笔记☆25Updated 4 years ago
- 一 个实时数仓项目,从0到1搭建实时数仓☆59Updated 4 years ago
- 用户画像相关的参考代码☆155Updated 2 years ago
- ✏️[计算机基础+java基础+大数据基础及进阶+面试指南] 一份涵盖计算机基础,java,大数据,面试宝典,大部分核心知识的项目,学习,面试,共同进步!☆79Updated last year
- 基于SparkSQL的电影分析项目实战☆40Updated 4 years ago
- 电商平台数据仓库搭建☆131Updated 4 months ago
- 大数据全栈学习【生态组件,技术栈,数据流,数据仓库,数据库,指标体系,血缘关系,元数据管理,数据质量,DataWorks,Hadoop,Spark,Flink,面试,笔记文档,实战练习,公共脚本,常用Shell脚本,Java,Scala,离线,实时,采集,计算,存储,可视化…☆122Updated 4 years ago
- 用户画像平台,涵盖标签管理,用户画像报告,用户分群,用户360视角,oneId服务☆102Updated last year
- This is code of book "Spark Big Data Business Trilogy"☆69Updated 2 years ago
- 电商大数据项目-推荐系统(java和scala语言)☆201Updated last year
- 总结典型的hive面试题、SQL、HQL练习☆22Updated 3 years ago
- flink简易使用教程,结合官方仓库的example样例,结合常见场景,使用flink的基本功能☆114Updated 2 years ago
- 基于Flink流处理的动态实时亿级全端用户画像系统☆479Updated 2 years ago
- 《Spark 大型电商项目实战》源码,博客地址:http://blog.csdn.net/u012318074/article/category/6744423☆213Updated last year
- 记录HBase版本API的变迁Demo☆33Updated 6 years ago
- 大数据面试知识点☆41Updated 4 years ago
- 基于 spark 推荐系统, 基于内容标签 CBCF 实现,协同过滤 UBCF 实现,协同过滤 IBCF 实现☆46Updated 8 years ago
- 尚硅谷大数据Spark-2019版最新 Spark 学习☆51Updated 2 years ago
- 大数据相关框架实战项目(Hadoop, Spark, Storm, Flink)☆336Updated 2 years ago
- 《hadoop权威指南》、《大数据架构师指南》、《大数据之路:阿里巴巴大数据实践》《Apache+Kylin权威指南》☆220Updated 6 years ago
- ☆113Updated 8 months ago
- docker构建大数据开发学习环境☆50Updated 8 years ago
- 全套大数据基础学习教程,包含最基础的centos、maven。大数据主要包含hdfs、mr、yarn、hbase、kafka、scala、sparkcore、sparkstreaming、sparksql。教程包含所有的源代码演示以及在线文档说明。☆54Updated 2 years ago
- 基于 Spark Streaming + ALS 的餐饮推荐系统☆88Updated 6 years ago
- 基于Spark企业级用户画像项目☆122Updated last year
- 分享一些在工作中的大数据实战案例,包括flink、kafka、hadoop、presto等等。欢迎大家关注我的公众号【大数据技术与应用实战】,一起成长。☆263Updated last year
- 实现了一整套电商数仓的搭建,包括数据采集平台的搭建,将用户的行为数据分为四层分别分层搭建,并实现业务数据库的分层搭建,针对数据仓库中的数据进行,留存、转化率、复购率、GMV、活跃等报表分析,使用当下主流程数的框架,这个项目采用Apache版本的框架实现,后续会上传CDH版本…☆52Updated 2 years ago
- 学习 Spark 的一个小项目,以及其中各种调优的笔记☆177Updated 7 years ago
- 模拟电商系统上线运行一段时间后,根据收集到大量的用户行为数据,利用大数据技术(Flink)进行深入挖掘和分析,进而得到感兴趣的商业指标并增强对风险的控制。 整体可以分为用户行为习惯数据和业务行为数据两大类。用户的行为习惯数据包括了用户的登录方式、上线的时间点及时长、点击和浏…☆126Updated 5 years ago
- 基于Flink+Kafka的全链路数仓, 包括实时和离线☆37Updated 2 years ago