fengchi66 / bigdata
大数据笔记整理
☆53Updated 3 years ago
Alternatives and similar repositories for bigdata:
Users that are interested in bigdata are comparing it to the libraries listed below
- 一个实时数仓项目,从0到1搭建实时数仓☆59Updated 3 years ago
- 大数据相关笔记☆25Updated 4 years ago
- 用户画像相关的参考代码☆155Updated 2 years ago
- 大数据框架 Spark MLlib 机器学习库基础算法全面讲解,附带齐全的测试文件☆39Updated last year
- 基于SparkSQL的电影分析项目实战☆40Updated 4 years ago
- 用户画像平台,涵盖标签管理,用户画像报告,用户分群,用户360视角,oneId服务☆102Updated last year
- This is code of book "Spark Big Data Business Trilogy"☆69Updated 2 years ago
- Spark中实现用户画像系统价值度、忠诚度、流失预警、活跃度等模型☆66Updated 7 years ago
- 电商平台数据仓库搭建☆130Updated 3 months ago
- 基于flink的电商实时数据分析、推荐、风控项目☆56Updated 2 years ago
- 大数据全栈学习【生态组 件,技术栈,数据流,数据仓库,数据库,指标体系,血缘关系,元数据管理,数据质量,DataWorks,Hadoop,Spark,Flink,面试,笔记文档,实战练习,公共脚本,常用Shell脚本,Java,Scala,离线,实时,采集,计算,存储,可视化…☆121Updated 4 years ago
- spark全示例代码(java、scala) Spark most full instance code DEMO (java、scala)☆83Updated 5 years ago
- ✏️[计算机基础+java基础+大数据基础及进阶+面试指南] 一份涵盖计算机基础,java,大数据,面试宝典,大部分核心知识的项目,学习,面试,共同进步!☆78Updated last year
- flink简易使用教程,结合官方仓库的example样例,结合常见场景,使用flink的基本功能☆114Updated 2 years ago
- FlinkTutorial 专注大数据Flink流试处理技术。从基础入门、概念、原理、实战、性能调优、源码解析等内容,使用Java开发,同时含有Scala部分核心代码。欢迎关注我的博客及github。☆70Updated 2 years ago
- 基于Flink的批流处理实战案例☆36Updated 2 years ago
- Flink cdc 整库同步 & flink 代码 demo☆43Updated 7 months ago
- 基于SparkMLLib实现的商品推荐功能,包括:基于用户的协同过滤,基于物品的协同过滤,基于ALS交替最小二乘的协同过滤。☆36Updated 6 years ago
- 基于Flink+Kafka的全链路数仓, 包括实时和离线☆37Updated 2 years ago
- 分享一些在工作中的大数据实战案例,包括flink、kafka、hadoop、presto等等。欢迎大家关注我的公众号【大数据技术与应用实战】,一起成长。☆263Updated last year
- docker构建大数据开发学习环境☆50Updated 8 years ago
- 基于spark-ml,spark-mllib,spark-streaming的推荐算法实现☆96Updated 5 years ago
- Flink电商项目,实时统计分析 + 风控☆25Updated 5 years ago
- 总结典型的hive面试题、SQL、HQL练习☆20Updated 3 years ago
- 基于Flink流处理的动态实时亿级全端用户画像系统☆478Updated 2 years ago
- 实现了一整套电商数仓的搭建,包括数据采集平台的搭建,将用户的行为数据分为四层分别分层搭建,并实现业务数据库的分层搭建,针对数据仓库中的数据进行,留存、转化率、复购率、GMV、活跃等报表分析,使用当下主流程数的框架,这个项目采用Apache版本的框架实现,后续会上传CDH版本…☆52Updated 2 years ago
- 全套大数据基础学习教程,包含最基础的centos、maven。大数据主要包含hdfs、mr、yarn、hbase、kafka、scala、sparkcore、sparkstreaming、sparksql。教程包含所有的源代码演示以及在线文档说明。☆54Updated 2 years ago
- 模拟电商系统 上线运行一段时间后,根据收集到大量的用户行为数据,利用大数据技术(Flink)进行深入挖掘和分析,进而得到感兴趣的商业指标并增强对风险的控制。 整体可以分为用户行为习惯数据和业务行为数据两大类。用户的行为习惯数据包括了用户的登录方式、上线的时间点及时长、点击和浏…☆122Updated 5 years ago
- 记录HBase版本API的变迁Demo☆33Updated 6 years ago
- Flink 案例开发数据清洗、数据报表☆53Updated 2 years ago