jiguang123 / Big-Data-Competition-Project
大数据竞赛项目实战, 内容涵盖: Kaggle、阿里天池大数据、腾讯大数据、京东大数据、DataCastle大数据竞赛等等
☆58Updated 6 years ago
Alternatives and similar repositories for Big-Data-Competition-Project:
Users that are interested in Big-Data-Competition-Project are comparing it to the libraries listed below
- 拉勾网+BOSS直聘网招聘信息大数据分析项目_数据获取+数据清洗+数据分析+数据可视化☆157Updated 2 years ago
- 大数据项目实战之基于Spark2.X的新闻话题的实时统计分析☆26Updated 2 years ago
- 基于Spark2.2新闻网大数据实时系统项目☆60Updated 5 years ago
- 此项目是对大学生的一卡通消费数据、图书借阅记录和图书馆门禁数 据在spark集群的大数据框架环境之下进行聚类、关联分析,分析出学生的消费水平、生活规律、学习强度等聚类结果,以及将聚类结果进行FPGrowth关联分析得出学生聚类之间存在的关联性,此项目是使用scala语言,利用…☆63Updated 3 months ago
- 电商大数据项目-推荐系统(java和scala语言)☆201Updated last year
- 一个简单的Hive项目,使用了Sqoop、Hadoop、Hive、MySQL,对电商数据进行分析☆46Updated 6 years ago
- 大数据招聘信息分析平台☆41Updated 8 years ago
- 大数据实习hdfs+flume+kafka+spark+hbase+hive项目☆32Updated 7 years ago
- 电商大数据分析平台——静态页面模板☆79Updated 4 years ago
- 基于spark的外卖大数据平台分析系统☆42Updated 6 years ago
- 数据分析师的进阶之路,我目前的知识体系,后续继续补充~☆47Updated 6 years ago
- 模拟电商系统上线运行一段时间后,根据收集到大量的用户行为数据,利用大数据技术(Flink)进行深入挖掘和分析,进而得到感兴趣的商业指标并增强对风险的控制。 整体可以分为用户行为习惯数据和业务行为数据两大类。用户的行为习惯数据包括了用户的登录方式、上线的时间点及时长、点击和浏…☆115Updated 4 years ago
- 本项目旨在建立一个基于大数据处理的大学生就业方向分析预测系统,通过爬虫技术获取各大公司和著名招聘网站的大量招聘信息,然后将获取的数据进行清洗分类后储存在数据库中,最后从大学生的就业角度出发,通过算法分析数据,建立一个帮助大学生明确就业方向与社会需求的平台☆100Updated 6 years ago
- 使用Hadoop、Spark等实现的大数据平台项目☆22Updated 2 years ago
- spark大数据大型电商项目☆13Updated 4 years ago
- 电商平台数据仓库搭建☆125Updated 2 years ago
- python数据分析基础☆80Updated 10 months ago
- Spark大型项目实战:电商用户行为分析大数据平台\Spark大型项目实战:电商用户行为分析大数据平台(史上第一套高端大数据项目实 战课程)☆29Updated last year
- 基于flume+kafka+HBase+spark+ElasticSearch的用户轨迹查询大数据开发项目☆110Updated 2 years ago
- 最好的大数据项目。《Titan数据运营系统》,本项目是一个全栈闭环系统,我们有用作数据可视化的web系统,然后用flume-kafaka-flume进行日志的读取,在hive设计数仓,编写spark代码进行数仓表之间的转化以及ads层表到mysql的迁移,使用azkaban…☆121Updated 3 years ago
- 利用用户画像数据、物品元数据、用户行为数据为特征构建推荐系统,使用CB和CF算法做推荐召回,使用 Redis数 据库 做缓存处理,结合机器学习LR算法推荐排序,达到粗排、精排效果,实现推荐引擎搭建。☆42Updated 3 years ago
- 基于互联网金融平台2015年度贷款数据完成信贷违约预测模型,该模型可以作为信贷平台预测违约借款人的参考☆68Updated 6 years ago
- 《Spark 快速大数据分析》学习笔记☆40Updated last year
- 从0到1构建用户画像☆36Updated 3 years ago
- 基于spark-ml,spark-mllib,spark-streaming的推荐算法实现☆96Updated 5 years ago
- SparkStreaming项目,显示flume->Kafka->Spark->hbase(实时数据处理方案),Scala实现☆36Updated 6 years ago
- 数据分析,挖掘建模。☆204Updated 3 years ago
- 实现了一整套电商数仓的搭建,包括数据采集平台的搭建,将用户的行为数据分为四层分别分层搭建,并实现业务数据库的分层搭建,针对数据仓库中的数据进行,留存、转化率、复购率、GMV、活跃等报表分析,使用当下主流程数的框架,这个项目采用Apache版本的框架实现,后续会上传CDH版本…☆49Updated 2 years ago
- 本次数据分析基于阿里云天池数据集(用户行为数据集),使用转化漏斗,AARRR模型,对常见电商分析指标,包括转化率,PV,UV,留存率,复购率等进行分析,分析过程中使用python进行数据清洗及可视化。☆26Updated 4 years ago
- 基于 Spark Streaming + ALS 的餐饮推荐系统☆88Updated 6 years ago