harvardfly / Spark-for-Python
基于python3使用spark的统计分析,涵盖spark的几大模块,主要有spark core、spark mllib、spark sql及spark streaming等的python实现
☆32Updated 6 years ago
Alternatives and similar repositories for Spark-for-Python
Users that are interested in Spark-for-Python are comparing it to the libraries listed below
Sorting:
- 大数据精准营销中搜狗用户画像挖掘☆36Updated 8 years ago
- 基于 Spark Streaming + ALS 的餐饮推荐系统☆88Updated 6 years ago
- 使用Spark GraphX基于PageRank算法构建一个仿微博用户好友的分布式推荐系统。☆24Updated 6 years ago
- 毕业设计源码-基于Spark的Kmeans聚类算法优化☆18Updated 8 years ago
- csdn用户画像的源码☆20Updated 7 years ago
- pyspark+Word2Vec+Tfidf+LSH、文章相似性推荐☆26Updated 5 years ago
- 基于Spark MLlib ALS的音乐推荐系统☆29Updated 8 years ago
- 基于SparkMLLib实现的商品推荐功能,包括:基于用户的协同过滤,基于物品的协同过滤,基于ALS交替最小二乘的协同过滤。☆36Updated 6 years ago
- 基于Spark的行为日志分析系统☆16Updated 2 years ago
- Spark中实现用户画像系统价值度、忠诚度、流失预警、活跃度等模型☆66Updated 8 years ago
- 基于PySpark库,使用SparkSql连接MYSQL数据库并对数据进行统计分析的基础架构☆14Updated 7 years ago
- 第二届全国大数据比赛-个性化新闻推荐☆69Updated 9 years ago
- hbase + spark 实现常用推荐算法(主要用于精准广告投放和推荐系统)☆67Updated 8 years ago
- 基于Spark2.2新闻网大数据实时系统项目☆61Updated 6 years ago
- 参与针对于2019-nCoV数据可视化预测项目,后端完全使用ElasticSearch集群/Redis缓存,利用Flask提供API Server,利用前端/中后/前台的接口配合完成新型冠状病毒的疫情发展的相关信息可视化以及预测,方便观察疫情发展情况,并结合机器学习模型对疫…☆23Updated 5 years ago
- 一个简单的Hive项目,使用了Sqoop、Hadoop、Hive、MySQL,对电商数据进行分析☆49Updated 6 years ago
- 基于spark-ml,spark-mllib,spark-streaming的推荐算法实现☆96Updated 5 years ago
- 基于Django和Hadoop集群进行的大数据分析平台☆65Updated 7 years ago
- 基于Spark的实时推荐系统,使用MovieLens作为测试数据集☆28Updated 2 years ago
- 基于Hadoop和Django开发的用户画像系统☆23Updated 6 years ago
- 此项目是对大学生的一卡通消费数据、图书借阅记录和图书馆门禁数据在spark集群的大数据框架环境之下进行聚类、关联分析,分析出学生的消费水平、生活规律、学习强度等聚类结果,以及将聚类结果进行FPGrowth关联分析得出学生聚类之间存在的关联性,此项目是使用scala语言,利用…☆63Updated 7 months ago
- SparkMLlib智慧交通项目☆15Updated 6 years ago
- 目前任职大数据开发工作,日常开发使用Python作为数据分析工具,在此比较常用的方面知识或难点总结、整理出来,以此分享,谢谢!☆18Updated 7 years ago
- 数据挖掘,参加Kaggle的一个预测广告点击率的竞赛☆28Updated 9 years ago
- 基于Django Restframework的异常检测系统,分析服务为Spark SQL和Spark Mllib,每天通过自动跑定时job从全量数据中导入正常数据供算法模型训☆50Updated 2 years ago
- 基于用户行为的推荐算法大赛---第四名(临兵斗列)☆41Updated 8 years ago
- 使用 Spark MLlib 的 ALS 算法的电影推荐系统☆42Updated 8 years ago
- 基于SparkSQL的电影分析项目实战☆40Updated 4 years ago
- 基于hadoop和hive的微博热词跟踪系统☆27Updated 8 years ago
- spark流式计算电商商品关注度+推荐系统/关联系统☆15Updated 7 years ago