ZongXR / BigData-Competition
全国大数据竞赛三等奖解决方案,省赛二等奖解决方案。一键安装大数据环境脚本,自动部署集群环境,包括zookeeper、hadoop、mysql、hive、spark以及一些基础环境。已通过实际服务器测试,效果极佳,仅需要输入密码等少量人为干预。解放安装部署配置所需人力。并添加若干scala案例,结合spark用以进行数据准备。
☆34Updated 6 months ago
Alternatives and similar repositories for BigData-Competition:
Users that are interested in BigData-Competition are comparing it to the libraries listed below
- 本赛题旨在运用有效的金融科技和大数据系统,分析涉赌涉诈资金交易新方式,持续优化风险监测模型,通过赛题提供的涉赌涉诈黑名单、白名单及用于训练的相关交易流水数据集,构建涉赌涉诈账户算法识别模型,全面排查存量风险。A榜排名11/1594,B榜排名13/1594。☆44Updated 2 years ago
- DCIC2023 Fraud Risk Identification Competition Solution.☆25Updated last year
- 2020年第八届泰迪杯数据挖掘C题“智慧政务文本挖掘”特等奖作品(论文与代码)☆63Updated 4 years ago
- 基于RFM和决策树模型构建专家推荐系统。融合了RFM模型和决策树模型,结合专业运营人员的业务经营,发掘潜在用户,进行推荐营销召回。☆88Updated 10 months ago
- Z Lab数据实验室开源代码汇总☆200Updated 9 months ago
- DCIC 2023年 科技金融应用——欺诈风险识别☆26Updated last year
- 根据用户数据以及消费行为数据,使用Python建立分类模型,通过评估客户流失的风险来预测客户流转情况,找到对客户影响较大的因素,进而挽留客户☆9Updated 4 years ago
- 基于用户行为的用户画像项目☆73Updated 7 years ago
- 该项目主要是自学过程中对于一些知识点的整理,项目整体分为四部分,分别是算法、工程、工具和数学知识。算法部分主要是常用的机器学习(LR、SVM、树模型、XGBoost、LightGBM和CatBoost等)和深度学习算法(NLP和CV以及一些基础知识),工程部分主要是spar…☆23Updated 2 years ago
- 基于真实业务上手数据挖掘(银行流失预警):数据的处理、LightGBM、skLearning包(里面含有:GridSearchCV寻找最优参、StratifiedKFold分层5折切分、_test_Split单次数据切分等)、叠层模型融合、画AUC图、画混淆矩阵图,并输出预…☆93Updated 3 years ago
- 数据竞赛笔记fork☆67Updated last year
- 大模型训练、推理、推荐系统相关☆16Updated this week
- 本项目以应用为主出发,结合了从基础的机器学习、深度学习到目标检测以及目前最新的大模型,采用目前成熟的 第三方库、开源预训练模型以及相关论文的最新技术,目的是记录学习的过程同时也进行分享以供更多人可以直接进行使用。☆66Updated 3 weeks ago
- 利用用户画像数据、物品元数据、用户行为数据为特征构建推荐系统,使用CB和CF算法做推荐召回,使用 Redis数 据库做缓存处理,结合机器学习LR算法推荐排序,达到粗排、精排效果,实现推荐引擎搭建。☆44Updated 4 years ago
- 零基础入门金融风控-贷款违约预测 TOP11☆36Updated 4 years ago
- 全国工业大数据算法大赛,省赛二等奖解决方案,已经过实际生产线验证。包括视觉检测模型和动态误差补偿模型。☆20Updated 3 years ago
- 比赛中的通用方法和模板☆15Updated 4 years ago
- 基于Spark2.2新闻网大数据实时系统项目☆60Updated 5 years ago
- 个性化推荐代码--初学者☆40Updated 4 years ago
- 通过python爬虫获取人民网、新浪等网站新闻作为训练集,基于BERT构建新闻文本分类模型,并结合node.js + vue完成了一个可视化界面。☆41Updated 3 years ago
- 开源往期获奖竞赛代码☆44Updated 2 years ago
- 实现了一整套电商数仓的搭建,包括数据采集平台的搭建,将用户的行为数据分为四层分别分层搭建,并实现业务数据库的分层搭建,针对数据仓库中的数据进行,留存、转化率、复购率、GMV、活跃等报表分析,使用当下主流程数的框架,这个项目采用Apache版本的框架实现,后续会上传CDH版本…☆51Updated 2 years ago
- 练手项目:Comment of Interest 电商文本评论数据挖掘 (爬虫 + 观点抽取 + 句子级和观点级情感分析)☆101Updated 4 years ago
- 阿里天池与Datawhale联合举办二手车价格预测比赛:优胜奖方案代码总结☆106Updated last year
- 面向数据安全治理的数据内容智能发现与分级分类 A榜rank7 B榜rank10☆33Updated 4 years ago
- 近年来,随着微信、微博、市长信箱、阳光热线等网络问政平台逐步成为政府了解民意、汇聚民智、凝聚民气的重要渠道,各类社情民意相关的文本数据量不断攀升,给以往主要依靠人工来进行留言划分和热点整理的相关部门的工作带来了极大挑战。同时,随着大数据技术的发展,建立基于自然语言处理技术的…☆33Updated 4 years ago
- Spark开源项目:个性化推荐算法实践☆32Updated 5 years ago
- 大数据实战——商品推荐系统(Spark、Scala、MongoDB)☆102Updated 2 years ago
- 🏆🥈🥉 TianChi/天池 AIStudio Kaggle iFLYTEKAI...☆74Updated 9 months ago
- 基于Python+Flask+MySQL的数据微中台,支持数据库管理、数据收集(某乎爬虫等)等功能☆10Updated 4 years ago