实现了一整套电商数仓的搭建,包括数据采集平台的搭建,将用户的行为数据分为四层分别分层搭建,并实现业务数据库的分层搭建,针对数据仓库中的数据进行,留存、转化率、复购率、GMV、活跃等报表分析,使用当下主流程数的框架,这个项目采用Apache版本的框架实现,后续会上传CDH版本的框架实现,并实现最终的数据可视化。
☆62Jun 17, 2022Updated 4 years ago
Alternatives and similar repositories for E-CommerceWarehouse
Users that are interested in E-CommerceWarehouse are comparing it to the libraries listed below. We may earn a commission when you buy through links labeled 'Ad' on this page.
Sorting:
- 模拟电商系统上线运行一段时间后,根据收集到大量的用户行为数据,利用大数据技术(Flink)进行深入挖掘和分析,进而得到感兴趣的商业指标并增强对风险的控制。 整体可以分为用户行为习惯数据和业务行为数据两大类。用户的行为习惯数据包括了用户的登录方式、上线的时间点及时长、点击和浏…☆145May 5, 2020Updated 6 years ago
- 其中包括:Python的数据结构和算法相关内容,一个完整的Django的web项目,还有MiniWeb相关内容,和多线程的协程、进程、线程,和网络编程,还有和数据库的交互,比如Mongodb、Mysql、Redis,其中还有PyQt5,还有可视化内容相关,还有整套Pytho…☆17Jun 7, 2023Updated 3 years ago
- 基于开源Litemall电商项目的大数据项目,包含前端埋点(openresty+lua)、后端埋点;数据仓库(五层)、实时计算和用户画像。大数据平台采用CDH6.3.2(已使用vagrant+ansible脚本化),同时也包含了Azkaban的workflow。☆121May 16, 2022Updated 4 years ago
- 一个简单的Hive项目,使用了Sqoop、Hadoop、Hive、MySQL,对电商数据进行分析☆56Dec 15, 2018Updated 7 years ago
- 本项目分别电商数据统计模块及业务采集及数仓搭建模块,利用hive统计每个区域热门商品进行统计;依据业务数据实现离线业务数仓搭建。☆22Mar 2, 2022Updated 4 years ago
- Bare Metal GPUs on DigitalOcean Gradient AI • AdPurpose-built for serious AI teams training foundational models, running large-scale inference, and pushing the boundaries of what's possible.
- 小象数据完整产品包括用户行为分析、用户画像、智慧运营,通过采集用户行为数据和第三方数据进行实时处理和分析,实时获取用户操作、产品体验和运营活动的数据反馈。兼容神策SDK,完整产品包括用户行为分析、用户画像、智慧运营,通过 采集用户行为数据和第三方数据进行实时处理和分析,实时获…☆52Apr 6, 2024Updated 2 years ago
- 从数据仓库到用户画像,从数据建设到数据应用☆649Jan 26, 2022Updated 4 years ago
- 微博情感分析☆12Sep 1, 2013Updated 13 years ago
- 通过图形界面为数据监控以及数据同步提高良好的服务,可支持数据同步的数据源或数据 库有:SQL数据源、NoSQL数据源、数据引擎、数据仓库、消息队列;通过Canal可支持数据库监控以及数据备份。☆25Jan 19, 2021Updated 5 years ago
- 数据采集、数据审核、数据分析平台☆11Dec 16, 2022Updated 3 years ago
- 自己设计的所有MapReduce案例,包括有单词统计、主播数据的清洗、疫情数据统计、岗位分析、Java岗位统计、手机数据品牌的统计等等☆20Nov 21, 2022Updated 3 years ago
- ☆15Dec 12, 2021Updated 4 years ago
- 大数据相关框架实战项目(Hadoop, Spark, Storm, Flink)☆354Oct 4, 2022Updated 3 years ago
- 一站式自动化测试平台及解决方案,安装包☆10Jan 19, 2024Updated 2 years ago
- Managed Kubernetes at scale on DigitalOcean • AdDigitalOcean Kubernetes includes the control plane, bandwidth allowance, container registry, automatic updates, and more for free.
- 基于深度学习的监督学习,使用梯度下降、ALS、LFM算法,使用AngularJS2生成前端框架,数据库为MongoDB,使用ElasticSearch作为搜索服务器,Redis作为缓存数据库,其中包括Spark的离线统计服务、Azkaban的工作调度服务、Flume的日志采…☆22Dec 16, 2022Updated 3 years ago
- 分布式Github爬虫☆14May 22, 2019Updated 7 years ago
- The dataset is of a Global Pharmacy Company. The dataset comprises of Historical sales, Product Information and products which need forec…☆29Aug 27, 2019Updated 7 years ago
- loganalysis.py 是一个通过python语言实现的WEB服务器访问日志统计分析应用。☆18Nov 9, 2013Updated 12 years ago
- Flink 案例开发数据清洗、数据报表☆58Sep 13, 2025Updated 11 months ago
- 研究使用解析网页数据,并将主要信息存储到本地数据库中,方便在电脑上查询。☆14Dec 6, 2016Updated 9 years ago
- 项目以推荐系统领域知名的经过修改过的中文亚马逊电商数据集作为依托,以电商网站真实业务数据架构为基础,构建了这套一体化电商推荐系统,包含了离线推荐与实时推荐体系,综合利用了协同过滤算法以及基于内容的推荐方法来提供混合推荐。包括从前端应用、后台服务、算法设计实现、平台部署等多方…☆32Dec 16, 2022Updated 3 years ago
- 天津财经大学2019年统计学院机器学习讨论班☆13Dec 9, 2019Updated 6 years ago
- A p2p gossip protocol for requesting artifacts.☆11May 5, 2015Updated 11 years ago
- AI Agents on DigitalOcean Gradient AI Platform • AdBuild production-ready AI agents using customizable tools or access multiple LLMs through a single endpoint. Create custom knowledge bases or connect external data.
- Python+Requests+PyTest+Excel+Allure接口自动化测试实战☆14Mar 16, 2023Updated 3 years ago
- 亿矿云大数据处理框架:借助Hadoop、Spark、Storm等分布式处理架构,满足海量数据的批处理和流处理计算需求。 亿矿云大数据预处理:运用数据冗余剔除、异常检测、归一化等方法对原始数据进行清洗,为后续存储、管理与分析提高质量数据来源。 亿矿云大数据存储与管理:通过分布…☆20Sep 9, 2023Updated 2 years ago
- 最好的大数据项目。《Titan数据运营系统》,本项目是一个全栈闭环系统,我们有用作数据可视化的web系统,然后用flume-kafaka-flume进行日志的读取,在hive设计数仓,编写spark代码进行数仓表之间的转化以及ads层表到mysql的迁移,使用azkaban…☆147Nov 8, 2021Updated 4 years ago
- java 大数据 spark flink redis hive hbase kafka 面试题 数据结构 算法 设计模式☆23Sep 20, 2021Updated 4 years ago
- 电商+大数据+spark机器学习☆17Dec 5, 2017Updated 8 years ago
- 利用用户画像数据、物品元数据、用户行为数据为特征构建推荐系统,使用CB和CF算法做推荐召回,使用 Redis数 据库做缓存处理,结合机器学习LR算法推荐排序,达到粗排、精排效果,实现推荐引擎搭建。☆47Feb 10, 2021Updated 5 years ago
- 本人毕业设计课题为《互联网大数据时代的酒店预订平台设计与实现》,由Leme34/fun+Leme34/fun-app+Leme34/fun-backend三个项目构成,项目以及全部组件使用Docker搭建,全套Hadoop+Hive+Kafka+Spark+ElasticS…☆26Mar 19, 2024Updated 2 years ago
- Twitter Spider 推特爬虫,支持搜索关键词采集推文数据,采集相关用户,采集用户主页推文☆11Dec 31, 2019Updated 6 years ago
- seesee,看看视频。基于DDD领域驱动设计的SpringCloud Alibaba短视频项目,移动端使用Flutter2.x构建,管理后台使用Vue 3.0 + Element Plus 进行构建,后端采用Hadoop与Flink等大数据框架构建实时计算与离线计算体系。☆19Feb 16, 2022Updated 4 years ago
- Deploy to Railway using AI coding agents - Free Credits Offer • AdUse Claude Code, Codex, OpenCode, and more. Autonomous software development now has the infrastructure to match with Railway.
- 本地解析+存储的Epub电子书阅读器☆10Jul 11, 2023Updated 3 years ago
- 大数据离线项目之:BI上报(Hadoop、Hbase、Hive、flume、sqoop)☆13Jul 1, 2022Updated 4 years ago
- Sea-land segmentation data with ground truth☆16Jan 26, 2020Updated 6 years ago
- 基于ssm的财务预算管理系统,写的简单易用,很适合上手。同时也包括了基本的管理系统的功能,也用到了一些插件,界面也美观大方。☆11Jun 30, 2017Updated 9 years ago
- Simple implementation of a p2p network in Go☆14Apr 11, 2018Updated 8 years ago
- 数据库模型映射,自动建表, 自动更新表,数据增删改查, FTS全文搜索, 支持自定义fts3,4,5分词器,可拼音分词. sql,fmdb,wcdb,sqlite3,orm,fts,fts3,fts4,fts5. VVSequelize的swift版本☆23May 22, 2023Updated 3 years ago
- Searching a High Performance Feature Extractor for Text Recognition Network. TPAMI 2022☆13Nov 25, 2022Updated 3 years ago