flicck / CninfoDistributedSpider
针对巨潮资讯网上市公司公告的分布式爬虫,采用scrapy和kafka的分布式架构。可以爬取爬取指定上市公司列表、指定时间段内的所有公告并保存PDF。后续会加入搜索引擎功能
☆19Updated 5 years ago
Alternatives and similar repositories for CninfoDistributedSpider:
Users that are interested in CninfoDistributedSpider are comparing it to the libraries listed below
- a crawler for wallstreetcn,finance.sina by Scrapy-新浪财经,同花顺财经,华尔街见闻的爬虫☆30Updated 8 years ago
- scrapy+Fiddler+celery+ redis +mysql实现分布式定时启动并异步快速动态爬取股票数据功能☆56Updated 2 years ago
- 本项目对美股股票的涨跌进行了研究,从问题出发并提出猜想,然后定义了机器学习的实验任务。通过多次实验得到实验数据,最终证明了所提出的猜想:中国股市确实和美国股市存在着一定的联系,并且通过这些隐含的联系可以预测某些美国股票的涨跌。☆48Updated 8 years ago
- 利用Scikit Learn对秒级股票数据进行建模预测☆56Updated 6 years ago
- 股价预测程序,尝试各种模型。☆34Updated 3 years ago
- 金融问答平台文本数据采集/爬取,数据源涉及上交所,深交所,全景网及新浪股吧☆39Updated 7 years ago
- 提取金融相关领域研究报告的主要结论(key idea)☆59Updated 6 years ago
- 量化交易经典策略:alpha对冲(股票+期货) ,利用股指期货进行对冲的股票策略☆25Updated 7 years ago
- 根据股票帐号,自动下载www.cninfo.com.上对应的企业年报(pdf格式),然后将这些pdf格式的文件转换为txt文件,然后从中提取出有用的信息,进行数据分析和图标展示☆52Updated 8 years ago
- 根据东财股吧爬虫数据进行自然语言分析,展示股市热度☆113Updated 5 years ago
- 对于一个板块内的股票使用Kmeans聚类剔除垃圾股,利用遗传算法分析上市公司的财务指标,从基本面的角度得出合理的股票选择模型,帮助投资者在某个板块内确定出选择高收益股票的标准,策略样本外回测计效见backtest.png文件。☆66Updated 3 years ago
- 极简爬虫工作流☆41Updated last year
- 自动化Tushare数据获取和MySQL储存☆61Updated 2 years ago
- 搜索引擎关键词排位爬虫,包括百度,搜狗,360的搜索引擎关键词排位爬虫,关键词从百度热词中取得,排位分别从三个搜索引擎中抓取。☆19Updated 5 years ago
- This program focused on the core concepts and practice of quantitative investment (multi-factor combination analysis, technical analysis …☆42Updated 5 years ago
- 私募基金管理人查询数据接口。Chinese Private Equity Funds APIs.☆11Updated 6 years ago
- 量化交易股票预测系统☆40Updated 6 years ago
- 重新造轮子构建投资组合框架,适合大类资产配置和股票交易。☆50Updated 6 years ago
- 主要财经媒体新闻爬虫☆10Updated 4 years ago
- A stock market text sentiment analysis website. A股舆情分析, web-crawler, bayesian algorithm, SQL, django, data-visualization.☆41Updated 4 years ago
- 本项目致力于开发各种金融数据处理小工具,以实现基本面分析并提供投资建议☆43Updated 6 years ago
- 金融新闻增量式聚焦爬虫☆20Updated 7 years ago
- 金融财经类新闻文本主题事件提取☆53Updated 2 years ago
- 预测股票☆19Updated 7 years ago
- 爬取东方财富的宏观研究的研报,基于LSTM进行情感分析,分类为正向、负向和中性三类☆109Updated 3 years ago
- Used for study of company. 用于公司研究, 包括公司财报分析, 公司估值等, 使用了python的编译器ply的lexer,yacc来处理非结构化数据,采用神经网络来预测市场趋势.☆13Updated 2 years ago
- 雪球网沪深全站股票评论爬虫☆104Updated 7 years ago
- 在聚宽(joinquant)平台上使用多因子策略进行量化投资模拟。☆32Updated 4 years ago
- 基于scrapy-redis的分布式新闻爬虫,可同时获取腾讯、网易、搜狐、凤凰网、新浪、东方财富、人民网等各大平台新闻资讯☆42Updated 6 years ago
- 对期货数据的研究☆14Updated 7 years ago