anycodes / companyCategoryLinks
根据企业名称对企业类型进行分类
☆38Updated 7 years ago
Alternatives and similar repositories for companyCategory
Users that are interested in companyCategory are comparing it to the libraries listed below
Sorting:
- 利用文本挖掘技术进行新闻热点关注问题分析☆166Updated 6 years ago
- company name parser, extract company name brand. 中文公司名称分词工具,支持公司名称中的地名,品牌名(主词),行业词,公司名后缀提取。☆92Updated 3 years ago
- Python文本挖掘系统 Research of Text Mining System☆342Updated 7 years ago
- An exploration for Eventline (important news Rank organized by pulic time),针对某一事件话题下的新闻报道集合,通过使用docrank算法,对新闻报道进行重要性识别,并通过新闻报道时间挑选出时间线上重要…☆224Updated 7 years ago
- 房新数据中文地址分词☆62Updated 6 years ago
- 中文地址分词(地址元素识别与抽取),通过序列标注进行NER☆200Updated 5 years ago
- 依据香港中文大学设计的规则系统,先用小样本评论建立初始关键词库,再结合18种句式逐条匹配评论,能够快速准确地识别评论对象及情感极性。经多次迭代优化关键词库后,达到较高准确率的基础上,使用Tableau进一步分析数据,识别出客户集中关注的商品属性、普遍好评差评的商品属性;通过…☆57Updated 8 years ago
- self complemented BaiduIndexSpyder based on Selenium , index image decode and num image transfer,基于关键词的历时百度搜索指数自动采集☆42Updated 7 years ago
- mirror of dongxiexidian/Chinese☆306Updated 6 years ago
- Simple examples of text data visualization. 文本人物可视化,词云、人物关系图谱☆112Updated 8 years ago
- 极简爬虫工作流☆43Updated 2 years ago
- 文本分类是指在给定分类体系下 , 根据文本的内容自动确定文本类别的过程。首先我们根据scrapy爬虫根据中国知网URL的规律,爬取70多万条2014年公开的发明专利,然后通过数据清洗筛选出了60 多万条含标签数据。通过TF-IDF对60多万条本文进行词频提取,依照词频排序提取…☆108Updated 7 years ago
- 地址标准化☆125Updated last year
- Wenshu_Spider-Scrapy框架爬取中国裁判文书网案件数据(2019-1-9最新版)☆200Updated 6 years ago
- 博客文章开源代码分享区☆126Updated 4 years ago
- 使用pyltp的工具,基于中文依存句法的四大名著人物情节分析系统。分为整体分析和章节分析两大模块,实现了人物篇幅分析,故事发生地分析,主要人物情绪变化分析,人物互动情况分析.☆94Updated 8 years ago
- 字符串地址查询,支持自定义地址词库,解析地址,地址识别,地址抽取,中文地址.☆95Updated 4 years ago
- 经济责任审计知识图谱:网络爬虫、关系抽取、领域词汇判定☆127Updated 5 years ago
- 今日头条中文新闻文本(多层)分类数据集☆401Updated 4 years ago
- 中国裁判文书网爬虫(2018-08-28更新)☆349Updated 2 years ago
- 基于在线民宿 UGC 数据的意见挖掘项目,包含数据挖掘和NLP 相关的处理,负责数据采集、主题抽取、情感分析等任务。目的是克服用户打分和评论不一致,实时对在线民宿的满意度评测,包含在线评论采集和情感可视化分析。搭建了百度地图POI查询入口,可以进行自动化的批量查询 POI …☆436Updated last year
- flask+seq2seq【TensorFlow1.0, Pytorch】 在线聊天机器人 https://mp.weixin.qq.com/s/VpiAmVSTin3ALA8MnzhCJA 或 https://ask.hellobi.com/blog/python_s…☆69Updated 2 years ago
- 中文地址提取 工具,支持中国三级区划地址(省、市、区)提取和映射,支持地址热力图绘制。☆235Updated last year
- MachineLearning☆95Updated 10 years ago
- 天池比赛作品整理。实现从pdf中提取出姓名、出生年月、性别、电话、最高学历、籍贯、落户市县、政治面貌、毕业院校、工作单位、工作内容、职务、项目名称、项目责任、学位、毕业时间、工作时间、项目时间共18个字段。☆116Updated last year
- gunicorn+gevent+restful,一个标准的高并发flask项目☆47Updated 6 years ago
- ☆115Updated 7 years ago
- 短文本相似度☆102Updated 4 years ago
- 爬虫-百度百科-知识图谱探索☆200Updated 6 years ago
- 中国大陆 31 个省份最近几日新增工商企业注册信息以及其他部分企业数据,大概100余万信息,包含企业名称、注册地址、统一社会信用代码、省份、城市、注册日期、经营范围、负责人、邮箱、注册资金、企业类型等资料。 In 31 provinces in mainland China…☆181Updated 6 years ago