limccn / cacl2
Lexicon for Chinese lexical analyzing, 中文语言分词词库
☆119Updated 3 years ago
Alternatives and similar repositories for cacl2
Users that are interested in cacl2 are comparing it to the libraries listed below
Sorting:
- 中文、分词、词表、核心词典、事件词表、停用词、敏感词、问答、问答数据、知识图谱、文本语料。☆162Updated 3 years ago
- 字符串地址查询,支持自定义地址词库,解析地址,地址识别,地址抽取,中文地址.☆97Updated 4 years ago
- 各大中文分词性能评测☆157Updated 6 years ago
- 中文预处理语料☆109Updated 6 years ago
- 中文文本相似度计算器☆145Updated 7 months ago
- 中文文本分析工具包(包括- 文本分类 - 文本聚类 - 文本相似性 - 关键词抽取 - 关键短语抽取 - 情感分析 - 文本纠错 - 文本摘要 - 主题关键词-同义词、近义词-事件三元组抽取)☆715Updated last year
- An off-the-shelf tool for Chinese Keyphrase Extraction 一个快速从中文里抽取关键短语的工具,仅占35M内存 www.jionlp.com☆551Updated last year
- 基于哈工大同义词词林扩展版的单词相似度计算方法☆364Updated 2 years ago
- 速度更快、效果更好的中文新词发现☆511Updated last year
- 中文地址分词(地址元素识别与抽取),通过序列标注进行NER☆195Updated 5 years ago
- 自然语言处理工具Macropodus,基于Albert+BiLSTM+CRF深度学习网络架构,中文分词,词性标注,命名实体识别,新词发现,关键词,文本摘要,文本相似度,科学计算器,中文数字阿拉伯数字(罗马数字)转换,中文繁简转换,拼音转换。tookit(tool) of N…☆662Updated 2 years ago
- 基于法律裁判文书的事件抽取及其应用,包括数据的分词、词性标注、命名实体识别、事件要素抽取和判决结果预测等内容☆587Updated 2 years ago
- company name parser, extract company name brand. 中文公司名称分词工具,支持公司名称中的地名,品牌名(主词),行业词,公司名后缀提取。☆90Updated 2 years ago
- An exploration for Eventline (important news Rank organized by pulic time),针对某一事件话题下的新闻报道集合,通过使用docrank算法,对新闻报道进行重要性识别,并通过新闻报道时间挑选出时间线上重要…☆221Updated 6 years ago
- mirror of dongxiexidian/Chinese☆300Updated 6 years ago
- 人民日报语料处理工具集 | Tools for Corpus of People's Daily☆281Updated last year
- 综合了同义词词林扩展版与知网(Hownet)的词语相似度计算方法,词汇覆盖更多、结果更准确。☆731Updated 3 years ago
- 适用于中文分词的经济金融词典☆80Updated 4 years ago
- This is a corpus of Chinese abbreviation, including negative full forms.☆196Updated 3 years ago
- 常用的中文停用词表☆75Updated 7 years ago
- ChineseSemanticKB,chinese semantic knowledge base, 面向中文处理的12类、百万规模的语义常用词典,包括34万抽象语义库、34万反义语义库、43万同义语义库等,可支持句子扩展、转写、事件抽象与泛化等多种应用场景。☆755Updated 2 years ago
- 大连理工大学情感词汇本体库及其他相关操作☆134Updated 7 years ago
- 中文问题句子相似度计算比赛及方案汇总☆300Updated 4 years ago
- Minimal keyword extraction with BERT☆84Updated 3 years ago
- 文本相似度计算/文本匹配☆305Updated 5 years ago
- pytextclassifier is a toolkit for text classification. 文本分类,LR,Xgboost,TextCNN,FastText,TextRNN,BERT等分类模型实现,开箱即用。☆509Updated 7 months ago
- 一个简单易用的 Python 模块,用于通过字符串来操作日期/时间。正则时间提取,字符串时间解析,字符串时间提取。中文时间提取,一句话里面提取时间☆76Updated 10 months ago
- 中文近义词表 Chinese Synonyms☆256Updated 7 years ago
- Pytorch-NLU,一个中文文本分类、序列标注工具包,支持中文长文本、短文本的多类、多标签分类任务,支持中文命名实体识别、词性标注、分词、抽取式文本摘要等序列标注任务。 Ptorch NLU, a Chinese text classification and sequ…☆345Updated 10 months ago
- fastHan是基于fastNLP与pytorch实现的中文自然语言处理工具,像spacy一样调用方便。☆755Updated last year