dingyaguang117 / DoubleArrayTrie
高级结构双数组Trie树(DoubleArrayTrie) java实现
☆22Updated 3 years ago
Related projects ⓘ
Alternatives and complementary repositories for DoubleArrayTrie
- Tree-split 搬新家..给各位带来的不便深表歉意☆57Updated 8 years ago
- DoubleArrayTrie Java 实现类☆15Updated 6 years ago
- 搜狐实习自动回复项目:语音识别、问题过滤、答案推荐☆8Updated 10 years ago
- 自定制的精准短文本搜索服务☆18Updated 3 years ago
- A Java port of darts-clone.☆44Updated 10 years ago
- 基于标题分类的主题句提取方法可描述为: 给定一篇新闻报道, 计算标题与新闻主题词集的相似度, 判断标题是否具有提示性。对于提示性标题,抽取新闻报道中与其最相似的句子作为主题句; 否则, 综合利用多种特征计算新闻报道中句子 的重要性, 将得分最高的句子作为主题句。☆39Updated 8 years ago
- 简书站内搜索☆23Updated 6 years ago
- 基于SVM的短文本分类研究☆19Updated 10 years ago
- 语义、情感、相似度分析。☆57Updated 9 years ago
- 本项目转移到https://github.com/cocolian/cocolian-nlp☆34Updated 10 years ago
- A library that provides Pinyin and Chinese conversion and Chinese word segmentation.一个汉字与拼音互转的工具库,提供简单的分词功能。☆22Updated last year
- 把李航老师《统计学习方法》的后几章的算法都用java实现了一遍,实现盒子与球的EM算法,扩展到去GMM训练,后来实现了HMM分词(实现了HMM分词的参数训练)和CRF分词(借用CRF++训练的参数模型),最后利用tensorFlow把BiLSTM+CRF实现了,然后为luc…☆24Updated 2 years ago
- 搜狗输入法细胞词库解析☆14Updated 11 years ago
- elasticsearch similarity Custom plug-in☆10Updated 11 years ago
- ☆26Updated 6 years ago
- 自动抽取网页正文的算法,用JAVA实现☆107Updated 7 years ago
- The missing SVM-based text classification module implementing HanLP's interface☆47Updated 6 years ago
- Text retrieval database based on simhash similarity search☆24Updated last year
- Chinese Word Segmentation Tool, THULAC的Java实现.☆85Updated 3 years ago
- machine learning from scratch☆17Updated 6 years ago
- crf-seg:用于生产环境的中文分词处理工具,可自定义语料、可自定义模型、架构清晰,分词效果好。java编写。☆13Updated 2 years ago
- 中科院分词java客户端;支持x64、x86的windows、linux平台。☆24Updated 10 years ago
- 实现中文文本分类,支持文件、文本分类,基于多项式分布的朴素贝叶斯分类器。由于工作实际应用是二分类,加之考虑到每个分类属性都建立map存储词语向量可能引起的内存问题,所以目前只支持二分类。当然,直接复用这个结构扩展到多分类也是很容易。之所以自己写,主要原因是没有仔细研读mah…☆23Updated 8 years ago
- 基于行块抽取正文内容的java版本的改进算法☆16Updated 10 years ago
- 复旦的中文自然语言工具包☆70Updated 7 years ago
- 中文拼写检查工具,用于对中文文本中的错误用语进行检测并给出纠正建议☆35Updated 6 years ago
- 通过web服务器对word分词的资源进行集中统一管理☆17Updated 7 years ago
- 给定训练新闻数据集,可以对输入的测试新闻进行自动分类识别☆19Updated 9 years ago
- 无损转换OpenCC词典为HanLP格式☆9Updated 3 years ago