awnuxkjy / es-custom-similarity-providerLinks
elasticsearch similarity Custom plug-in
☆10Updated 11 years ago
Alternatives and similar repositories for es-custom-similarity-provider
Users that are interested in es-custom-similarity-provider are comparing it to the libraries listed below
Sorting:
- 这是Word2vec和Doc2vec的一个应用示例:用Word2vec计算词的相似度和用doc2vec计算句子的相似度。☆26Updated 8 years ago
- 语义、情感、相似度分析。☆58Updated 9 years ago
- JNI api for faiss☆14Updated 8 years ago
- Tree-split 搬新家..给各位带来的不便深表歉意☆55Updated 8 years ago
- LDA 的java实现☆63Updated 9 years ago
- 基于标题分类的主题句提取方法可描述为: 给定一篇新闻报道, 计算标题与新闻主题词集的相似度, 判断标题是否具有提示性。对于提示性标题,抽取新闻报道中与其最相似的句子作为主题句; 否则, 综合利用多种特征计算新闻报道中句子的重要性, 将得分最高的句子作为主题句。☆40Updated 8 years ago
- Java port of c++ version of facebook fasttext☆122Updated 4 years ago
- word2vec的Java并行实现☆126Updated 9 years ago
- A Java port of darts-clone.☆44Updated 11 years ago
- ☆29Updated 9 years ago
- A simple scoring plugin for vector in Elasticsearch.☆69Updated 8 years ago
- Chinese Word Segmentation Tool, THULAC的Java实现.☆84Updated 4 years ago
- 这是一个使用中科院计算所分词器的历史答题系统, 能够建立简单的知识图谱, 并通过计算关联项决定答案。☆13Updated 9 years ago
- Document preprocessing for preparing formatted input data which is suitable for LibSVM tool.☆50Updated 8 years ago
- crf-seg:用于生产环境的中文分词处理工具,可自定义语料、可自定义模型、架构清晰,分词效果好。java编写。☆14Updated 3 years ago
- 复旦的中文自然语言工具包☆72Updated 8 years ago
- 实现中文文本分类,支持文件、文本分类,基于多项式分布的朴素贝叶斯分类器。由于工作实际应用是二分类,加之考虑到每个分类属性都建立map存储词语向量可能引起的内存问题,所以目前只支持二分类。当然,直接复用这个结构扩展到多分类也是很容易。之所以自己写,主要原因是没有仔细研读mah…☆22Updated 8 years ago
- 自定制的精准短文本搜索服务☆18Updated 4 years ago
- Refactored version for https://github.com/shirdrn/document-processor.git☆15Updated 8 years ago
- A Java implementation of doc2vec in ICML'14☆30Updated 9 years ago
- ☆11Updated 8 years ago
- A Java implementation of doc2vec in ICML'14☆25Updated 9 years ago
- 把李航老师《统计学习方法》的后几章的算法都用java实现了一遍,实现盒子与球的EM算法,扩展到去GMM训练,后来实现了HMM分词(实现了HMM分词的参数训练)和CRF分词(借用CRF++训练的参数模型),最后利用tensorFlow把BiLSTM+CRF实现了,然后为luc…☆23Updated 3 years ago
- FoolNLTK java version☆82Updated 6 years ago
- 《实体数据挖掘与知识图谱构建》一书的代码和实验数据。☆43Updated 9 years ago
- Details of paper cw2vec☆82Updated 7 years ago
- Text Classification ToolKit☆22Updated 7 years ago
- 新浪微博模拟登陆2014-04-01版☆22Updated 11 years ago
- 无损转换OpenCC词典为HanLP格式☆9Updated 4 years ago
- Item-Based Collaborative Filtering Spark Job (use cosin similarity)☆37Updated 8 years ago