推荐!国外程序员整理的机器学习资源大全 - 博客 - 伯乐在线
Java
自然语言处理
- CoreNLP―斯坦福大学的CoreNLP提供一系列的自然语言处理工具,输入原始英语文本,可以给出单词的基本形式(下面Stanford开头的几个工具都包含其中)。
- Stanford Parser―一个自然语言解析器。
- Stanford POS Tagger ―一个词性分类器。
- Stanford Name Entity Recognizer―Java实现的名称识别器
- Stanford Word Segmenter―分词器,很多NLP工作中都要用到的标准预处理步骤。
- Tregex, Tsurgeon and Semgrex ―用来在树状数据结构中进行模式匹配,基于树关系以及节点匹配的正则表达式(名字是"tree regular expressions"的缩写)。
- Stanford Phrasal:最新的基于统计短语的机器翻译系统,java编写
- Stanford Tokens Regex―用以定义文本模式的框架。
- Stanford Temporal Tagger―SUTime是一个识别并标准化时间表达式的库。
- Stanford SPIED―在种子集上使用模式,以迭代方式从无标签文本中学习字符实体
- Stanford Topic Modeling Toolbox ―为社会科学家及其他希望分析数据集的人员提供的主题建模工具。
- Twitter Text Java―Java实现的推特文本处理库
- MALLET -―基于Java的统计自然语言处理、文档分类、聚类、主题建模、信息提取以及其他机器学习文本应用包。
- OpenNLP―处理自然语言文本的机器学习工具包。
- LingPipe ―使用计算机语言学处理文本的工具包。
Read full article from 推荐!国外程序员整理的机器学习资源大全 - 博客 - 伯乐在线
No comments:
Post a Comment