菜鸟如何使用Hanlp
boss给了个做分词的任务,最开始想用的是结巴分词and正则表达式。后来发现结果并不好,需要一遍一遍筛选【第一个标准筛选出80%的数据,然后制定第二个标准,继续筛选,然后制定第三个标准筛选,等等等等】自己用了一下结巴分词,感觉对于人名,地名,机构名,只是泛泛地使用了一下。在实际分开的时候,并不能很好地分开机构名称。于是转而使用hanlp分词但是hanlp分词的缺点是只有在java上可以用,但是java一向又是我的弱项。所以在这里写一篇博客从头至尾叙述一下怎么样使用hanlp而且,小胖胖把我的电脑锁在北师图书馆柜子里了。我工作没有电脑可用,于是使用小胖的电脑,也就是说,所有的基本变量都需要我自己来配来下,因此也相当于是从一张白纸到使用hanlp的过程。第一步:下载一个jdk到openjdk官网去下一个,直接安装即可。安装过后,要配置三个环境变量,分别是1.JAVA_HOME:C:Program FilesJavajdk1.8.0_732.CLASSPATH: 就是这个jdk打开之后里面的那个lib的目录3.PATH:就是jdk后面的bin目录配置完成之后,在Windows底下的cmd上面...