ansj源码下载

上传:sid1749 浏览: 33 推荐: 0 文件:ZIP 大小:24.05MB 上传时间:2019-07-17 05:22:12 版权申诉
文本分析源码中文分词(ChineseWordSegmentation)指的是将一个汉字序列切分成一个一个单独的词。分词就是将连续的字序列按照一定的规范重新组合成词序列的过程。我们知道,在英文的行文中,单词之间是以空格作为自然分界符的,而中文只是字、句和段能通过明显的分界符来简单划界,唯独词没有一个形式上的分界符,虽然英文也同样存在短语的划分问题,不过在词这一层上,中文比之英文要复杂的多、困难的多。
上传资源
用户评论