1. 首页
  2. 数据库
  3. 其它
  4. Python jieba结巴分词原理及用法解析

Python jieba结巴分词原理及用法解析

上传者: 2020-12-31 14:30:09上传 PDF文件 82.13KB 热度 51次
1、简要说明 结巴分词支持三种分词模式,支持繁体字,支持自定义词典 2、三种分词模式 全模式:把句子中所有的可以成词的词语都扫描出来, 速度非常快,但是不能解决歧义 精简模式:把句子最精确的分开,不会添加多余单词,看起来就像是把句子分割一下 搜索引擎模式:在精简模式下,对长词再度切分 # -*- encoding=utf-8 -*- import jieba if __name__ == '__main__': str1 = '我去北京天安门广场跳舞' a = jieba.lcut(str1, cut_all=True) # 全模式 print('全模式:{}'.format(a
下载地址
用户评论