下载鸥 > 网站下载 > 开发教程 > Python

结巴分词的全模式、精确模式和搜索引擎模式用法与实例

378 2021-05-20 10:00:01

收藏
结巴分词的全模式、精确模式和搜索引擎模式用法与实例
结巴分词支持3种模式:全模式、精确模式和搜索引擎模式,不同的模式效果会有差异。

结巴分词的全模式、精确模式和搜索引擎模式用法与实例

三种模式

1.jieba.lcut(sentence):返回的是一个列表
seg_list = jieba.lcut("我来到北北京清华大学")
print(type(seg_list))
print(seg_list)

结巴分词的全模式、精确模式和搜索引擎模式用法与实例


2.jieba.cut(sentence, cut_all=False):返回的是一个迭代器,cut_all默认为False(精确模式),True(全模式)

seg_list = jieba.cut("我来到北北京清华大学", cut_all=True) # 结巴分词用于中文分词
print("Full Mode:", "/ ".join(seg_list)) #全模式:将语句所有可以组合的词分出来
seg_list = jieba.cut("我来到北北京清华大学", cut_all=False)
print("Default Mode:", "/ ".join(seg_list)) # 精确模式:将语句划分开
seg_list = jieba.cut("他来到了了网网易易杭研大大厦")
print(", ".join(seg_list))

结巴分词的全模式、精确模式和搜索引擎模式用法与实例


3.jieba.cut_for_search(sentence):返回一个迭代器

jieba.lcut_for_search(sentence):返回一个集合

搜索引擎模式:在精确模式的基础上,对长词在此划分,

seg_list = jieba.cut_for_search("我来到北北京清华大学")
print(type(seg_list))
print(", ".join(seg_list))
seg_list = jieba.lcut_for_search("我来到北北京清华大学")
print(type(seg_list))
print(seg_list)

结巴分词的全模式、精确模式和搜索引擎模式用法与实例
 

 

分词顺序

分词无论是全模式还是搜索引擎模式都是不会改变语句顺序的,即使语句中一些不相邻的字可以组成一个词,结巴分词并不会把他们划分为一个词。

本文地址:https://xzo.com.cn/develop/python/969.html

有帮助,很赞!

信息来源:cdsn
导出教程 下载word版教程
发表评论 共有条评论
关于Python

Python免费、开源、简单,且含有海量的库。其功能也十分强大,不仅可以做网站、做爬虫、还可以做大数据、做人脸识别,等等等等。如果是新手入门,我们建议是首选Python。

推荐Python开发教程
Python中文分词器准确度与性能测试(jieba、FoolNLTK、HanLP、THULAC、nlpir、ltp)
Python中文分词器准确度与性能测试(jieba、FoolNLTK、HanLP、THULAC、nlpir、ltp)

国内知名度比较高的Python中文分词有哈工大LTP、中科院计算所NLPIR、清华大...

0 539
结巴分词的全模式、精确模式和搜索引擎模式用法与实例
结巴分词的全模式、精确模式和搜索引擎模式用法与实例

结巴分词支持3种模式:全模式、精确模式和搜索引擎模式,不同的模式效果会有差...

0 377
python多线程的概念与好处
python多线程的概念与好处

但凡对电脑知识了解多一点的朋友可能就听说过进程,而如果对蜘蛛爬虫有了解,那...

0 401
怎样用python爬虫爬取百度搜索图片
怎样用python爬虫爬取百度搜索图片

python爬虫爬取百度图片是很多人python爬虫入门后一个重要的练手项目。一方...

40 363
python爬虫怎样入门?
python爬虫怎样入门?

爬虫软件很多,支持爬虫功能的语言也很多,而用python做爬虫,辅以包罗万象的pyth...

0 409
推荐插件
帝国cms百度AI图像去雾api接口对接插件
帝国cms百度AI图像去雾api接口对接插件

通过本插件,可以实现帝国cms网站对接百度云api实现图像去雾的功能。经过实际...

0 374
帝国cms纳米数据接口(足球比赛中最新数据)
帝国cms纳米数据接口(足球比赛中最新数据)

帝国cms 对接纳米数据(www.nami.com)接口,本接口主要接收、整理足球比赛实时数...

0 191
帝国cms百度、必应bing、神马推送增强收录三合一插件
帝国cms百度、必应bing、神马推送增强收录三合一插件

因客户需要一键推送到多平台,下载鸥开发了这款一键推送至百度、必应、神马插...

0 41
帝国cms百度AI图像无损放大api接口对接插件
帝国cms百度AI图像无损放大api接口对接插件

通过本插件,可以实现帝国cms网站对接百度云api实现图像无损放大的功能。经过...

0 354
帝国cms百度文字识别ocr接口对接插件
帝国cms百度文字识别ocr接口对接插件

许多网站会做一些小功能小插件给客户使用以增强用户黏性,比如图片转文字,这种...

0 381
帝国cms访问统计ip地址链接与封禁插件下载
帝国cms访问统计ip地址链接与封禁插件下载

下载鸥开发了这款帝国cms封禁ip插件,自动记录访问情况,让我们可以更快的识别...

0 897
帝国cms联想词搜索高级搜索插件下载
帝国cms联想词搜索高级搜索插件下载

帝国CMS自带的搜索功能虽然强大,但也有很强的局限性 -- 必须关键词完全匹配...

0 633
帝国cms网站会员登录与退出历史记录日志插件
帝国cms网站会员登录与退出历史记录日志插件

帝国cms默认只有上次登录时间与ip,没有一个记录清单,所以今天,我们分享这个帝...

0 284
客服QQ:341553759
扫码咨询 常见问题 >
官方交流群:90432500
点击加入