实例解析:Python jieba库用法(具有不错的参考价值)

今天为大家带来的内容是:
实例解析:Python jieba库用法(具有不错的参考价值)

文章内容主要介绍了Python jieba库用法及实例解析,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,喜欢的记得点赞转发关注收藏不迷路哦!!!

1、jieba库基本介绍

(1)jieba库概述

jieba是优秀的中文分词第三方库

  • - 中文文本需要通过分词获得单个的词语
  • - jieba是优秀的中文分词第三方库,需要额外安装
  • - jieba库提供三种分词模式,最简单只需掌握一个函数

(2)、jieba分词的原理

Jieba分词依靠中文词库

- 利用一个中文词库,确定汉字之间的关联概率

- 汉字间概率大的组成词组,形成分词结果

- 除了分词,用户还可以添加自定义的词组

jieba库使用说明

(1)jieba分词的三种模式

精确模式、全模式、搜索引擎模式

  • - 精确模式:把文本精确的切分开,不存在冗余单词
  • - 全模式:把文本中所有可能的词语都扫描出来,有冗余
  • - 搜索引擎模式:在精确模式基础上,对长词再次切分

(2)、jieba库常用函数

实例解析:Python jieba库用法(具有不错的参考价值)

2.jieba应用实例

实例解析:Python jieba库用法(具有不错的参考价值)

实例解析:Python jieba库用法(具有不错的参考价值)

实例解析:Python jieba库用法(具有不错的参考价值)

3.利用jieba库统计三国演义中任务的出场次数

实例解析:Python jieba库用法(具有不错的参考价值)

实例解析:Python jieba库用法(具有不错的参考价值)

统计了次数对多前十五个名词,曹操不愧是一代枭雄,第一名当之无愧,但是我们会发现得到的数据还是需要进一步处理,比如一些无用的词语,一些重复意思的词语。

以上就是本文的全部内容,希望对大家的学习有所帮助!!!

最后多说一句,小编是一名python开发工程师,这里有我自己整理了一套最新的python系统学习教程,包括从基础的python脚本到web开发、爬虫、数据分析、数据可视化、机器学习等。想要这些资料的可以关注小编,并在后台私信小编:“07”即可领取。


分享到:


相關文章: