国产成人AV无码一二三区,少女1到100集,国产精品久久久久精品综合紧,巜公妇之诱感肉欲HD在线播放

文章 > 爬虫进阶 > jieba库的运用

jieba库的运用

头像

流芳

2020-05-26 14:17:265382浏览 · 0收藏 · 0评论

三十年河东,三十年河西,莫欺少年穷!年仅15岁的萧家废物,于此地,立下了誓言,从今以后便一步步走向斗气大陆巅峰!这里是属于斗气的世界,没有花俏艳丽的魔法,有的,仅仅是繁衍到巅峰的斗气!

《斗破苍穹》可谓玄幻小说的巅峰之作,曾经痴迷到彻夜看小说,回不到的过去,等不到的未来!今天就利用python的jieba库以及在线制作词云工具TAGUL,制作《斗破苍穹》词云。

步骤

jieba分词

首先,通过pip3 install jieba安装jieba库,随后在网上下载《斗破苍穹》小说及停用词表。代码如下:

import jieba.analyse

path = '小说路径'
fp = open(path,'r',encoding='utf-8')
content = fp.read()
try:
    jieba.analyse.set_stop_words('停用词表路径')    
    tags = jieba.analyse.extract_tags(content, topK=100, withWeight=True)    
    for item in tags:
        print(item[0]+'\t'+str(int(item[1]*1000)))
finally:
     fp.close()

大家运行程序可能会报错,是编码问题,我们这时需打开下载的txt文档,另存为,选择utf-8编码即可。

08.jpg

运行部分结果图:

08.jpg

词云制作

(1)打开taglue官网,点击import words,把运行的结果copy过来。
(2)选择形状,在这里是网上下载的图片进行的导入。
(3)选择字体。
(4)点击Visualize生成图片。

09.jpg

《斗破苍穹》词云

10.jpg

在这个斗气大陆上,只有强者才可以生存,萧炎在药老及丹药的帮助下不断修炼,拥有多种异火,有着极强的灵魂感知力;在不断修炼中,遇到了小医仙,纳兰,美杜莎,紫研等人,成为斗气大陆上的强者而奋斗。

更多python数据分析相关文章请关注python自学网

关注

关注公众号,随时随地在线学习

本教程部分素材来源于网络,版权问题联系站长!

欧美大片| 《停不了的爱》床戏| 第一章激情艳妇| 成品PPT网站大片入口| 交替轮换4| 苍老师巅峰电影在线观看| 芒果浏览器| 动物扌桑辶鬲的| 年轻的瑜伽教练2| 吻戏| 特殊按摩治疗师| 王娟被老赵一夜干4次| 老婆被快递员干了一下午| 《完美邻居2》电影在线观看 | 聊斋艳谭之灯草和尚| 美腿视频| 九九在线观看免费播放大全电视剧| 日亚M码是日本的还是中国的| 满18岁免费观看高清电视剧大全| 国产精品一区| 妈妈你真棒里面的插曲叫什么| 床戏| 鲁鲁射击免费播放电视剧全部| 男同网站| 同学的母亲中字ID| 强壮的公2伦理| 女性真人外生图片大全| 一夹一摇怎么练出来| 爱动漫| 温柔的房东夫人免费观看电视剧| 胸吻| 黑色蕾丝女装大长腿| 暴躁少女10-16岁| 美国禁忌| 麻花视频3.2.2| 狗配女人宝典视频| 鲜肉3| 两个男人睡一个女人什么心理呢 | 倩女幽魂甲士| 口咬的10个绝招图片| 舌头伸进去添的我爽高潮