Python将QQ聊天记录生成词云的示例代码
作者:盛夏温暖流年 发布时间:2022-03-06 03:20:47
在这个情人节前夕,我把现任对象回收掉了,这段感情积攒了太多的失望,也给了我太多的伤害,所以我看到这个活动的第一反应是拒绝的。然而人生嘛,最重要的就是体验,沉浸在过去的回忆里没有意义,积极面对才能让自己更好地重振旗鼓。
所以,当大家都一致地在这个活动里各种秀恩爱时,我决定走一条不一样的路来为单身狗和刚分手的小伙伴们打打气:时间能改变的,是那些原本就不坚定的东西,未来的路还很长,笑一笑,一切都会过去的!
言归正传,我们要做的任务是,把 QQ 分手聊天记录导出,使用 Python 分词后做成分开的桃心形状的词云进行展示。听着就很有意思,来,开干!
步骤一:创建和导出聊天记录
1.创建聊天记录内容
选择 QQ 聊天记录是因为比较简单,而微信导出相对麻烦。考虑到个人隐私问题,我申请了 QQ 小号,和大号之间发了一些分手语录作为提取素材:
2.导出聊天记录
我使用的是TIM,点击右下角的主菜单,选择“设置”:
选择“消息记录” ->> “安全设置” ->> “打开消息管理器” :
选择需要导出的关系人,右键点击“导出消息记录”:
保存到 F:\csdn 目录下,保存类型选择文本文件,命名为 chat.txt:
第一步导出操作完成。
步骤二:安装需要的库
1.安装 jieba 库
pip install jieba -i https://pypi.douban.com/simple/
2.安装 Wordcloud 库
网上有人说直接使用 pip install 安装 Wordcloud 会有问题,所以我们先下载到本地:
Wordcloud 下载链接
选择适合自己环境的安装包(cp 后面的数字代表 Python 版本,一定要对应起来),下载到 Python 安装目录下的 Scripts 文件夹中:
打开cmd,进入该路径,执行安装命令:
pip install wordcloud-1.8.1-cp38-cp38-win_amd64.whl
安装成功截图如下:
步骤三:代码实现
选择一张分开的心图片(分开的心也很美嘛):
在选择生成配色方案的图片时,要求背景白色,边缘越清晰越好。
qqChat.py 代码实现:
import matplotlib.pyplot as plt
from wordcloud import WordCloud
import jieba
from wordcloud import WordCloud, ImageColorGenerator, STOPWORDS
import os
import numpy as np
import PIL.Image as Image
newtext = []
#打开聊天记录文件
for word in open('F:\\csdn\\chat.txt', 'r',encoding='utf-8'):
tmp = word[0:4]
#过滤掉聊天记录的时间和qq名称
if (tmp == "2021"):
continue
tmp = word[0:2]
#print(tmp)
newtext.append(word)
#将过滤后的文本重新写入文件并保存
with open('F:\\csdn\\chat_final.txt', 'w', encoding='utf-8') as f:
for i in newtext:
f.write(i)
#打开新生成的聊天记录文件
text = open('F:\\csdn\\chat_final.txt', 'r',encoding = 'utf-8').read()
word_jieba = jieba.cut(text, cut_all=True)
word_split = " ".join(word_jieba)
#去掉一些意义不大的字
stop_words = set(STOPWORDS)
stop_words.add("的")
stop_words.add("我")
stop_words.add("你")
stop_words.add("是")
stop_words.add("就")
#根据心形图片生成配色方案,这里的路径要配置正确
alice_coloring = np.array(Image.open(os.path.join('F:\\','heart.jpg')))
my_wordcloud = WordCloud(scale=16,background_color="white", max_words=800, stopwords=stop_words, mask=alice_coloring,max_font_size=80, random_state=42,font_path='C:/Windows/Fonts/simhei.ttf')\
.generate(word_split)
image_colors = ImageColorGenerator(alice_coloring)
plt.imshow(my_wordcloud.recolor(color_func=image_colors))
plt.imshow(my_wordcloud)
plt.axis("off")
plt.show()
可以根据自己的需求调整参数,比如如果有一些语气词和无意义的字可以通过配置 stopwords 来进行过滤,最后输入命令运行代码:
python qqChat.py
效果如下,还是很漂亮的。
词云里面频率最高的几个词分别是“爱”,“自己”,“喜欢”,也恰恰是我想表达的:不管一段爱情有多么甜蜜或多么悲伤,始终都不能失去自己,哪怕说再见也要保持骄傲的姿态,每一段人生经历都有它的意义和价值,平和地接受结果就好了。
来源:https://blog.csdn.net/j1231230/article/details/113743564
猜你喜欢
- 本文主要介绍了Opencv图片生成视频,分享给大家,具体如下:生成视频import random as rdimport cv2 as cv
- 按照本文操作和体会,会对sql优化有个基本最简单的了解,其他深入还需要更多资料和实践的学习: 1. 建表: 代码如下:creat
- 一、使用以下命令查看当前安装mysql情况,查找以前是否装有mysqlrpm -qa|grep -i mysql可以看到如下图的所示:显示之
- matlab中创建类似字典的数据结构Matlab中创建struct:d = struct('a','1',&
- 使用递归实现words = ['giraffe', 'elephant', 'ant', &
- 动态添加input并动态添加新验证方式!init状态: 点击“+”后: 验证后:知识点:1 先去官网下载:http://
- python的uuid都是32位的,比较长,处理起来效率比较低,本算法利用62个可打印字符,通过随机生成32位UUID,由于UUID都为十六
- 一、存储引擎上节我们最后说到,SQL 的执行计划是执行器组件调用存储引擎的接口来完成的。那我们可以理解为:MySQL 这个数据库管理系统是依
- 本文实例讲述了Python Web框架之Django框架文件上传功能。分享给大家供大家参考,具体如下:上传方式:- Form表单上传文件-
- 库的管理创建库create database [if not exists] 库名;删除库drop databases [if exists
- 在 Time 包中,定义有一个名为 Duration 的类型和一些辅助的常量:type Duration int64const ( Nano
- numpy和matlab的几点差异Python numpy和matlab都是便捷灵活的科学计算语言,两者具有很多相似之处,但也有一些混淆的地
- 当你用 ASP 编写服务器端应用程序时,必须依靠 ActiveX
- 1、django应用Celerydjango框架请求/响应的过程是同步的,框架本身无法实现异步响应。但是我们在项目过程中会经常会遇到一些耗时
- <% On Error Resume Next Const uploadPath = "/uploads/"
- 本文主要讲述的是Python中的模块的概念,具体如下。模块是python组织代码的基本方式:python的脚本都是用扩展名为py的文本文件保
- 本文实例为大家分享了javascript实现倒计时提示框的具体代码,供大家参考,具体内容如下代码:<!DOCTYPE html>
- 服务:# chkconfig --list 列出所有系统服务# chkconfig --list | grep o
- 箱线图介绍箱线图(Box-plot)又称为盒式图或箱型图,是一种用来显示一组数据分散情况的统计图,它能显示一组数据的上界、下界、中位数、上下
- 一 前言知识追寻者又要放大招了,学完这篇openpyxl第三方库,读者将会懂得如何灵活的读取excel数据,如何创建excel工作表;更新工