2020不平凡的90天,Python分析三个月微博热搜数据带你回顾
前言
文的文字及图片来源于网络,仅供学习、交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理。
作者:刘早起早起
PS:如有需要Python学习资料的小伙伴可以加点击下方链接自行获取http://t.cn/A6Zvjdun
北京时间4月3日凌晨,全球新冠病毒感染人数突破100万,死亡人数超过5万。而这一切都在2020年刚开始的三个月内发生。可能你觉得这三个月很快,有些事情已经逐渐忘记,而互联网的记忆不会消失,数据也会说话。因此作者抓取了2020年1月1日至4月2日的每天微博排名前50条热搜共近5000条数据,通过分析微博热搜数据带你回顾这不平凡的90天。
Part1
首先我们制作这三个月全部热搜的词云图
可以看到,疫情下的微博热搜主要以疫情相关词汇组成,我们再根据每一条热搜的热度大小进行排序,得到这三个月中热度最高的十条热搜,猜猜是什么
令人惊讶的的是,在这三个月内的每日热度排名前十的热搜中娱乐相关的热搜为4条,疫情相关热搜为5条。并且第一第二的并不是疫情相关热搜,而是两位明星相关的资讯
Part2
我们接着提取中国各省市在热搜中出现的次数,以此来代表网友对各省的关注度绘制关注度地图与词云图
从热搜出现的省份来看最受关注的还是湖北省,其次是北京、上海、浙江、四川等省市,从热搜出现的城市来看,武汉、广州、北京、杭州、上海等城市出现次数较多。同时值得关注的是:境外和公主号邮轮也频上热搜。
Part3 疫情来袭
现在我们分析三个月内每天50条热搜中疫情相关热搜数量的变化,
不难看出,在1月19日之前,关于疫情相关的热搜基本保持在5条以下,甚至有几天并未出现相关热搜,但是自1月20日开始,突然暴增20+条,并且最高曾一天有30+条相关热搜,其中最主要集中在1月23至25日,我们再回顾那几天的热搜
可以看到,虽然正值新春佳节,但是全国网友的关注点基本都集中在疫情,在湖北,在武汉。而现在今天这条热搜已经有10亿+的阅读了。当然在这场疫情之下的热搜还有很多值得关注的热搜,比如河南硬核防疫频登热搜、买不到的口罩也曾霸屏微博、封闭式管理虽受吐槽但是颇有成效
Part4 逆行驰援
可能上面的热搜已经从记忆里淡去,但是你必须要记得的热搜应是全国各地医护人员驰援湖北,我们提取相关关键词的热搜并制作词云图
可以看到,从1月23日也就是我们刚刚分析的疫情热搜暴涨的那几天开始各地医生便逆行驰援武汉;2月1日,李兰娟带队驰援武汉;2月4日,再增加2000名医护人员支援湖北;2月7日,一省包一市支援湖北;2月13日,2月14日,四川、辽宁再派2批医疗队伍驰援湖北;2月20日,重庆调拨20万毫升血浆增援湖北⋯⋯
Part5 乌云散去
正是有着上面一群勇敢逆行的医护人员,加上大家的努力,疫情的乌云渐渐散去,因此三月的热搜主旋律除了防疫还有复工和开学
而说到开学,那就少不了小学生被钉钉支配的恐惧,我们提取相关热搜
再看看学生们的反馈
Part6
最后我们对近一周的热搜进行分析可以发现,疫情依旧是大家关注热点,但是侧重点已经从国内转向国外,并且无症状感染者已经引起了大家的关注,所以各位依旧要做好防护措施,不能对防疫掉以轻心!
以上就是对微博热搜数据的一些分析,不知是否唤醒了你的某些回忆,如果你也对该数据感兴趣希望挖掘更多的信息可以在后台回复微博获取。
注:本文所有分析使用的数据均采集于新浪微博公开数据 ,采样时间为每天23点。
2020不平凡的90天,Python分析三个月微博热搜数据带你回顾的更多相关文章
- Python爬取微博热搜以及链接
基本操作,不再详述 直接贴源码(根据当前时间创建文件): import requests from bs4 import BeautifulSoup import time def input_to_ ...
- EDG夺冠!用Python分析22.3万条数据:粉丝都疯了!
一.EDG夺冠信息 11月6日,在英雄联盟总决赛中,EDG战队以3:2战胜韩国队,获得2021年英雄联盟全球总决赛冠军,这个比赛在全网各大平台也是备受瞩目: 1.微博热搜第一名,截止2021-11-1 ...
- Python网络爬虫-爬取微博热搜
微博热搜的爬取较为简单,我只是用了lxml和requests两个库 url=https://s.weibo.com/top/summary?Refer=top_hot&topnav=1& ...
- Python 数据分析实战 | 用数据带你回顾乔丹的职业生涯
乔丹是联盟上下公认的历史第一人,芝加哥公牛在他带领下几乎统治了上世纪 90 年代 NBA 整整 10 年,包括分别在 91-93 赛季和 96-98 赛季拿下的两次三连冠,要知道,NBA72 年历史上 ...
- 用Python分析北京市蛋壳公寓租房数据
本文的文字及图片来源于网络,仅供学习.交流使用,不具有任何商业用途,如有问题请及时联系我们以作处理 近期,蛋壳公寓"爆雷"事件持续发酵,期间因拖欠房东房租与租客退款,蛋壳公寓陷入讨 ...
- 【可视化分析案例】用python分析B站Top100排行榜数据
一.数据源 之前,我分享过一期爬虫,用python爬取Top100排行榜: 最终数据结果,是这样的: 在此数据基础上,做python可视化分析. 二.数据读取 首先,读取数据源: # 读取csv数据 ...
- python:王思聪究竟上了多少次热搜?
前言 文的文字及图片来源于网络,仅供学习.交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理. 作者: 朱小五 凹凸玩数据 PS:如有需要Python学习资料的小伙伴可以加 ...
- 五月天的线上演唱会你看了吗?用Python分析网友对这场线上演唱会的看法
前言 本文的文字及图片来源于网络,仅供学习.交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理. 作者:CDA数据分析师 豆瓣9.4分!这场线上演唱会到底多好看? 首先让我 ...
- Python爬虫+可视化教学:爬取分析宠物猫咪交易数据
前言 各位,七夕快到了,想好要送什么礼物了吗? 昨天有朋友私信我,问我能用Python分析下网上小猫咪的数据,是想要送一只给女朋友,当做礼物. Python从零基础入门到实战系统教程.源码.视频 网上 ...
随机推荐
- navicat使用、pymysql连接数据库
内容回顾 select distinct 字段1,字段2,... from 表名 where 分组之前的过滤条件 group by 分组条件 having 分组之后过滤条件 order by 排序字段 ...
- python环境变量忘记配置
Python安装没有勾选配置环境变量安装 解决方法一: 于是,便用安装包卸载后重新安装. 重新安装勾选 安装成功 方法二: 配置环境变量 A.右键点击“我的电脑”,点击“属性”: B.在弹出的界面中点 ...
- Servlet(五)----ServletContext对象
## ServletContext对象 1.概念:代表整个web应用,可以和程序的容器(服务器)来通信 2.获取: 1.通过request对象获取 request.getServletContext ...
- CF1324B Yet Another Palindrome Problem 题解
原题链接 CF 127个测试点,好评 简要题意: 多组数据,问数组中是否有长度 \(\geq 3\) 的回文子序列. 我们需要找到本质. 题目不让我们求这个长度,只让我们判断,这是为什么呢? 如果答案 ...
- Javascript之盒子拖拽(跟随鼠标、边界限定、轨迹回放)
本文通过拖拽案例,实现"跟随鼠标.边界限定.轨迹回放"三大效果: 完整代码中有详尽注释,故不再进行细致讲解: 对于案例中需要注意的重点或易错点问题,会总结在最后. 效果图(仅演示左 ...
- pycharm创建虚拟环境venv和添加依赖库package
1.创建虚拟环境 因为项目采用不同版本的python,所依赖的库的版本也不一样,为了避免版本冲突,为每一个项目每个python版本创建一个虚拟环境,环境中所使用的依赖库也是独立存在,不会被其他版本或其 ...
- Sprinboot 整合 RabbitMQ,RabbitMQ 消息重试机制
当消费者消费消息的时候,出现错误,RabbitMQ 本身会有
- ajax实现图片上传与进度条
这里使用的是bootstract的一个插件来实现 详情请查看文档中的进度条 https://v3.bootcss.com/components/ 引入必要的文件 <link href=" ...
- nginx负载均衡例子
upstream demo { ip_hash;//客户连接后, 一直用这个IP,直到会话结束,否则,动态程序可能会在换IP后出错 server 192.168.1.1:80 weight=5 | d ...
- 面试刷题31:分布式ID设计方案
面试中关于分布式的问题很多.(分布式事务,基本理论CAP,BASE,分布式锁)先来一个简单的. 简单说一下分布式ID的设计方案? 首先要明确在分布式环境下,分布式id的基本要求. 1, 全局唯一,在分 ...