作者:小伍哥
来源:AI入门学习
上次出了一个在网站「Flourish」画动态条形图的文章【动态条形图视频教程】,需要登录网址很多人可能觉得不方便,现在有大佬出了个python包,只需几行代码就能搞定动态条形图,非常强大,给大家分享下。
一、前期准备工作
1、官方参考文档
GitHub :https://github.com/dexplo/bar_chart_race
说明文档:https://www.dexplo.org/bar_chart_race/
2、软件安装(该安装方法只能安装0.1版本)
pip install bar_chart_race conda install -c conda-forge bar_chart_race
0.2版本需要到github安装
压缩包解压到软件安装目录的/site-packages目录下,利用命令行安装即可
3、安装ffmpeg、ImageMagick
ffmpeg包:不然无法输出 mp4/m4v/mov/等格式的视频,该包比较复杂,需要配置变量环境,具体操作可以看看这个博客:
https://baijiahao.baidu.com/s?id=1660327134602942057&wfr=spider&for=pc
ImageMagick包:如果你要创建GIF,需要安装这个包ImageMagick,安装方法与上述类似。
二、官方数据画图
上述准备都做好了,那就可以开始画图了,利用官方提供的数据,直接加载就可以,我的数据下载没成功,所以自己上传数据绘图,等下回讲怎么自己上传数据。
#加载包 import bar_chart_race as bcr #下载数据 df = bcr.load_dataset('covid19_tutorial') #生成GIF图像 bcr.bar_chart_race(df, 'covid19_horiz.gif') #生成MP4 bcr.bar_chart_race(df, 'covid19_horiz.MP4')
生成的GIF
生成的MP4
三、自己的数据画图
如果是自己的数据,要进行一定的处理,达到画图格式,不然会报错。
#读取数据 df = pd.read_csv('data.csv') #格式处理,需要把日期date转换成索引,不能作为单独一列 df = df.set_index(keys='date') 作者也提供了两个处理数据的函数 bcr.prepare_wide_data bcr.prepare_long_data
原始数据
处理后数据(date转换成了索引)
四、图形美化
作者还提供了很多参数,对图形进行调整和美化,输出的图形更漂亮
1、横转纵 Vertical bars
#orientation='v',.gif变成MP4即可输出视频 bcr.bar_chart_race(df, 'covid19_horiz.gif', orientation='v')
2、升序排序
# 排序方式,sort='asc'-升序 bcr.bar_chart_race(df, 'covid19_horiz.gif', sort='asc')
3、类目数限制,此处设置为最多出现6条
# 设置最多能显示的条目数 n_bars=6 bcr.bar_chart_race(df, 'covid19_horiz.gif', n_bars=6)
4、设置展示类目
# 选取如下5个国家的数据 fixed_order bcr.bar_chart_race(df, 'covid19_horiz.gif', fixed_order=['Iran', 'USA', 'Italy', 'Spain', 'Belgium'])
5、固定坐标轴
#设置数值的最大值,固定数值轴fixed_max bcr.bar_chart_race(df, 'covid19_horiz.gif', fixed_max=True)
6、改变图像帧数
#图像帧数,数值越小,越不流畅。越大,越流畅。默认为10比较流畅,改为3就有些卡顿了 bcr.bar_chart_race(df, 'covid19_horiz.gif', steps_per_period=3)
7、设置帧率,默认为500ms
# 设置20帧的总时间,此处为200ms bcr.bar_chart_race(df, 'covid19_horiz.gif', steps_per_period=20, period_length=200)
8、设置每帧增加的标签时间,默认为False
# 输出gif bcr.bar_chart_race(df, 'covid19_horiz.gif', interpolate_period=True)
9、绘图属性设置
# figsize-设置画布大小,默认(6, 3.5) # dpi-图像分辨率,默认144 # label_bars-显示柱状图的数值信息,默认为True # period_label-显示时间标签信息,默认为True # title-图表标题 bcr.bar_chart_race(df, 'covid19_horiz.gif', figsize=(5, 3), dpi=100, label_bars=False, period_label={'x': .99, 'y': .1, 'ha': 'right', 'color': 'red'}, title='COVID-19 Deaths by Country')
10、配置标签文字大小
# bar_label_size-柱状图标签文字大小 # tick_label_size-坐标轴标签文字大小 # title_size-标题标签文字大小 bcr.bar_chart_race(df, 'covid19_horiz.gif', bar_label_size=4, tick_label_size=5, title='COVID-19 Deaths by Country', title_size='smaller')
11、全局字体属性设置
# shared_fontdict-全局字体属性 bcr.bar_chart_race(df, 'covid19_horiz.gif', title='COVID-19 Deaths by Country', shared_fontdict={'family': 'Helvetica', 'weight': 'bold', 'color': 'rebeccapurple'})
12、透明度,边框等设置
# bar_kwargs-条形图属性设置参数 bcr.bar_chart_race(df, 'covid19_horiz.gif', bar_kwargs={'alpha': .2, 'ec': 'black', 'lw': 3})
13、日期格式设置
# 设置日期格式,默认为'%Y-%m-%d' bcr.bar_chart_race(df, 'covid19_horiz.gif', period_fmt='%b %-d, %Y')
14、改日期标签为数值格式
# 设置日期标签为数值 bcr.bar_chart_race(df.reset_index(drop=True), 'covid19_horiz.gif', interpolate_period=True, period_fmt='Index value - {x:.2f}')
15、添加汇总统计
#设置文本位置、数值、大小、颜色等 def summary(values, ranks): total_deaths = int(round(values.sum(), -2)) s = f'Total Deaths - {total_deaths:,.0f}' return {'x': .99, 'y': .05, 's': s, 'ha': 'right', 'size': 8} # 添加文本 bcr.bar_chart_race(df, 'covid19_horiz.gif', period_summary_func=summary
16、添加垂直条参考线(平均值、分位数等)
# 设置垂直条数值,分位数 def func(values, ranks): return values.quantile(.9) # 添加垂直条 bcr.bar_chart_race(df, 'covid19_horiz.gif', perpendicular_bar_func=func)
17、设置柱状图颜色
'dark12' is the default colormap. If there are more than 10 columns, then the default colormap will be 'dark24'
# 设置柱状图颜色 bcr.bar_chart_race(df, 'covid19_horiz.gif', cmap='accent')
18、颜色不重复
#filter_column_colors保证颜色不重复 bcr.bar_chart_race(df, 'covid19_horiz.gif', cmap='accent', filter_column_colors=True)
19、中文支持配置
中文配置只需在第三方库的_make_chart.py文件中,加入如下三行代码。
#中文显示 plt.rcParams['font.sans-serif'] = ['SimHei'] #Windows plt.rcParams['font.sans-serif'] = ['Hiragino Sans GB'] #Mac plt.rcParams['axes.unicode_minus'] = False
20、自定义颜色
此外通过在「_colormaps.py」文件中添加颜色信息,经cmap引用,即可自定义配置颜色。
colormaps = { "new_colors": [ '#ff812c', '#ff5a5a', '#00c5d2', '#a64dff', '#4e70f0', '#f95dba', '#ffce2b']}
——热门课程推荐:
想从事业务型数据分析师,您可以点击>>>“数据分析师”了解课程详情;
想从事大数据分析师,您可以点击>>>“大数据就业”了解课程详情;
想成为人工智能工程师,您可以点击>>>“人工智能就业”了解课程详情;
想了解Python数据分析,您可以点击>>>“Python数据分析师”了解课程详情;
想咨询互联网运营,你可以点击>>>“互联网运营就业班”了解课程详情;
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
以下文章来源于数有道 ,作者数据星爷 SQL查询是数据分析工作的基础,也是CDA数据分析师一级的核心考点,人工智能时代,AI能为 ...
2025-02-19在当今这个数据驱动的时代,几乎每一个业务决策都离不开对数据的深入分析。而其中,指标波动归因分析更是至关重要的一环。无论是 ...
2025-02-18当数据开始说谎:那些年我们交过的学费 你有没有经历过这样的场景?熬了三个通宵做的数据分析报告,在会议上被老板一句"这数据靠 ...
2025-02-17数据分析作为一门跨学科领域,融合了统计学、编程、业务理解和可视化技术。无论是初学者还是有一定经验的从业者,系统化的学习路 ...
2025-02-17挖掘用户价值本质是让企业从‘赚今天的钱’升级为‘赚未来的钱’,同时让用户从‘被推销’变为‘被满足’。询问deepseek关于挖 ...
2025-02-17近来deepseek爆火,看看deepseek能否帮我们快速实现数据看板实时更新。 可以看出这对不知道怎么动手的小白来说是相当友好的, ...
2025-02-14一秒精通 Deepseek,不用找教程,不用买资料,更不用报一堆垃圾课程,所有这么去做的,都是舍近求远,因为你忽略了 deepseek 的 ...
2025-02-12自学 Python 的关键在于高效规划 + 实践驱动。以下是一份适合零基础快速入门的自学路径,结合资源推荐和实用技巧: 一、快速入 ...
2025-02-12“我们的利润率上升了,但销售额却没变,这是为什么?” “某个业务的市场份额在下滑,到底是什么原因?” “公司整体业绩 ...
2025-02-08活动介绍 为了助力大家在数据分析领域不断精进技能,我们特别举办本期打卡活动。在这里,你可以充分利用碎片化时间在线学习,让 ...
2025-02-071、闺女,醒醒,媒人把相亲的带来了。 我。。。。。。。 2、前年春节相亲相了40个, 去年春节相亲50个, 祖宗,今年你想相多少个 ...
2025-02-06在数据科学的广阔领域中,统计分析与数据挖掘占据了重要位置。尽管它们常常被视为有关联的领域,但两者在理论基础、目标、方法及 ...
2025-02-05在数据分析的世界里,“对比”是一种简单且有效的方法。这就像两个女孩子穿同一款式的衣服,效果不一样。 很多人都听过“货比三 ...
2025-02-05当我们只有非常少量的已标记数据,同时有大量未标记数据点时,可以使用半监督学习算法来处理。在sklearn中,基于图算法的半监督 ...
2025-02-05考虑一种棘手的情况:训练数据中大部分样本没有标签。此时,我们可以考虑使用半监督学习方法来处理。半监督学习能够利用这些额 ...
2025-02-04一、数学函数 1、取整 =INT(数字) 2、求余数 =MOD(除数,被除数) 3、四舍五入 =ROUND(数字,保留小数位数) 4、取绝对值 =AB ...
2025-02-03作者:CDA持证人 余治国 一般各平台出薪资报告,都会哀嚎遍野。举个例子,去年某招聘平台发布《中国女性职场现状调查报告》, ...
2025-02-02真正的数据分析大神是什么样的呢?有人认为他们能轻松驾驭各种分析工具,能够从海量数据中找到潜在关联,或者一眼识别报告中的数 ...
2025-02-01现今社会,“转行”似乎成无数职场人无法回避的话题。但行业就像座围城:外行人看光鲜,内行人看心酸。数据分析这个行业,近几年 ...
2025-01-31本人基本情况: 学校及专业:厦门大学经济学院应用统计 实习经历:快手数据分析、字节数据分析、百度数据分析 Offer情况:北京 ...
2025-01-30