我的编程空间,编程开发者的网络收藏夹
学习永远不晚

python数据可视化Seaborn绘制山脊图

短信预约 -IT技能 免费直播动态提醒
省份

北京

  • 北京
  • 上海
  • 天津
  • 重庆
  • 河北
  • 山东
  • 辽宁
  • 黑龙江
  • 吉林
  • 甘肃
  • 青海
  • 河南
  • 江苏
  • 湖北
  • 湖南
  • 江西
  • 浙江
  • 广东
  • 云南
  • 福建
  • 海南
  • 山西
  • 四川
  • 陕西
  • 贵州
  • 安徽
  • 广西
  • 内蒙
  • 西藏
  • 新疆
  • 宁夏
  • 兵团
手机号立即预约

请填写图片验证码后获取短信验证码

看不清楚,换张图片

免费获取短信验证码

python数据可视化Seaborn绘制山脊图

1. 引言

山脊图一般由垂直堆叠的折线图组成,这些折线图中的折线区域间彼此重叠,此外它们还共享相同的x轴.

山脊图经常以一种相对不常见且非常适合吸引大家注意力的紧凑图的形式表现。观察上图,我们给其起名叫Ridge plot是非常恰当的,因为上述图表看起来确实很像山的脊背.此外,上述图像还有另一个称呼叫做Joy Plots–这主要是因为Joy Division乐队在如下专辑封面上采用了这种可视化形式.

2. 举个栗子

在介绍完山脊图的由来背景后,现在让我们来举个例子。我们使用以下数据集,主要包含 Netflix 的作品及对应的 IMDB 分数。

import matplotlib.pyplot as plt
import seaborn as sns
import pandas as pd
df = pd.read_csv('./data/film.csv')
languages = ['English', 'Hindi', 'Spanish', 
             'French', 'Italian', 'Portuguese']
df_filtered = df[df['Language'].isin(languages)]
df_filtered

运行结果如下:

上表中从左往右,依次为ID,电影名称,电影类型,首映日期,电影长度,IMDB评分,以及电影语种.

接下来我们首先使用 Seaborns FacetGrid库来为每个语言类别的电影创建不同IMDB下的概率密度分布曲线图。实现这个功能很简单,仅需要对数据表中相应名称字段来按值进行分组统计即可。

代码如下:

sns.set_theme(style="white")
g = sns.FacetGrid(df_filtered, row="Language")
g.map_dataframe(sns.kdeplot, x="IMDB Score")
g.set(ylabel="")

结果如下:

上述实现采用的为默认的参数配置,横轴表示IMDB分数,纵轴表示对应不同语种电影在不同IMDB得分下的概率. 从上述图例中可以看出单个语种电影评分的概率密度分布,但是很难查看不同语种间的对比分布。

接着我们尝试来改进显示效果,我们通过设置FacetGrid函数中相应的参数来让图表变得更宽更短。

代码如下:

sns.set_theme(style="white")
g = sns.FacetGrid(df_filtered, row="Language", aspect=9, height=1.2)
g.map_dataframe(sns.kdeplot, x="IMDB Score")
g.set(ylabel="")

结果如下:

上述改进虽然可以让数据间的对比变得明显一些,但是这个可视化从视觉效果上看并没有太大的吸引力。

观察上图,我们其实并没有多少人去关注左侧的Y轴信息,我们更关注的是数据的形状.这就意味着我们这里可以删除Y轴.

代码如下:

sns.set_theme(style="white")
g = sns.FacetGrid(df_filtered, row="Language", aspect=9, height=1.2)
g.map_dataframe(sns.kdeplot, x="IMDB Score")
g.set_titles("")
g.set(yticks=[],ylabel="")
g.despine(left=True)

运行结果如下:

3.山脊图

经过我们的优化,上述不同语种电影的IMDB得分概率密度分布还是不够直观.
接下来我们一步一步来介绍我们的终结法宝–山脊图.

首先,我们需要确保背景是透明的。

sns.set_theme(style="white", rc={"axes.facecolor": (0, 0, 0, 0)})

接着,我们需要填充线条的内部区域。

g.map_dataframe(sns.kdeplot, x="IMDB Score", fill=True, alpha=1)

上述操作后,不同语种间的区域会出现重叠,这时我们还需要区分重叠部分。

我们通过以下代码进行区分:

sns.set_theme(style="white", rc={"axes.facecolor": (0, 0, 0, 0)})
g = sns.FacetGrid(df_filtered, row="Language", aspect=9, height=1.2)
g.map_dataframe(sns.kdeplot, x="IMDB Score", fill=True, alpha=1)
g.map_dataframe(sns.kdeplot, x="IMDB Score", color='black')
g.fig.subplots_adjust(hspace=-.5)
g.set_titles("")
g.set(yticks=[])
g.despine(left=True)

运行结果如下:

到目前位置,我们实现了我们第一版的山脊图,接着我们可以根据需要来自定义扩展它。
FacetGrid函数非常适合创建多个可视化图例,并且 .map 和 .map_dataframe 方法可以让我们与所有子图进行交互。

代码如下:

sns.set_theme(style="white", rc={"axes.facecolor": (0, 0, 0, 0), 'axes.linewidth':2})
palette = sns.color_palette("Set2", 12)
g = sns.FacetGrid(df_filtered, palette=palette, row="Language", hue="Language", aspect=9, height=1.2)
g.map_dataframe(sns.kdeplot, x="IMDB Score", fill=True, alpha=1)
g.map_dataframe(sns.kdeplot, x="IMDB Score", color='black')
def label(x, color, label):
    ax = plt.gca()
    ax.text(0, .2, label, color='black', fontsize=13,
            ha="left", va="center", transform=ax.transAxes)
    
g.map(label, "Language")
g.fig.subplots_adjust(hspace=-.5)
g.set_titles("")
g.set(yticks=[], xlabel="IMDB Score")
g.despine( left=True)
plt.suptitle('Netflix Originals - IMDB Scores by Language', y=0.98)

运行结果如下:

4.扩展

最后,我们可以使用下面代码来复制Joy Division 专辑封面的可视化效果。

代码如下:

import pandas as pd
import seaborn as sns
import matplotlib.pyplot as plt

if __name__ == "__main__":
    url = "./data/pulsar.csv"
    df = pd.read_csv(url, header=None)
    df = df.stack().reset_index()
    df.columns = ['idx', 'x', 'y']
    sns.set_theme(rc={"axes.facecolor": (0, 0, 0, 0), 'figure.facecolor':'#000000', 'axes.grid':False})
    g = sns.FacetGrid(df, row='idx', aspect=50, height=0.4)
    # Draw the densities in a few steps
    g.map(sns.lineplot, 'x', 'y', clip_on=False, alpha=1, linewidth=1.5)
    g.map(plt.fill_between, 'x', 'y', color='#000000')
    g.map(sns.lineplot, 'x', 'y', clip_on=False, color='#ffffff', lw=2)
    # Set the subplots to overlap
    g.fig.subplots_adjust(hspace=-0.95)
    g.set_titles("")
    g.set(yticks=[], xticks=[], ylabel="", xlabel="")
    g.despine(bottom=True, left=True)
    plt.savefig('joy.png', facecolor='#000000')

运行结果如下:

5.结论

总的来说,山脊图非常适合关注数据的分布对比。山脊图以吸引人的美学可以引起观众的共鸣,使它们成为向用户介绍数据分布对比分析时的绝佳选择。

到此这篇关于python数据可视化Seaborn绘制山脊图的文章就介绍到这了,更多相关Seaborn绘制山脊图内容请搜索编程网以前的文章或继续浏览下面的相关文章希望大家以后多多支持编程网!

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

python数据可视化Seaborn绘制山脊图

下载Word文档到电脑,方便收藏和打印~

下载Word文档

猜你喜欢

如何使用python数据可视化Seaborn绘制山脊图

这篇文章主要介绍如何使用python数据可视化Seaborn绘制山脊图,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!1. 引言山脊图一般由垂直堆叠的折线图组成,这些折线图中的折线区域间彼此重叠,此外它们还共享相同的x
2023-06-22

python数据可视化之饼状图的绘制

本篇文章给大家带来了关于python的相关知识,其中主要整理了饼状图的绘制相关问题,Pyplot 包含一系列绘图函数的相关函数,其中pie()函数可以绘制饼状图,下面一起来看一下,希望对大家有帮助。Pyplot 是 Matplotlib 的子库,提供了和 MATLAB 类似的绘图 API。 Pyplot 包含一系列绘图函数的相关函数,其中pie()函数可以绘制饼状图 用的时候,我们可以使用 impo
2022-06-22

如何使用python数据可视化Seaborn画热力图

这篇文章主要为大家展示了“如何使用python数据可视化Seaborn画热力图”,内容简而易懂,条理清晰,希望能够帮助大家解决疑惑,下面让小编带领大家一起研究并学习一下“如何使用python数据可视化Seaborn画热力图”这篇文章吧。1.
2023-06-22

python数据可视化之饼状图怎么绘制

这篇文章主要介绍“python数据可视化之饼状图怎么绘制”的相关知识,小编通过实际案例向大家展示操作过程,操作方法简单快捷,实用性强,希望这篇“python数据可视化之饼状图怎么绘制”文章能帮助大家解决问题。Pyplot 是 Matplot
2023-07-02

Python数据可视化之用Matplotlib绘制常用图形

目录一、散点图二、柱状图三、直方图四、扇形图总结一、散点图 散点图用两组数据构成多个坐标点,考察坐标点的分布,判断两变量之间是否存在某种关联或总结坐标点的分布模式。 特点:判断变量之间是否存在数量关联趋势,表示离群点的分布规律。散点图绘制:
2022-06-02

编程热搜

  • Python 学习之路 - Python
    一、安装Python34Windows在Python官网(https://www.python.org/downloads/)下载安装包并安装。Python的默认安装路径是:C:\Python34配置环境变量:【右键计算机】--》【属性】-
    Python 学习之路 - Python
  • chatgpt的中文全称是什么
    chatgpt的中文全称是生成型预训练变换模型。ChatGPT是什么ChatGPT是美国人工智能研究实验室OpenAI开发的一种全新聊天机器人模型,它能够通过学习和理解人类的语言来进行对话,还能根据聊天的上下文进行互动,并协助人类完成一系列
    chatgpt的中文全称是什么
  • C/C++中extern函数使用详解
  • C/C++可变参数的使用
    可变参数的使用方法远远不止以下几种,不过在C,C++中使用可变参数时要小心,在使用printf()等函数时传入的参数个数一定不能比前面的格式化字符串中的’%’符号个数少,否则会产生访问越界,运气不好的话还会导致程序崩溃
    C/C++可变参数的使用
  • css样式文件该放在哪里
  • php中数组下标必须是连续的吗
  • Python 3 教程
    Python 3 教程 Python 的 3.0 版本,常被称为 Python 3000,或简称 Py3k。相对于 Python 的早期版本,这是一个较大的升级。为了不带入过多的累赘,Python 3.0 在设计的时候没有考虑向下兼容。 Python
    Python 3 教程
  • Python pip包管理
    一、前言    在Python中, 安装第三方模块是通过 setuptools 这个工具完成的。 Python有两个封装了 setuptools的包管理工具: easy_install  和  pip , 目前官方推荐使用 pip。    
    Python pip包管理
  • ubuntu如何重新编译内核
  • 改善Java代码之慎用java动态编译

目录