百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 编程网 > 正文

可视化神器Plotly玩转小提琴图 小提琴图 分析

yuyutoo 2024-10-21 12:06 2 浏览 0 评论

大家好,本文介绍如何利用Plotly来绘制小提琴图,是一种统计类的图形,基于两种方法实现:

  • 基于plotly_express
  • 基于plotly.graph_objects

一、小提琴图

看下实际绘制的小提琴图效果:

那究竟什么是小提琴图?

小提琴图(Violin Plot)是一种用来显示数据分布和概率密度的图形。


它结合了之前介绍的箱型图和密度图的双重特征,能够用来显示数据的分布形状。


三、导入库及数据

先导入需要的ku:

import numpy as np
import pandas as pd
import plotly_express as px
import plotly.graph_objects as go

本文中使用的pandas中自带的消费数据:

# 采用的是消费数据tips
tips = px.data.tips()
tips.head()

四、基于点的小提琴图

首先绘制的是基于数据点的小提琴图:

fig = px.strip(
    tips,   # 指定数据
    x='day',   # xy轴
    y='total_bill',
    color='day'  # 颜色
    )

fig.show()

根据4个day的取值来分别绘制小提琴图:

五、基于Plotly_Express实现

5.1 基础小提琴图

fig = px.violin(tips,y="total_bill")  # 使用total_bill数据
fig.show()

换了一份数据再绘图:

fig = px.violin(tips,y="tip")  # 使用的是小费tip
fig.show()

5.2 带数据点的小提琴图

上面的图形是没有数据点的,下面是将数据点也显示在提琴图的旁边,参数是points:

fig = px.violin(
    tips,
    y="total_bill",
    box=True,   # 开启之后在小提琴图里面绘制箱型图
    points='all'  # all-全部   outliers-离群点   False-不显示,默认
)

fig.show()

这个案例中没有离群点,所以points=outliers或者False,结果是相同的:

5.3 分组小提琴图

通过字段的不同取值来分别绘制不同的小提琴图:

fig = px.violin(
    tips,
    y="total_bill",  # 绘制的数据
    x="day",
    color="sex",
    box=True,
    points="all",
    hover_data=tips.columns  # 悬停显示的数据信息
)

fig.show()

5.4 覆盖型、分组型小提琴图

两种不同的图形主要是通过小提琴的模式来决定的,使用的参数是violinmode:

fig = px.violin(
    tips,
    y='total_bill',
    color='sex',
    violinmode='overlay',   # overlay-覆盖型   group-分组
    hover_data=tips.columns
)

fig.show()
fig = px.violin(
    tips,
    y='total_bill',
    color='sex',
    violinmode='group',   # overlay-覆盖型   group-分组
    hover_data=tips.columns
)

fig.show()

6.1 基础小提琴图

  fig = go.Figure(data=go.Violin(
    y=tips['total_bill'],  # 绘图数据
    box_visible=True,  # 内部箱体是否显示
    line_color='red',  # 线条颜色
    meanline_visible=True,  # 是否显示中线
    fillcolor='seagreen',  # 填充色
    opacity=0.5,  # 透明度
    x0='Tip-小提琴图'   # x轴标题
))

fig.update_layout(yaxis_zeroline=False)

fig.show()

6.2 多个小提琴图

在一个画布中同时绘制多个小提琴图。在消费数据tips中的day字段有4个不同的取值:

通过一个for循环来遍历实现4个图形的绘制:

fig1 = go.Figure()  # 生成一个Figure对象

# 通过循环在对象上添加4个轨迹trace
for day in day_list:
    fig1.add_trace(go.Violin(
        x=tips["day"][tips["day"] == day],
        y=tips["total_bill"][tips["day"] == day],
        name=day,
        box_visible=True,
        meanline_visible=True
       ))
    
fig1.show()

6.3分组小提琴图

fig2 = go.Figure()

fig2.add_trace(go.Violin(
    x=tips[ tips['sex'] == 'Male' ]['day'],  # 绘图的xy轴数据
    y=tips['total_bill'][ tips['sex'] == 'Male' ],
#     legendgroup='男', # 图例分组
#     scalegroup='男',  
    name='男',  # 图形轨迹名称
    line_color='blue'  # 线条颜色
))

fig2.add_trace(go.Violin(
    x=tips['day'][tips['sex'] == 'Female' ],
    y=tips['total_bill'][tips['sex'] == 'Female' ],
#     legendgroup='女', 
#     scalegroup='女', 
    name='女',
    line_color='orange')
)

# 设置箱体和中位线是否显示
fig2.update_traces(box_visible=True, meanline_visible=True)
  
# 小提琴图模式:overlay覆盖型   group分组
fig2.update_layout(violinmode='group')  

fig2.show()

6.4 正负形小提琴图

在小提琴图中我们可以看到它是由两个部分组成的,分为negative和positive,取值不同会呈现不同的图形:

import plotly.graph_objects as go

import pandas as pd

# 如何使用pandas读取网页在线的csv文件
df = pd.read_csv("https://raw.githubusercontent.com/plotly/datasets/master/violin_data.csv")

fig = go.Figure()

fig.add_trace(go.Violin(
    x=df['day'][ df['smoker'] == 'Yes' ],
    y=df['total_bill'][ df['smoker'] == 'Yes' ],
#     legendgroup='Yes', 
#     scalegroup='Yes', 
    name='Yes',
    side='negative',  # 'both-全部', 'positive-右', 'negative-左'
    line_color='blue')
)

fig.add_trace(go.Violin(
    x=df['day'][ df['smoker'] == 'No' ],
    y=df['total_bill'][ df['smoker'] == 'No' ],
#     legendgroup='No', 
#     scalegroup='No', 
    name='No',
    side='positive',
    line_color='lightseagreen')
)

# 设置轨迹参数
fig.update_traces(meanline_visible=True,  # 中位数是否显示
                  points='all',  # 是否显示点
                  jitter=0.05,  # 在每个点之间加上抖动,可视化效果更好
                  scalemode='count')   # 'width', 'count'

fig.update_layout(violingap=0, violinmode='overlay')  # 设置间隔和模式

fig.show()

七、高级小提琴图

介绍两个官网中的高级小提琴图的例子:

另一个是绘制Ridgeline(脊型) Plots图形的例子,当做欣赏:

import plotly.graph_objects as go
from plotly.colors import n_colors
import numpy as np
np.random.seed(1)

data = (np.linspace(1, 2, 12)[:, np.newaxis] * np.random.randn(12, 200) +
            (np.arange(12) + 2 * np.random.random(12))[:, np.newaxis])

print(data)
# 'rgb(5, 200, 200)', 'rgb(200, 10, 10)' 表示第一个和最后一个颜色,12表示个数,colortype表示类型
colors = n_colors('rgb(5, 200, 200)', 'rgb(200, 10, 10)', 12, colortype='rgb')
print(colors)


fig = go.Figure()
for data_line, color in zip(data, colors):
    fig.add_trace(go.Violin(x=data_line, line_color=color))

fig.update_traces(orientation='h', side='positive', width=3, points=False)

fig.update_layout(xaxis_showgrid=False, xaxis_zeroline=False)

fig.show()

原文链接:

https://mp.weixin.qq.com/s/3VbNaJRRfDurN77VTqXRWw

相关推荐

野路子科技!2步教你把手机改造成一个FTP服务器,支持PC互传

哈喽,大家好,我是野路子科技,今天来给大家带来一个教程,希望大家喜欢。正如标题所言,就是教大家如何把售价改造成FTP服务器,而这个时候估计有朋友会问了,把手机改造成FTP服务器有什么用呢?现在有Q...

不得不看:别样于Server-U的群晖文件存储服务器的搭建与使用

我先前的作品中,有着关于Server-U的ftp文件存储服务器的搭建与访问的头条文章和西瓜视频,而且我们通过各种方式也给各位粉丝介绍了如何突破局域网实现真正意义上的公网访问机制技术。关于Server-...

Qt三种方式实现FTP上传功能_qt引入qftp库

FTP协议FTP的中文名称是“文件传输协议”,是FileTransferProtocol三个英文单词的缩写。FTP协议是TCP/IP协议组中的协议之一,其传输效率非常高,在网络上传输大的文件时,经...

Filezilla文件服务器搭建及客户端的使用

FileZilla是一个免费开源的FTP软件,分为客户端版本和服务器版本,具备所有的FTP软件功能。可控性、有条理的界面和管理多站点的简化方式使得Filezilla客户端版成为一个方便高效的FTP客户...

美能达柯美/震旦复印机FTP扫描怎么设置?

好多网友不知道怎么安装美能达/震旦复印机扫描,用得最多是SMB和FTP扫描,相对于SMB来说,FTP扫描安装步骤更为便捷,不容易出问题,不需要设置文件夹共享,所以小编推荐FTP来扫描以美能达机器为例详...

CCD(简易FTP服务器软件)_简单ftp服务器软件

CCD简易FTP服务器软件是一款很方便的FPT搭建工具,可以将我们的电脑快速变成一个FPT服务器。使用方法非常简单,只要运行软件就会自动生效,下载银行有该资源。该工具是不提供操作界面的,其他用户可以输...

Ubuntu系统搭建FTP服务器教程_ubuntu架设服务器

在Ubuntu系统上搭建FTP服务器是文件传输的一个非常实用方法,适合需要进行大量文件交换的场景。以下是一步步指导,帮助您在Ubuntu上成功搭建FTP服务器。1.安装vsftpd软件...

理光FTP扫描设置教程_理光ftp扫描设置方法

此教程主要用来解决WIN10系统下不能使用SMB文件夹扫描的问题,由于旧的SMB协议存在安全漏洞,所以微软在新的系统,WIN8/WIN10/SERVER201220162018里使用了新的SMB传...

纯小白如何利用wireshark学习网络技术

写在前面工欲善其事必先利其器!熟悉掌握一种神器对以后的工作必然是有帮助的,下面我将从简单的描述Wireshark的使用和自己思考去写,若有错误或不足还请批评指正。...

京东买13盘位32GB内存NAS:NAS系统安装设置教程

本内容来源于@什么值得买APP,观点仅代表作者本人|作者:yasden你没有看错,我在京东自营商城购买硬件,组装了一台13盘位,32GB内存的NAS,硬盘有13个盘位!CPU是AMD的5500!本文...

FileZilla搭建FTP服务器图解教程_filezilla server搭建ftp服务器

...

python教程之FTP相关操作_python ftps

ftplib类库常用相关操作importftplibftp=ftplib.FTP()ftp.set_debuglevel(2)#打开调试级别2,显示详细信息ftp.connect(“I...

xftp怎么用,xftp怎么用,具体使用方法

Xftp是一款界面化的ftp传输工具,用起来方便简单,这里为大家分享下Xftp怎么使用?希望能帮到有需要的朋友。IIS7服务器管理工具可以批量管理、定时上传下载、同步操作、数据备份、到期提醒、自动更新...

树莓派文件上传和下载,详细步骤设置FTP服务器

在本指南中,详细记录了如何在树莓Pi上设置FTP。设置FTP可以在网络上轻松地将文件传输到Pi上。FTP是文件传输协议的缩写,只是一种通过网络在两个设备之间传输文件的方法。还有一种额外的方法,你可以用...

win10电脑操作系统,怎么设置FTP?windows10系统设置FTP操作方法

打印,打印,扫描的日常操作是每一个办公工作人员的必需专业技能,要应用FTP作用扫描文件到电脑上,最先要必须一台可以接受文件的FTP服务器。许多软件都需要收费标准进行,但人们还可以应用Windows的系...

取消回复欢迎 发表评论: