可视化神器Plotly玩转小提琴图 小提琴图 分析
yuyutoo 2024-10-21 12:06 1 浏览 0 评论
大家好,本文介绍如何利用Plotly来绘制小提琴图,是一种统计类的图形,基于两种方法实现:
- 基于plotly_express
- 基于plotly.graph_objects
一、小提琴图
看下实际绘制的小提琴图效果:
那究竟什么是小提琴图?
小提琴图(Violin Plot)是一种用来显示数据分布和概率密度的图形。
它结合了之前介绍的箱型图和密度图的双重特征,能够用来显示数据的分布形状。
三、导入库及数据
先导入需要的ku:
import numpy as np
import pandas as pd
import plotly_express as px
import plotly.graph_objects as go
本文中使用的pandas中自带的消费数据:
# 采用的是消费数据tips
tips = px.data.tips()
tips.head()
四、基于点的小提琴图
首先绘制的是基于数据点的小提琴图:
fig = px.strip(
tips, # 指定数据
x='day', # xy轴
y='total_bill',
color='day' # 颜色
)
fig.show()
根据4个day的取值来分别绘制小提琴图:
五、基于Plotly_Express实现
5.1 基础小提琴图
fig = px.violin(tips,y="total_bill") # 使用total_bill数据
fig.show()
换了一份数据再绘图:
fig = px.violin(tips,y="tip") # 使用的是小费tip
fig.show()
5.2 带数据点的小提琴图
上面的图形是没有数据点的,下面是将数据点也显示在提琴图的旁边,参数是points:
fig = px.violin(
tips,
y="total_bill",
box=True, # 开启之后在小提琴图里面绘制箱型图
points='all' # all-全部 outliers-离群点 False-不显示,默认
)
fig.show()
这个案例中没有离群点,所以points=outliers或者False,结果是相同的:
5.3 分组小提琴图
通过字段的不同取值来分别绘制不同的小提琴图:
fig = px.violin(
tips,
y="total_bill", # 绘制的数据
x="day",
color="sex",
box=True,
points="all",
hover_data=tips.columns # 悬停显示的数据信息
)
fig.show()
5.4 覆盖型、分组型小提琴图
两种不同的图形主要是通过小提琴的模式来决定的,使用的参数是violinmode:
fig = px.violin(
tips,
y='total_bill',
color='sex',
violinmode='overlay', # overlay-覆盖型 group-分组
hover_data=tips.columns
)
fig.show()
fig = px.violin(
tips,
y='total_bill',
color='sex',
violinmode='group', # overlay-覆盖型 group-分组
hover_data=tips.columns
)
fig.show()
6.1 基础小提琴图
fig = go.Figure(data=go.Violin(
y=tips['total_bill'], # 绘图数据
box_visible=True, # 内部箱体是否显示
line_color='red', # 线条颜色
meanline_visible=True, # 是否显示中线
fillcolor='seagreen', # 填充色
opacity=0.5, # 透明度
x0='Tip-小提琴图' # x轴标题
))
fig.update_layout(yaxis_zeroline=False)
fig.show()
6.2 多个小提琴图
在一个画布中同时绘制多个小提琴图。在消费数据tips中的day字段有4个不同的取值:
通过一个for循环来遍历实现4个图形的绘制:
fig1 = go.Figure() # 生成一个Figure对象
# 通过循环在对象上添加4个轨迹trace
for day in day_list:
fig1.add_trace(go.Violin(
x=tips["day"][tips["day"] == day],
y=tips["total_bill"][tips["day"] == day],
name=day,
box_visible=True,
meanline_visible=True
))
fig1.show()
6.3分组小提琴图
fig2 = go.Figure()
fig2.add_trace(go.Violin(
x=tips[ tips['sex'] == 'Male' ]['day'], # 绘图的xy轴数据
y=tips['total_bill'][ tips['sex'] == 'Male' ],
# legendgroup='男', # 图例分组
# scalegroup='男',
name='男', # 图形轨迹名称
line_color='blue' # 线条颜色
))
fig2.add_trace(go.Violin(
x=tips['day'][tips['sex'] == 'Female' ],
y=tips['total_bill'][tips['sex'] == 'Female' ],
# legendgroup='女',
# scalegroup='女',
name='女',
line_color='orange')
)
# 设置箱体和中位线是否显示
fig2.update_traces(box_visible=True, meanline_visible=True)
# 小提琴图模式:overlay覆盖型 group分组
fig2.update_layout(violinmode='group')
fig2.show()
6.4 正负形小提琴图
在小提琴图中我们可以看到它是由两个部分组成的,分为negative和positive,取值不同会呈现不同的图形:
import plotly.graph_objects as go
import pandas as pd
# 如何使用pandas读取网页在线的csv文件
df = pd.read_csv("https://raw.githubusercontent.com/plotly/datasets/master/violin_data.csv")
fig = go.Figure()
fig.add_trace(go.Violin(
x=df['day'][ df['smoker'] == 'Yes' ],
y=df['total_bill'][ df['smoker'] == 'Yes' ],
# legendgroup='Yes',
# scalegroup='Yes',
name='Yes',
side='negative', # 'both-全部', 'positive-右', 'negative-左'
line_color='blue')
)
fig.add_trace(go.Violin(
x=df['day'][ df['smoker'] == 'No' ],
y=df['total_bill'][ df['smoker'] == 'No' ],
# legendgroup='No',
# scalegroup='No',
name='No',
side='positive',
line_color='lightseagreen')
)
# 设置轨迹参数
fig.update_traces(meanline_visible=True, # 中位数是否显示
points='all', # 是否显示点
jitter=0.05, # 在每个点之间加上抖动,可视化效果更好
scalemode='count') # 'width', 'count'
fig.update_layout(violingap=0, violinmode='overlay') # 设置间隔和模式
fig.show()
七、高级小提琴图
介绍两个官网中的高级小提琴图的例子:
另一个是绘制Ridgeline(脊型) Plots图形的例子,当做欣赏:
import plotly.graph_objects as go
from plotly.colors import n_colors
import numpy as np
np.random.seed(1)
data = (np.linspace(1, 2, 12)[:, np.newaxis] * np.random.randn(12, 200) +
(np.arange(12) + 2 * np.random.random(12))[:, np.newaxis])
print(data)
# 'rgb(5, 200, 200)', 'rgb(200, 10, 10)' 表示第一个和最后一个颜色,12表示个数,colortype表示类型
colors = n_colors('rgb(5, 200, 200)', 'rgb(200, 10, 10)', 12, colortype='rgb')
print(colors)
fig = go.Figure()
for data_line, color in zip(data, colors):
fig.add_trace(go.Violin(x=data_line, line_color=color))
fig.update_traces(orientation='h', side='positive', width=3, points=False)
fig.update_layout(xaxis_showgrid=False, xaxis_zeroline=False)
fig.show()
原文链接:
https://mp.weixin.qq.com/s/3VbNaJRRfDurN77VTqXRWw
相关推荐
- mysql数据库如何快速获得库中无主键的表
-
概述总结一下MySQL数据库查看无主键表的一些sql,一起来看看吧~1、查看表主键信息--查看表主键信息SELECTt.TABLE_NAME,t.CONSTRAINT_TYPE,c.C...
- 一文读懂MySQL的架构设计
-
MySQL是一种流行的开源关系型数据库管理系统,它由四个主要组件构成:协议接入层...
- MySQL中的存储过程和函数
-
原文地址:https://dwz.cn/6Ysx1KXs作者:best.lei存储过程和函数简单的说,存储过程就是一条或者多条SQL语句的集合。可以视为批文件,但是其作用不仅仅局限于批处理。本文主要介...
- 创建数据表:MySQL 中的 CREATE 命令深入探讨
-
数据库是企业日常运营和业务发展的不可缺少的基石。MySQL是一款优秀的关系型数据库管理系统,它支持数据的插入、修改、查询和删除操作。在数据库中,表是一个关系数据库中用于保存数据的容器,它由表定义、表...
- SQL优化——IN和EXISTS谁的效率更高
-
IN和EXISTS被频繁使用在SQL中,虽然作用是一样的,但是在使用效率谁更高这点上众说纷纭。下面我们就通过一组测试来看,在不同场景下,使用哪个效率更高。...
- 在MySQL中创建新的数据库,可以使用命令,也可以通过MySQL工作台
-
摘要:在本教程中,你将学习如何使用MySQLCREATEDATABASE语句在MySQL数据库服务器上创建新数据库。MySQLCREATEDATABASE语句简介...
- SQL查找是否"存在",别再用count了
-
根据某一条件从数据库表中查询『有』与『没有』,只有两种状态,那为什么在写SQL的时候,还要SELECTCOUNT(*)呢?无论是刚入道的程序员新星,还是精湛沙场多年的程序员老白,都是一如既往...
- 解决Mysql数据库提示innodb表不存在的问题
-
发现mysql的error.log里面有报错:>InnoDB:Error:Table"mysql"."innodb_table_stats"notfo...
- Mysql实战总结&面试20问
-
1、MySQL索引使用注意事项1.1、索引哪些情况会失效查询条件包含or,可能导致索引失效如果字段类型是字符串,where时一定用引号括起来,否则索引失效...
- MySQL创建数据表
-
数据库有了后,就可以在库里面建各种数据表了。创建数据表的过程是规定数据列的属性的过程,同时也是实施数据完整性(包括实体完整性、引用完整性和域完整性)约束的过程。后面也是通过SQL语句和Navicat...
- MySQL数据库之死锁与解决方案
-
一、表的死锁产生原因:...
- MySQL创建数据库
-
我的重点还是放在数据表的操作,但第一篇还是先介绍一下数据表的容器数据库的一些操作。主要涉及数据库的创建、修改、删除和查看,下面演示一下用SQL语句创建和用图形工具创建。后面主要使用的工具是Navica...
- MySQL中创建触发器需要执行哪些操作?
-
什么是触发器触发器,就是一种特殊的存储过程。触发器和存储过程一样是一个能够完成特定功能、存储在数据库服务器上的SQL片段,但是触发器无需调用,当对数据库表中的数据执行DML操作时自动触发这个SQL片段...
- 《MySQL 入门教程》第 17 篇 MySQL 变量
-
原文地址:https://blog.csdn.net/horses/article/details/107736801原文作者:不剪发的Tony老师来源平台:CSDN变量是一个拥有名字的对象,可以用于...
- 关于如何在MySQL中创建表,看这篇文章就差不多了
-
数据库技术是现代科技领域中至关重要的一部分,而MySQL作为最流行的关系型数据库管理系统之一,在数据存储和管理方面扮演着重要角色。本文将深入探讨MySQL中CREATETABLE语句的应用,以及如何...
你 发表评论:
欢迎- 一周热门
- 最近发表
- 标签列表
-
- mybatis plus (70)
- scheduledtask (71)
- css滚动条 (60)
- java学生成绩管理系统 (59)
- 结构体数组 (69)
- databasemetadata (64)
- javastatic (68)
- jsp实用教程 (53)
- fontawesome (57)
- widget开发 (57)
- vb net教程 (62)
- hibernate 教程 (63)
- case语句 (57)
- svn连接 (74)
- directoryindex (69)
- session timeout (58)
- textbox换行 (67)
- extension_dir (64)
- linearlayout (58)
- vba高级教程 (75)
- iframe用法 (58)
- sqlparameter (59)
- trim函数 (59)
- flex布局 (63)
- contextloaderlistener (56)