首页 > 脚本专栏 > python > python 可视化

python可视化分析的实现(matplotlib、seaborn、ggplot2)

作者:feifei2233

这篇文章主要介绍了python可视化分析的实现(matplotlib、seaborn、ggplot2),文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧

一、matplotlib库

1、基本绘图命令

import matplotlib.pyplot as plt plt.figure(figsize=(5,4)) #设置图形大小 plt.rcParams['axes.unicode_minus']=False #正常显示负号 plt.rcParams['font.sans-self']=['Kai Ti'] #设置字体,这里是楷体,SimHei表示黑体 #基本统计图 plt.bar(x,y);plt.pie(y,labels=x);plt.plot(x,y); plt.hist(df.身高) #若参数density=True则是频率直方图

3、图形参数设置

颜色: plt.plot(x,y,c=‘red') #参数c控制颜色
横纵坐标轴范围: plt.xlim(0,100),plt.ylim(0,8)
横纵坐标轴名称: plt.xlabel(),plt.ylabel()
横纵坐标轴刻度: plt.xticks(range(len(x)),x)
线形和符号: plt.plot(x,y,linestyle='–',marker=‘o') #实线:'-' ;虚线:'–'; '.'指点线
附加参考线: plt.axvline(x=1);plt.axhline(y=4)
文字标注: plt.text(3,5,‘peak point') #参数表示:坐标+文字
图例: plt.plot(x,y,label=‘折线');plt.legend()
分面绘图:

#一行两图 plt.subplot(121) plt.bar(x,y) plt.subplot(122) plt.plot(x,y) #一页多图 fig,ax=plt.subplots(2,2,figsize=(15,12)) # 2行2列放4个图,figsize控制大小 ax[0,0].bar(x,y);ax[0,1].plot(x,y); ax[1,0].pie(x,y);ax[1,1].plot(y,'.',linewidth=3)

具体的参数color、linestyle、图例位置设置

颜色字符(color)

import matplotlib.pyplot as plt #加载基本绘图包 plt.rcParams['font.sans-serif']=['SimHei']; #SimHei黑体 plt.rcParams['axes.unicode_minus']=False; #正常显示图中负号 import numpy as np #加载软件包numpy import math #加载软件包math x=np.linspace(0,2*math.pi);x #生成[0,2*pi]序列 ,作为横坐标取值 plt.plot(x,np.sin(x)) #y=sinx 正弦函数 plt.plot(x,np.cos(x)) #y=cosx 余弦函数 plt.plot(x,np.log(x)) #y=lnx #对数函数 plt.plot(x,np.exp(x)) #y=e^x 指数函数

数学函数也可以用pandas库绘制,可详见我的另一篇博客:文章链接

#极坐标图 t=np.linspace(0,2*math.pi) x=3*np.sin(t); y=5*np.cos(t) plt.plot(x,y); plt.text(0,0,r'$\frac{x^2}{3^2}+\frac{y^2}{5^2}=1$',fontsize=20) #python借鉴的LATEX的格式,可以直接在图中添加公式

4.2 气泡图

import pandas as pd df=pd.read_excel('data.xlsx') plt.scatter(df['身高'], df['体重'], s=df['支出']) #在散点图的基础上加上点的大小,例子中s=df['支出']就是将指各样本点支出越多,点面积就越大

4.3 三维曲面图

from mpl_toolkits.mplot3d import Axes3D fig = plt.figure() ax = Axes3D(fig) X = np.arange(-4, 4, 0.5) Y = np.arange(-4, 4, 0.5) X, Y = np.meshgrid(X, Y) Z = (X**2+ Y**2) ax.plot_surface(X, Y, Z) #该图像就是表示函数z=x^2+y^2

二、seaborn库

1、常用统计图

1.1 箱线图

import seaborn as sns #加载软件包seaborn sns.boxplot(x=df['身高']) #竖着放的箱线图,也就是将 x 换成 y sns.boxplot(y=df['身高']) #分组绘制箱线图 sns.boxplot(x='性别', y='身高',data=df) #将身高按性别分组后绘制

1.2 小提琴图

sns.violinplot(x='性别', y='支出', data=df) #箱线图的变种,可以加第三个类别参数hue

1.3 点图

sns.stripplot(x='性别', y='身高', data=df, jitter=True) #分组的数据(定性+定量)画的点图,jitter参数为True表示将点分散开来,默认为false

1.4 条图与计数图

#条图,即柱形图 sns.barplot(x='性别', y='身高', data=df, ci=0, palette="Blues_d") #palette用于设置颜色 sns.countplot(x='性别', hue="开设", data=df) #都是分类变量

1.5 分组图

#按性别、开设依次分组后计数,aspect指比例大小 sns.factorplot(x='性别', col="开设", col_wrap=3, data=df, kind="count", size=2.5, aspect=.8)

1.6 概率分布图

#displot:直方图+密度函数,bins表示分的组数,kde=False表示不画出密度曲线,rug表示有数据的地方就标注出来 sns.distplot(df['身高'], kde=True, bins=20, rug=True) #自定义渐进正态函数图像 def norm_sim2(N=1000,n=10): xbar=np.zeros(N) for i in range(N): xbar[i]=np.random.uniform(0,1,n).mean()#[0,1]上均匀随机数均值 sns.distplot(xbar,bins=50) print(pd.DataFrame(xbar).describe().T) norm_sim2(N=100000,n=50)

2、联合图

sns.jointplot(x='身高', y='体重', data=df)#画的散点图+单个变量的直方图

3、配对图

#针对多个变量,两两配对,画在一起 sns.pairplot(df[['身高','体重','支出']]) #将各变量间关系共放一张图上,在多元统计分析中很有用

三、ggplot库

ggplot库是采用的绘画中 图层 的思想,即一层一层往上叠加,先画好坐标,再添线,再增加其他操作,最后用 + 号连接起来,操作起来更有逻辑章法,语句简洁。ggplot新包是 plotnine ,与R语言的ggplot2对应,使用起来更方便,故直接import plotnine即可,里面的函数使用与ggplot是基本一样的

1、图层画法+常用图形

绘制直角坐标系和字体

GP=ggplot(aes(x='身高',y='体重'),data=df) #快速绘制直方图 qplot(x='身高',data=df, geom='histogram')+ theme_grey(base_family = 'SimHei') #快速绘制柱形图 qplot('开设',data=df, geom='bar')+ theme_grey(base_family = 'SimHei') #默认散点图 qplot('身高', '体重', data=df, color='性别') + theme_grey(base_family = 'SimHei')

以上是基于《python数据分析基础教程 王斌会》整理的学习笔记,还有许多参数设置没有写明,以及pyecharts 动态图神器,日后学习了再一点点补充吧~

到此这篇关于python可视化分析的实现(matplotlib、seaborn、ggplot2)的文章就介绍到这了,更多相关python 可视化内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家!

您可能感兴趣的文章:
  • Python扑克牌21点游戏实例代码
    Python扑克牌21点游戏实例代码
    2021-12-12
  • Python读取CSV文件并计算某一列的均值和方差
    Python读取CSV文件并计算某一列的均值和方差
    2021-12-12
  • Python爬虫Scrapy框架IP代理的配置与调试
    Python爬虫Scrapy框架IP代理的配置与调试
    2021-12-12
  • Python random模块的运用详解
    Python random模块的运用详解
    2021-12-12
  • python数据可视化Seaborn绘制山脊图
    python数据可视化Seaborn绘制山脊图
    2021-12-12
  • python数据可视化Seaborn画热力图
    python数据可视化Seaborn画热力图
    2021-12-12
  • Python中不可错过的五个超有用函数
    Python中不可错过的五个超有用函数
    2021-12-12
  • Python小波变换去噪的原理解析
    Python小波变换去噪的原理解析
    2021-12-12
  • 美国设下计谋,用娘炮文化重塑日本,已影响至中国
    美国设下计谋,用娘炮文化重塑日本,已影响至中国
    2021-11-19
  • 时空伴随者是什么意思?时空伴随者介绍
    时空伴随者是什么意思?时空伴随者介绍
    2021-11-09
  • 工信部称网盘企业免费用户最低速率应满足基本下载需求,天翼云盘回应:坚决支持,始终
    工信部称网盘企业免费用户最低速率应满足基本下载需求,天翼云盘回应:坚决支持,始终
    2021-11-05
  • 2022年放假安排出炉:五一连休5天 2022年所有节日一览表
    2022年放假安排出炉:五一连休5天 2022年所有节日一览表
    2021-10-26
  • 电脑版 - 返回首页

    2006-2023 脚本之家 JB51.Net , All Rights Reserved.
    苏ICP备14036222号