python数据可视化技巧的100个练习 -- 52. 创建分类数据的条形图
你是一家零售公司的数据分析师。你的经理要求你可视化不同产品类别的销售金额分布,以识别任何模式或异常。创建一个条形图来显示这些信息。生成一个具有以下结构的样本数据集:类别:'Electronics'(电子产品)、'Clothing'(服装)、'Home & Kitchen'(家居与厨房)【数据生成代码示例】
import pandas as pdimport numpy as npcategories = ['Electronics', 'Clothing', 'Home & Kitchen']data = pd.DataFrame({ 'Category': [categories[i % 3] for i in range(300)], 'Sales Amount': np.random.randint(10, 501, 300)})
【图表答案】
【代码答案】
import pandas as pdimport numpy as npimport seaborn as snsimport matplotlib.pyplot as pltcategories = ['Electronics', 'Clothing', 'Home & Kitchen']data = pd.DataFrame({ 'Category': [categories[i % 3] for i in range(300)], 'Sales Amount': np.random.randint(10, 501, 300)})sns.stripplot(x='Category', y='Sales Amount', data=data)plt.title('按类别划分的销售金额分布')plt.xlabel('类别')plt.ylabel('销售金额')plt.show()
要创建分类数据的条形图,我们首先需要生成一个样本数据集。我们使用 pandas 库创建一个 DataFrame,并使用 numpy 生成随机销售金额。'Category' 列包含 'Electronics'、'Clothing' 和 'Home & Kitchen' 的重复值。'Sales Amount' 列包含 10 到 500 之间的随机整数。sns.stripplot 函数接受 x 和 y 参数,分别定义分类数据和数值数据。我们将 DataFrame 传递给 data 参数。最后,我们使用 matplotlib 的 plt 函数为图表添加标题和标签,并通过 plt.show() 显示它。【小知识】
条形图适用于可视化不同类别间数据点的分布,尤其是在处理小型数据集时非常有用。Seaborn 的 stripplot 函数可以通过各种参数(如 jitter)进行自定义,以提高重叠点的可读性。将条形图与其他图表(如箱线图)结合使用,可以更深入地了解数据分布。
系列完整内容可以在公众号主页搜索或点击分栏找到,欢迎扫码关注预防迷路找不到。感谢您的支持与相伴。
