Python中不同圖表的數(shù)據(jù)可視化的實現(xiàn)
數(shù)據(jù)可視化是以圖形格式呈現(xiàn)數(shù)據(jù)。它通過以簡單易懂的格式匯總和呈現(xiàn)大量數(shù)據(jù),幫助人們理解數(shù)據(jù)的重要性,并有助于清晰有效地傳達信息。
考慮這個給定的數(shù)據(jù)集,我們將為其繪制不同的圖表:

用于分析和呈現(xiàn)數(shù)據(jù)的不同類型的圖表
1.直方圖
直方圖表示特定現(xiàn)象發(fā)生的頻率,這些現(xiàn)象位于特定的數(shù)值范圍內(nèi),并以連續(xù)和固定的間隔排列。
在下面的代碼中繪制直方圖Age, Income, Sales。因此,輸出中的這些圖顯示了每個屬性的每個唯一值的頻率。
# 導(dǎo)入 pandas 和 matplotlib import pandas as pd import matplotlib.pyplot as plt # 創(chuàng)建上面給出的表的二維數(shù)組 data = [['E001', 'M', 34, 123, 'Normal', 350], ['E002', 'F', 40, 114, 'Overweight', 450], ['E003', 'F', 37, 135, 'Obesity', 169], ['E004', 'M', 30, 139, 'Underweight', 189], ['E005', 'F', 44, 117, 'Underweight', 183], ['E006', 'M', 36, 121, 'Normal', 80], ['E007', 'M', 32, 133, 'Obesity', 166], ['E008', 'F', 26, 140, 'Normal', 120], ['E009', 'M', 32, 133, 'Normal', 75], ['E010', 'M', 36, 133, 'Underweight', 40] ] # 使用上述數(shù)據(jù)數(shù)組創(chuàng)建的數(shù)據(jù)框 df = pd.DataFrame(data, columns = ['EMPID', 'Gender', 'Age', 'Sales', 'BMI', 'Income'] ) # 為數(shù)值數(shù)據(jù)創(chuàng)建直方圖 df.hist() # show plot plt.show()
輸出:

2. 柱形圖
柱形圖用于顯示不同屬性之間的比較,或者它可以顯示項目隨時間的比較。
# 此處使用之前代碼的數(shù)據(jù)框
# 繪制數(shù)值條形圖,將顯示所有 3 個年齡、收入、銷售額之間的比較
df.plot.bar()
# 在 2 個屬性之間繪制
plt.bar(df['Age'], df['Sales'])
plt.xlabel("Age")
plt.ylabel("Sales")
plt.show()輸出:

3. 箱線圖
箱線圖是基于 minimum, first quartile, median, third quartile, and maximum. 術(shù)語“箱線圖”來自這樣一個事實,即圖形看起來像一個矩形,線條從頂部和底部延伸。由于延伸線,這種類型的圖有時被稱為盒須圖。
# 對于數(shù)據(jù)框的每個數(shù)字屬性 df.plot.box() # 單個屬性箱線圖 plt.boxplot(df['Income']) plt.show()
輸出:

4、餅圖
餅圖顯示一個靜態(tài)數(shù)字以及類別如何代表整體的一部分。餅圖以百分比表示數(shù)字,所有段的總和需要等于 100%。
plt.pie(df['Age'], labels = {"A", "B", "C",
"D", "E", "F",
"G", "H", "I", "J"},
autopct ='% 1.1f %%', shadow = True)
plt.show()
plt.pie(df['Income'], labels = {"A", "B", "C",
"D", "E", "F",
"G", "H", "I", "J"},
autopct ='% 1.1f %%', shadow = True)
plt.show()
plt.pie(df['Sales'], labels = {"A", "B", "C",
"D", "E", "F",
"G", "H", "I", "J"},
autopct ='% 1.1f %%', shadow = True)
plt.show()輸出:

5、散點圖
散點圖顯示了兩個不同變量之間的關(guān)系,它可以揭示分布趨勢。當有許多不同的數(shù)據(jù)點,并且您想突出數(shù)據(jù)集中的相似性時,應(yīng)該使用它。這在查找異常值和了解數(shù)據(jù)分布時很有用。
# 收入和年齡之間的散點圖 plt.scatter(df['income'], df['age']) plt.show() # 收入和銷售額之間的散點圖 plt.scatter(df['income'], df['sales']) plt.show() # 銷售額和年齡之間的散點圖 plt.scatter(df['sales'], df['age']) plt.show()
輸出 :

以上就是Python中不同圖表的數(shù)據(jù)可視化的實現(xiàn)的詳細內(nèi)容,更多關(guān)于Python圖表數(shù)據(jù)可視化的資料請關(guān)注腳本之家其它相關(guān)文章!
相關(guān)文章
對pandas中iloc,loc取數(shù)據(jù)差別及按條件取值的方法詳解
今天小編就為大家分享一篇對pandas中iloc,loc取數(shù)據(jù)差別及按條件取值的方法詳解,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2018-11-11
python django事務(wù)transaction源碼分析詳解
這篇文章主要介紹了python django事務(wù)transaction源碼分析詳解的相關(guān)資料,需要的朋友可以參考下2017-03-03
python用selenium打開瀏覽器后秒關(guān)閉瀏覽器的解決辦法
最近朋友在學(xué)Selenium的時候遇到一個問題,當執(zhí)行完selenium程序后,瀏覽器會閃退也就是自動關(guān)閉,這篇文章主要給大家介紹了關(guān)于python用selenium打開瀏覽器后秒關(guān)閉瀏覽器的解決辦法,需要的朋友可以參考下2023-07-07
Pycharm內(nèi)置終端及遠程SSH工具的使用教程圖文詳解
這篇文章主要介紹了Pycharm內(nèi)置終端及遠程SSH工具的使用教程,本文通過圖文并茂的形式給大家介紹的非常詳細,對大家的學(xué)習(xí)或工作具有一定的參考借鑒價值,需要的朋友可以參考下2020-03-03
Python中 pickle 模塊的 dump() 和 load()&
Python 的 pickle 模塊用于實現(xiàn)二進制序列化和反序列化,一個對象可以被序列化到文件中,然后可以從文件中恢復(fù),這篇文章主要介紹了Python中 pickle 模塊的 dump() 和 load() 方法詳解,需要的朋友可以參考下2022-12-12
Python必備shelve與dbm本地持久化存儲數(shù)據(jù)的兩個強大工具
當涉及存儲大量數(shù)據(jù)并且需要高效訪問時,shelve和dbm模塊是Python中用于本地持久化存儲數(shù)據(jù)的兩個強大工具,它們允許開發(fā)人員以鍵值對的形式存儲數(shù)據(jù),并支持快速的檢索和更新操作,在本文將深入探討這兩個模塊,展示它們的優(yōu)勢和應(yīng)用場景2024-01-01

