最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

如何用python做逐步回歸

 更新時間:2021年04月06日 14:49:24   作者:Hundred°C  
這篇文章主要介紹了如何用python 做逐步回歸,幫助大家更好的理解和學(xué)習使用python,感興趣的朋友可以了解下

算法介紹

逐步回歸是一種線性回歸模型自變量選擇方法;
逐步回歸的基本思想是將變量逐個引入模型,每引入一個解釋變量后都要進行F檢驗,并對已經(jīng)選入的解釋變量逐個進行t檢驗,當原來引入的解釋變量由于后面解釋變量的引入變得不再顯著時,則將其刪除。以確保每次引入新的變量之前回歸方程中只包含顯著性變量。這是一個反復(fù)的過程,直到既沒有顯著的解釋變量選入回歸方程,也沒有不顯著的解釋變量從回歸方程中剔除為止。以保證最后所得到的解釋變量集是最優(yōu)的。
這里我們選擇赤池信息量(Akaike Information Criterion)來作為自變量選擇的準則,赤池信息量(AIC)達到最?。夯谧畲笏迫还烙嬙淼哪P瓦x擇準則。

數(shù)據(jù)情況

案例

在現(xiàn)實生活中,影響一個地區(qū)居民消費的因素有很多,例如一個地區(qū)的人均生產(chǎn)總值、收入水平等等,本案例選取了9個解釋變量研究城鎮(zhèn)居民家庭平均每人全年的消費新支出y,解釋變量為:
x1——居民的食品花費
x2——居民的衣著消費
x3——居民的居住花費
x4——居民的醫(yī)療保健花費
x5——居民的文教娛樂花費
x6——地區(qū)的職工平均工資
x7——地區(qū)的人均GDP
x8——地區(qū)的消費價格指數(shù)
x9——地區(qū)的失業(yè)率(%)

數(shù)據(jù)

代碼

# -*- coding: UTF-8 -*-

import numpy as np
import statsmodels.api as sm
import statsmodels.formula.api as smf
from statsmodels.stats.api import anova_lm
import matplotlib.pyplot as plt
import pandas as pd
from patsy import dmatrices
import itertools as it
import random


# Load data 讀取數(shù)據(jù)
df = pd.read_csv('data3.1.csv',encoding='gbk')
print(df)


target = 'y'
variate = set(df.columns) #獲取列名
variate.remove(target) #去除無關(guān)列
variate.remove('地區(qū)')

#定義多個數(shù)組,用來分別用來添加變量,刪除變量
x = []
variate_add = []
variate_del = variate.copy()
# print(variate_del)
y = random.sample(variate,3) #隨機生成一個選模型,3為變量的個數(shù)
print(y)
#將隨機生成的三個變量分別輸入到 添加變量和刪除變量的數(shù)組
for i in y:
 variate_add.append(i)
 x.append(i)
 variate_del.remove(i)

global aic #設(shè)置全局變量 這里選擇AIC值作為指標
formula="{}~{}".format("y","+".join(variate_add)) #將自變量名連接起來
aic=smf.ols(formula=formula,data=df).fit().aic #獲取隨機函數(shù)的AIC值,與后面的進行對比
print("隨機化選模型為:{}~{},對應(yīng)的AIC值為:{}".format("y","+".join(variate_add), aic))
print("\n")



#添加變量
def forwark():
 score_add = []
 global best_add_score
 global best_add_c
 print("添加變量")
 for c in variate_del:
  formula = "{}~{}".format("y", "+".join(variate_add+[c]))
  score = smf.ols(formula = formula, data = df).fit().aic
  score_add.append((score, c)) #將添加的變量,以及新的AIC值一起存儲在數(shù)組中
  
  print('自變量為{},對應(yīng)的AIC值為:{}'.format("+".join(variate_add+[c]), score))

 score_add.sort(reverse=True) #對數(shù)組內(nèi)的數(shù)據(jù)進行排序,選擇出AIC值最小的
 best_add_score, best_add_c = score_add.pop()
 
 print("最小AIC值為:{}".format(best_add_score))
 print("\n")

#刪除變量
def back():
 score_del = []
 global best_del_score
 global best_del_c
 print("剔除變量")
 for i in x:

  select = x.copy() #copy一個集合,避免重復(fù)修改到原集合
  select.remove(i)
  formula = "{}~{}".format("y","+".join(select))
  score = smf.ols(formula = formula, data = df).fit().aic
  print('自變量為{},對應(yīng)的AIC值為:{}'.format("+".join(select), score))
  score_del.append((score, i))

 score_del.sort(reverse=True) #排序,方便將最小值輸出
 best_del_score, best_del_c = score_del.pop() #將最小的AIC值以及對應(yīng)剔除的變量分別賦值
 print("最小AIC值為:{}".format(best_del_score))
 print("\n")

print("剩余變量為:{}".format(variate_del))
forwark()
back()

while variate:
  
#  forwark()
#  back()
 if(aic < best_add_score < best_del_score or aic < best_del_score < best_add_score):
  print("當前回歸方程為最優(yōu)回歸方程,為{}~{},AIC值為:{}".format("y","+".join(variate_add), aic))
  break
 elif(best_add_score < best_del_score < aic or best_add_score < aic < best_del_score):
  print("目前最小的aic值為{}".format(best_add_score))
  print('選擇自變量:{}'.format("+".join(variate_add + [best_add_c]))) 
  print('\n')
  variate_del.remove(best_add_c)
  variate_add.append(best_add_c)
  print("剩余變量為:{}".format(variate_del))
  aic = best_add_score
  forwark()
 else:
  print('當前最小AIC值為:{}'.format(best_del_score))
  print('需要剔除的變量為:{}'.format(best_del_c))
  aic = best_del_score #將AIC值較小的選模型AIC值賦給aic再接著下一輪的對比
  x.remove(best_del_c) #在原集合上剔除選模型所對應(yīng)剔除的變量
  back()
  

結(jié)果

以上就是如何用python 做逐步回歸的詳細內(nèi)容,更多關(guān)于python 逐步回歸的資料請關(guān)注腳本之家其它相關(guān)文章!

相關(guān)文章

  • 淺談pandas中DataFrame關(guān)于顯示值省略的解決方法

    淺談pandas中DataFrame關(guān)于顯示值省略的解決方法

    下面小編就為大家分享一篇淺談pandas中DataFrame關(guān)于顯示值省略的解決方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-04-04
  • python利用MethodType綁定方法到類示例代碼

    python利用MethodType綁定方法到類示例代碼

    這篇文章主要給大家介紹了關(guān)于python利用MethodType綁定方法到類的相關(guān)資料,文中通過示例代碼介紹的非常詳細,對大家的學(xué)習或者工作具有一定的參考學(xué)習價值,需要的朋友們下面跟著小編來一起學(xué)習學(xué)習吧。
    2017-08-08
  • Django1.11配合uni-app發(fā)起微信支付的實現(xiàn)

    Django1.11配合uni-app發(fā)起微信支付的實現(xiàn)

    這篇文章主要介紹了Django1.11配合uni-app發(fā)起微信支付的實現(xiàn),文中通過示例代碼介紹的非常詳細,對大家的學(xué)習或者工作具有一定的參考學(xué)習價值,需要的朋友們下面隨著小編來一起學(xué)習學(xué)習吧
    2019-10-10
  • PyQt 異步任務(wù)多線程的幾種方案示例詳解

    PyQt 異步任務(wù)多線程的幾種方案示例詳解

    文章總結(jié)了多線程異步編程的不同方式,包括QThread、QThreadPool和concurrent.futures,分別適用于不同場景,本文結(jié)合實例代碼給大家介紹的非常詳細,感興趣的朋友一起看看吧
    2025-01-01
  • python使用aiohttp通過設(shè)置代理爬取基金數(shù)據(jù)簡單示例

    python使用aiohttp通過設(shè)置代理爬取基金數(shù)據(jù)簡單示例

    這篇文章主要為大家介紹了python使用aiohttp通過設(shè)置代理爬取基金數(shù)據(jù)簡單示例詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步,早日升職加薪
    2023-06-06
  • python實現(xiàn)的一只從百度開始不斷搜索的小爬蟲

    python實現(xiàn)的一只從百度開始不斷搜索的小爬蟲

    這是我第三天學(xué)python了, 想寫一個東西紀念一下吧,于是寫了一直爬蟲,但是不是好的蟲,只能講網(wǎng)頁的關(guān)鍵詞存到本地, 但是我覺得基本上算是一只小蟲了
    2013-08-08
  • python實現(xiàn)楊氏矩陣查找

    python實現(xiàn)楊氏矩陣查找

    這篇文章主要為大家詳細介紹了Python實現(xiàn)楊氏矩陣查找,具有一定的參考價值,感興趣的小伙伴們可以參考一下
    2019-03-03
  • Python+Pygame實戰(zhàn)之文字劇情游戲的實現(xiàn)

    Python+Pygame實戰(zhàn)之文字劇情游戲的實現(xiàn)

    這篇文章主要為大家詳細介紹了如何利用Python和Pygame實現(xiàn)兩款文字劇情游戲——《巨龍之洞》和《太空礦工》,感興趣的小伙伴可以了解一下
    2022-12-12
  • Python使用ffmpeg合成視頻、音頻的實現(xiàn)方法

    Python使用ffmpeg合成視頻、音頻的實現(xiàn)方法

    這篇文章主要介紹了Python使用ffmpeg合成視頻、音頻,通過本文的學(xué)習能幫助大家了解如何在python中調(diào)用ffmpeg模塊,對此進行音視頻合并,完成視頻合成,需要的朋友可以參考下
    2022-04-04
  • python創(chuàng)建進程fork用法

    python創(chuàng)建進程fork用法

    這篇文章主要介紹了python創(chuàng)建進程fork用法,實例分析了Python使用fork創(chuàng)建進程的使用方法,需要的朋友可以參考下
    2015-06-06

最新評論

偏关县| 新建县| 靖边县| 宕昌县| 池州市| 辽阳县| 汤阴县| 青铜峡市| 周口市| 仪陇县| 万山特区| 宁陵县| 南华县| 三江| 平罗县| 峨山| 新民市| 宣城市| 雷州市| 江口县| 盐边县| 广丰县| 儋州市| 海宁市| 深泽县| 长沙县| 江源县| 青川县| 突泉县| 拜城县| 凤凰县| 辛集市| 仪陇县| 偏关县| 泸定县| 任丘市| 竹北市| 南漳县| 类乌齐县| 铜梁县| 嘉峪关市|