解決Python調(diào)用df.to_csv()出現(xiàn)中文亂碼的問題
更新時間:2024年09月18日 12:12:33 作者:必須掂水
在Python使用df.to_csv()時,若出現(xiàn)中文亂碼,可通過加入?yún)?shù)encoding="utf_8_sig"解決,"utf-8"編碼不包含BOM,直接處理文件時會將BOM誤讀為內(nèi)容;而"utf_8_sig"會識別并處理BOM,避免亂碼,此方法為實踐經(jīng)驗,供參考
Python調(diào)用df.to_csv()出現(xiàn)中文亂碼
df = pd.DataFrame(data=total_info, columns=[‘公司全名', ‘公司簡稱', ‘公司規(guī)模', ‘融資階段', ‘區(qū)域', ‘職位名稱', ‘工作經(jīng)驗', ‘學歷要求', ‘薪資', ‘職位福利', ‘經(jīng)營范圍', ‘職位類型', ‘公司福利', ‘第二職位類型', ‘城市']) df.to_csv(‘C:/Users/Shinelon/Desktop/Python_development_engineer.csv', index=False)
結(jié)果出現(xiàn)亂碼:

解決方案
加上**encoding=“utf_8_sig”**就好了。
df.to_csv(‘C:/Users/Shinelon/Desktop/Python_development_engineer.csv', encoding=“utf_8_sig”)

注意注意
‘utf-8’ 和 ‘utf_8_sig’ 的區(qū)別:
- ”utf-8“ 是以字節(jié)為編碼單元,它的字節(jié)順序在所有系統(tǒng)中都是一樣的,沒有字節(jié)序問題,因此它不需要BOM,所以當用"utf-8"編碼方式讀取帶有BOM的文件時,它會把BOM當做是文件內(nèi)容來處理。
- “uft-8-sig"中sig( signature )是"帶有簽名的utf-8”, 所以"utf-8-sig"讀取帶有BOM的"utf-8文件時"會把BOM單獨處理,與文本內(nèi)容隔離開。
總結(jié)
以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關文章
Python列表list數(shù)組array用法實例解析
這篇文章主要介紹了Python列表list數(shù)組array用法,實例解析了關于數(shù)組的各種常見操作,非常具有實用價值,需要的朋友可以參考下2014-10-10
詳解Python中的數(shù)據(jù)清洗工具flashtext
FlashText是GitHub上的一個開源Python庫,正如之前所提到的,它在提取關鍵字和替換關鍵字任務上有著極高的性能。本文將詳解一下flashtext的使用,需要的可以參考一下2022-06-06
Python drop方法刪除列之inplace參數(shù)實例
這篇文章主要介紹了Python drop方法刪除列之inplace參數(shù)實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2020-06-06

