Python2和3字符編碼的區(qū)別知識點整理
python解釋器運行代碼的流程啟動python解釋器(相當于文本編輯器)打開文件,顯示這個字符并檢查語法(涉及字符編碼, a=1只是一個很普通的字符)解釋字符 (涉及字符編碼,再去內存空間 生成一個a=1的變量)
python2用的是ascii, python3默認是utf8讀取字符
# coding:gbk會告訴python3解釋器用gbk編碼讀取字符
python3(了解)
你看到的其實是unicode
但是終端幫你把這個unicode的0和1做一個轉換,從unicode轉換成了終端能夠識別的編碼格式,然后變成中文
# coding:gbk a = '中文' # 用unicode編碼存儲了這堆0和1 print(a) # 010101010
假設終端的默認編碼是gbk , 認識 unicode編碼的變量
假設終端的默認編碼是utf8,認識 unicode編碼的變量
Python2(了解)
unicode + 指定的coding編碼(str類型)
# coding:gbk a = '中文' # 用gbk編碼存儲了這堆0和1 a = u'中文' # 用unicode編碼存儲了這堆0和1 print(a)
終端是一個文本編輯器,會有默認編碼.
假設終端的默認編碼是gbk , 認識 gbk編碼的變量
假設終端的默認編碼是utf8, 不認識 gbk編碼的變量

總結
| 代碼詳情 | Python2執(zhí)行情況 | Python3執(zhí)行情況 |
|---|---|---|
| # coding:gbk print('中') 終端:utf8 |
亂碼 | 不亂碼 |
| # coding:utf8 print('中') 終端:utf8 |
不亂碼 | 不亂碼 |
| # coding:gbk print(u'中') 終端:utf8 |
不亂碼 | 不亂碼 |
| # coding:utf8 print(u'中') 終端:utf8 |
不亂碼 | 不亂碼 |
不亂碼不亂碼
在Python2中如果指定了字符編碼,那么內存存取就會按照指定的字符編碼去入內存。解釋或去執(zhí)行時就要按照指定了的字符編碼去解釋,否則就會亂碼。 否則可以在定義變量前面加上u,這樣變量就會以unicode編碼存入內存。
如:
#coding:gbkname = "爸爸"
但在Python3中就不會有這樣的問題,因為無論你指定了什么字符編碼,在內存存取時都會使用Unicode編碼去入內存Unicode編碼可以和任意的字符編碼相互轉換,并在讀取時按照所需的編碼區(qū)讀取,這樣就很好解決了字符編碼的問題
以上就是相關的全部內容知識點,感謝大家對腳本之家的支持。
相關文章
python之當你發(fā)現QTimer不能用時的解決方法
今天小編就為大家分享一篇python之當你發(fā)現QTimer不能用時的解決方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2019-06-06
詳談Python3 操作系統(tǒng)與路徑 模塊(os / os.path / pathlib)
下面小編就為大家分享一篇詳談Python3 操作系統(tǒng)與路徑 模塊(os / os.path / pathlib),具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2018-04-04
如何在Python項目中做多環(huán)境配置(環(huán)境變量使用.env文件)
實際工程開發(fā)中常常會對開發(fā)、測試和生產等不同環(huán)境配置不同的數據庫環(huán)境,傳統(tǒng)方式可以通過添加不同環(huán)境的配置文件達到部署時的動態(tài)切換的效果,這篇文章主要給大家介紹了關于如何在Python項目中做多環(huán)境配置的相關資料,環(huán)境變量使用.env文件,需要的朋友可以參考下2024-06-06
Django imgareaselect手動剪切頭像實現方法
這篇文章主要介紹了Django imgareaselect手動剪切頭像實現方法,實例分析了Django框架操作圖片的相關技巧,需要的朋友可以參考下2015-05-05

