Python數(shù)據(jù)處理之字符串處理技巧全解析
還在為處理文本數(shù)據(jù)頭疼? 據(jù)統(tǒng)計,Python開發(fā)者70%的日常編碼都在和字符串打交道!
本文詳解Python字符串操作核心技巧:
- 字符串切片與拼接的隱藏技巧
- 文本查找替換的實戰(zhàn)方法
- 數(shù)據(jù)清洗格式化全流程
- 附可直接運行的完整代碼模板
一、字符串的"七十二變":創(chuàng)建與切片
Python字符串就像靈活的積木,支持多種創(chuàng)建方式:
# 單雙引號通用 msg = "Hello 數(shù)據(jù)科學家!" path = r'C:\new_folder' # 原始字符串避免轉(zhuǎn)義 # 切片操作 [start:end:step] text = "Python超實用" print(text[2:5]) # tho print(text[::-1]) # 用實超nohtyP
二、文本拼接的3把利器
- 加號拼接:簡單少量文本
- join()方法:高效連接列表
- f-string:Python 3.6+首選
names = ["張偉", "李娜", "王陽"]
# 傳統(tǒng)方式(性能低)
full_str = names[0] + "," + names[1] + "," + names[2]
# 高效方式
print(",".join(names)) # 張偉,李娜,王陽
# 現(xiàn)代方式(推薦)
print(f"獲獎者:{names[0]}、{names[1]}、{names[2]}")三、切割與重組:split()和join()
這對黃金搭檔處理結(jié)構(gòu)化文本:
# 拆分CSV數(shù)據(jù)
csv_data = "ID,Name,Salary\n101,張三,15000"
rows = csv_data.split('\n')
for row in rows:
cols = row.split(',')
print(cols)
# 重組URL路徑
folders = ['img','2024','logo.png']
print('/'.join(folders)) # img/2024/logo.png四、精準定位:查找替換技巧
- find():返回首次出現(xiàn)位置
- replace():全局替換內(nèi)容
- in關鍵字:快速存在性檢測
log = "ERROR: File not found [code:404]"
# 定位關鍵信息
print(log.find("404")) # 28
print("ERROR" in log) # True
# 敏感信息脫敏
secure_log = log.replace("404", "XXX")
print(secure_log) # ERROR: File not found [code:XXX]五、格式化輸出:三種高階玩法
告別混亂拼接:
# 1. %格式化(經(jīng)典)
print("溫度:%.1f°C" % 23.456) # 溫度:23.5°C
# 2. str.format()(靈活)
print("坐標:({x},{y})".format(x=120, y=89))
# 3. f-string(推薦)
name = "Alice"
print(f"歡迎{name.upper()}!積分:{1000*1.2:.0f}")六、清洗標準化:大小寫與空白處理
數(shù)據(jù)清洗必備四件套:
raw_text = " Python數(shù)據(jù)分析 \t\n"
# 去空格
clean_text = raw_text.strip()
print(clean_text) # "Python數(shù)據(jù)分析"
# 大小寫轉(zhuǎn)換
print(clean_text.upper()) # PYTHON數(shù)據(jù)分析
print(clean_text.lower()) # python數(shù)據(jù)分析
# 首字母大寫
print("hello world".title()) # Hello World七、終極武器:完整數(shù)據(jù)處理模板
def clean_text_data(text):
"""文本清洗標準化流程"""
# 1. 去除首尾空白
text = text.strip()
# 2. 轉(zhuǎn)換為小寫
text = text.lower()
# 3. 替換特殊字符
text = text.replace('$', 'USD').replace('¥', 'CNY')
# 4. 分割重組
words = text.split()
return ' '.join(words[:5]) # 保留前5個詞
raw_data = " $19.99 限時優(yōu)惠 買一送一 "
print(clean_text_data(raw_data))
# 輸出:usd19.99 限時優(yōu)惠 買一送一到此這篇關于Python數(shù)據(jù)處理之字符串處理技巧全解析的文章就介紹到這了,更多相關Python字符串處理內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!
相關文章
python 在某.py文件中調(diào)用其他.py內(nèi)的函數(shù)的方法
這篇文章主要介紹了python 在某.py文件中調(diào)用其他.py內(nèi)的函數(shù)的方法,本文給大家介紹的非常詳細,具有一定的參考借鑒價值,需要的朋友可以參考下2019-06-06
Python分析微信好友性別比例和省份城市分布比例的方法示例【基于itchat模塊】
這篇文章主要介紹了Python分析微信好友性別比例和省份城市分布比例的方法,結(jié)合實例形式分析了Python基于itchat模塊獲取及計算微信好友相關信息操作技巧,需要的朋友可以參考下2020-05-05
在Python中執(zhí)行和調(diào)用JavaScript的多種方法小結(jié)
JavaScript(JS)是一種常用的腳本語言,通常用于網(wǎng)頁開發(fā),但有時也需要在Python中執(zhí)行或調(diào)用JavaScript代碼,本文將詳細介紹Python中執(zhí)行和調(diào)用JavaScript的多種方法,每種方法都將附有示例代碼,方便理解如何在Python中與JavaScript進行互動,需要的朋友可以參考下2023-11-11

