json - python中用正則表達(dá)式去掉字符串中的冒號(hào)
問題描述
初學(xué)python,最近嘗試爬數(shù)據(jù),json字符串的value中有冒號(hào),需要去掉。我的代碼如下。 a和b都是value中會(huì)有冒號(hào)的字符串
import rea = 'Title:’Intern: Customer Experience + Innovation (CX+I) Intern Brands’'b = 'cmp:’Adecco: USA’,cmpesc:’Adecco: USA’'result = re.sub(’^(?:Title|cmp|cmpesc):.+(:)’,’’, a)
代碼執(zhí)行結(jié)果是只剩 Customer Experience + Innovation (CX+I) Intern Brands’,之前的內(nèi)容全被刪除了,而我想要的效果是只刪intern之后的那個(gè)冒號(hào)(title后的冒號(hào)要保留)。請(qǐng)問大家該如何修改?
問題解答
回答1:import reresult = re.sub(’^(Title|cmp|cmpesc:)(.+):(.*)’,’123’,'Title:’Intern: Customer Experience + Innovation (CX+I) Intern Brands’')print(result) # Title:’Intern Customer Experience + Innovation (CX+I) Intern Brands’回答2:
這樣的話:
’’.join(re.split(’(?<![Title|cmp|cmpesc]):’,a))
就好了
回答3:果然是我看錯(cuò)題目了....
回答4:不用去掉冒號(hào),直接變成字典就行了~
>>> a = 'Title:’Intern: Customer Experience + Innovation (CX+I) Intern Brands’';b = 'cmp:’Adecco: USA’,cmpesc:’Adecco: USA’'>>> dict([s.split(’:’,1) for s in a.split(’,’)]){’Title’: '’Intern: Customer Experience + Innovation (CX+I) Intern Brands’'}>>> dict([s.split(’:’,1) for s in b.split(’,’)]){’cmpesc’: '’Adecco: USA’', ’cmp’: '’Adecco: USA’'}>>>
寫成函數(shù)
a = 'Title:’Intern: Customer Experience + Innovation (CX+I) Intern Brands’'b = 'cmp:’Adecco: USA’,cmpesc:’Adecco: USA’'def fn(x): return dict((s.split(’:’,1) for s in x.replace('’','').split(’,’)))print(fn(a))print(fn(b))# {’Title’: ’Intern: Customer Experience + Innovation (CX+I) Intern Brands’}# {’cmp’: ’Adecco: USA’, ’cmpesc’: ’Adecco: USA’}
相關(guān)文章:
1. nignx - docker內(nèi)nginx 80端口被占用2. docker - 如何修改運(yùn)行中容器的配置3. python3.x - python連oanda的模擬交易api獲取json問題第五問4. node.js - 我是一個(gè)做前端的,求教如何學(xué)習(xí)vue,node等js引擎?5. java - SSH框架中寫分頁(yè)時(shí)service層中不能注入分頁(yè)類6. angular.js - angular內(nèi)容過長(zhǎng)展開收起效果7. 為什么我ping不通我的docker容器呢???8. docker-machine添加一個(gè)已有的docker主機(jī)問題9. javascript - js代碼獲取驗(yàn)證碼倒計(jì)時(shí)問題10. 關(guān)于docker下的nginx壓力測(cè)試
