文章詳情頁

python - 如何正則字符串中的所有漢字

瀏覽：117日期：2022-06-28 10:06:59

問題描述

這樣算嗎？121238asdf<img src='https://imgsa.baidu.com/forum/w%3D580/sign=da0493cd90ef76c6d0d2fb23ad14fdf6/e483aa4bd11373f0bddb2e73a40f4bfbf9ed04b1.jpg' height='420'>

字符串如上，類型是’str’，要正則獲得漢字。我之前使用[u4e00-u9fa5]結(jié)果獲得的還是英文，符號(hào)跟數(shù)字的list。求教導(dǎo)正確姿勢(shì)。另外說說我哪里寫錯(cuò)了..

pattern = re.compile(r’[u4E00-u9FA5]’)print pattern.findall(x[1])

這是我寫的...但是返回結(jié)果就沒有漢字，反而是除漢字外的其他字符。

問題解答

回答1：

我這里假設(shè)你需要匹配的文本為s：

pattern = re.compile(ur'[u4e00-u9fa5]')print pattern.findall(s.decode(’utf8’))

這里的decode(’utf8’)是怕s的值為類似x66x77x88這樣的Unicode散列。另外，需要注意compile()中ur修飾符，u為Unicode修飾符。

PS：我是從這篇文章得到的啟發(fā)。

Update

剛才看了下樓下說的，確實(shí)用Python 3就不存在輸出為Unicode散列的情況了，以下摘自此處

Unicode 字符串

在Python2中，普通字符串是以8位ASCII碼進(jìn)行存儲(chǔ)的，而Unicode字符串則存儲(chǔ)為16位unicode字符串，這樣能夠表示更多的字符集。使用的語法是在字符串前面加上前綴 u。

在Python3中，所有的字符串都是Unicode字符串。

回答2：

你用的是python2，uxxxx是unicode字符，匹配后得到的是字節(jié)串，print出來是各個(gè)字節(jié)值。

換python3 就沒這個(gè)問題了

Python 編程

上一條：python - Django ModelSerializer 如何POST提交非Models中定義、關(guān)聯(lián)表中的字段？下一條：python - 網(wǎng)頁title中包含換行，如何用正則表達(dá)式提取出來？

相關(guān)文章：

1. 數(shù)據(jù)庫 - Mysql的存儲(chǔ)過程真的是個(gè)坑！求助下面的存儲(chǔ)過程哪里錯(cuò)啦，實(shí)在是找不到哪里的問題了。2. php傳對(duì)應(yīng)的id值為什么傳不了啊有木有大神會(huì)的看我下方截圖3. 如何用筆記本上的apache做微信開發(fā)的服務(wù)器4. python - linux怎么在每天的凌晨2點(diǎn)執(zhí)行一次這個(gè)log.py文件5. 關(guān)于mysql聯(lián)合查詢一對(duì)多的顯示結(jié)果問題6. 冒昧問一下，我這php代碼哪里出錯(cuò)了？？？7. windows誤人子弟啊8. mysql優(yōu)化 - MySQL如何為配置表建立索引？9. MySQL主鍵沖突時(shí)的更新操作和替換操作在功能上有什么差別(如圖)10. 實(shí)現(xiàn)bing搜索工具urlAPI提交

排行榜

					
					請(qǐng)問browsersync如何監(jiān)聽多個(gè)html文件
windows誤人子弟啊
html5和Flash對(duì)抗是什么情況？
android - 哪位大神知道java后臺(tái)的api接口的對(duì)象傳到前端后輸入日期報(bào)錯(cuò)，是什么情況？求大神指點(diǎn)
冒昧問一下，我這php代碼哪里出錯(cuò)了？？？
android - 安卓使用webview播放騰訊、優(yōu)酷視頻的方法
javascript - CSS圖片輪播顯示問題
javascript - 怎么設(shè)計(jì)項(xiàng)目的返回碼，讓不同的返回碼代表不同的含義？
Android中能不能判斷一個(gè)數(shù)據(jù)庫是create來的，還是open來的？
css3 - 有什么方法可以看到 的css樣式啊
javascript - 微信支付：H5調(diào)起支付API，直接說支付失敗
				

熱門標(biāo)簽

国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

python - 如何正則字符串中的所有漢字