python正则表达式中要匹配汉字怎么弄-PHP中文网问答

python正则表达式中要匹配汉字怎么弄

天蓬老师 2017-04-18 09:26:14

[Python讨论组]

479

天蓬老师

欢迎选择我的课程，让我们一起见证您的进步~~

全部回复(6)

PHPz2017-04-18 09:28:14 6楼

>>> import re
>>> pattern = re.compile(r'^\u539f\u6587\u94fe\u63a5\uff1a<a href=\"(http:\/\/.*)\">$')
>>> match = pattern.match('原文链接：<a href="http://www.darkreading.com">')
>>> match.group(1)
'http://www.darkreading.com'

赞 +0

添加回复

ringa_lee2017-04-18 09:28:14 5楼

小提示，py2的话，可以用字符串前缀 u''
如: ur'原文链接：<a href="(.*?)">'

赞 +0

添加回复

PHPz2017-04-18 09:28:14 4楼

我写 js 的，正则的话，可以匹配 u... 这种汉字码，有个范围，u4e00-u9fa5 是简体好像。。。

赞 +0

添加回复

黄舟2017-04-18 09:28:14 3楼

要考虑你抓下的网页是用什么编码实现的

赞 +0

添加回复

高洛峰2017-04-18 09:28:14 2楼

希望这是你想要的答案：

赞 +0

添加回复

PHP中文网2017-04-18 09:28:14 1楼

import re
s='原文链接：<a href="http://www.darkreading.com">'
ptn = re.compile('原文链接[^<]*?<a[^>]*?href="([^"]*)')
print(ptn.findall(s))

赞 +0

添加回复

专题推荐

更多>

热门话题

热门教程

更多>