您好, 欢迎来到 !    登录 | 注册 | | 设为首页 | 收藏本站

在python正则表达式中匹配unicode字符

在python正则表达式中匹配unicode字符

您需要指定re.UNICODE标志, 使用u前缀将您的字符串输入为Unicode字符串:

>>> re.match(r'^/by_tag/(?P<tag>\w+)/(?P<filename>(\w|[.,!#%{}()@])+)$', u'/by_tag/påske/øyfjell.jpg', re.UNICODE).groupdict()
{'tag': u'p\xe5ske', 'filename': u'\xf8yfjell.jpg'}

这在Python 2中;在Python 3中,您必须省略,u因为所有字符串都是Unicode。

python 2022/1/1 18:39:26 有230人围观

撰写回答


你尚未登录,登录后可以

和开发者交流问题的细节

关注并接收问题和回答的更新提醒

参与内容的编辑和改进,让解决方法与时俱进

请先登录

推荐问题


联系我
置顶