You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Julia中使用Python正则模块?PyCall调用re.findall报错求助

解决Julia中PyCall调用Python re.findall的错误问题

这个问题我之前碰到过,本质就是Julia原生正则对象和Python正则模块的参数要求不兼容在搞鬼:

你在Julia里写的r"[\w']+|[.,!?;]"会生成一个Julia自己的Regex类型对象,但Python的re.findall()要求第一个参数必须是字符串格式的正则表达式,或者用re.compile()编译好的Python正则模式对象,直接传Julia的Regex对象自然就触发TypeError了。

下面给你两种可行的解决办法:

方法1:直接传递字符串形式的正则表达式

把正则表达式写成Julia的普通字符串(去掉r前缀),用三重双引号包裹可以避免内部单引号的转义问题:

using PyCall
@pyimport re
re.findall("""[\w']+|[.,!?;]""", "Hello, I'm a string!")

运行后就能得到和Python一样的结果:["Hello", ",", "I'm", "a", "string", "!"]

方法2:先编译Python正则模式(适合多次调用场景)

如果需要重复使用这个正则表达式,先编译成Python的模式对象会更高效:

using PyCall
@pyimport re
# 编译正则模式
py_pattern = re.compile("""[\w']+|[.,!?;]""")
# 调用findall
py_pattern.findall("Hello, I'm a string!")

这个方法同样能得到正确的拆分结果,而且重复调用时不用每次解析正则表达式。

另外补个小细节:如果你的正则里有需要转义的字符(比如反斜杠),记得按照Python的字符串转义规则来写,比如Python里的\d在Julia字符串里直接写\d就行,不用额外转义~

内容的提问来源于stack exchange,提问作者zwlayer

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.15 04:26:51