Databricks SQL如何按指定单词拆分字符串至不同列?
解决方案
针对你在Databricks SQL中拆分赛事名称的需求,这里提供两种可行方法:
方法1:使用split函数
你之前的split(match_name,'[at]', 1)无效,是因为[at]代表字符集合,会把字符串里的单个a或t作为分隔符,而实际分隔符是带前后空格的"at"。正确写法如下:
- 提取客队:
split(match_name, ' at ')[0] - 提取主队:
split(match_name, ' at ')[1]
' at '是精确匹配带空格的分隔符,执行split后会得到包含两个元素的数组,第一个元素是at之前的客队名称,第二个是at之后的主队名称。
方法2:使用regexp_extract函数
你之前用(\d+)at(\d+)作为正则表达式无效,是因为这个正则只匹配数字,而球队名称是文本内容。正确的正则应该匹配at前后的文本:
提取客队:
regexp_extract(match_name, '(.*?) at ', 1)提取主队:
regexp_extract(match_name, ' at (.*)', 1)(.*?)是非贪婪匹配,确保只捕获at之前的客队名称,避免过度匹配;(.*)则捕获at之后的所有内容,得到完整的主队名称。
示例验证
对于match_name = 'Detroit Lions at New York Jets':
- 客队提取结果:
Detroit Lions - 主队提取结果:
New York Jets
内容的提问来源于stack exchange,提问作者hansolo
相关产品推荐
相关产品推荐

