如何使用REGEXEXTRACT提取URL中除https://等协议外的剩余内容
REGEXEXTRACT 去除URL协议前缀的正确正则公式
你原有公式=REGEXEXTRACT(A1,"(\..+)")的问题在于匹配逻辑是从URL中第一个.的位置开始向后捕获,会直接丢失.之前的子域名部分,不符合需求。
通用适配方案(兼容http、https两种协议)
使用公式:=REGEXEXTRACT(A1, "^https?://(.+)$")
正则逻辑说明
^https?://精准匹配URL开头的http://或https://协议前缀- 括号分组
(.+)捕获协议前缀之后的所有内容,包含完整域名、路径等部分 - 针对示例输入
https://info.example.edu/programs/degree/page1/,输出结果为info.example.edu/programs/degree/page1/,完全符合预期。
固定https协议的精简方案
如果你确认所有输入URL均为https开头,可以使用更简单的版本:=REGEXEXTRACT(A1, "^https://(.+)$")
内容的提问来源于stack exchange,提问作者MegaMikeJr
相关产品推荐
相关产品推荐

