You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用REGEXEXTRACT提取URL中除https://等协议外的剩余内容

REGEXEXTRACT 去除URL协议前缀的正确正则公式

你原有公式=REGEXEXTRACT(A1,"(\..+)")的问题在于匹配逻辑是从URL中第一个.的位置开始向后捕获,会直接丢失.之前的子域名部分,不符合需求。

通用适配方案(兼容http、https两种协议)

使用公式:
=REGEXEXTRACT(A1, "^https?://(.+)$")

正则逻辑说明

  • ^https?:// 精准匹配URL开头的http://或https://协议前缀
  • 括号分组(.+)捕获协议前缀之后的所有内容,包含完整域名、路径等部分
  • 针对示例输入https://info.example.edu/programs/degree/page1/,输出结果为info.example.edu/programs/degree/page1/,完全符合预期。

固定https协议的精简方案

如果你确认所有输入URL均为https开头,可以使用更简单的版本:
=REGEXEXTRACT(A1, "^https://(.+)$")

内容的提问来源于stack exchange,提问作者MegaMikeJr

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.07 07:18:02