You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

MariaDB中如何提取列B字符串片段与列A、列C做匹配对比

MariaDB下划线分隔字段匹配解决方案

核心依赖函数

本次方案使用MariaDB原生支持的SUBSTRING_INDEX()函数实现片段提取,语法为SUBSTRING_INDEX(目标字符串, 分隔符, 计数):

  • 计数为正:从左往右数,返回第N个分隔符之前的全部内容
  • 计数为负:从右往左数,返回倒数第N个分隔符之后的全部内容

两项对比的实现逻辑

1. A列与B列首个片段匹配验证

直接提取B列第一个下划线之前的内容与A列对比即可:

SUBSTRING_INDEX(你的表名.B, '_', 1) = 你的表名.A

你提供的示例数据中,该语句提取结果为IvanIvanov,与A列值完全相等。

2. C列与B列末尾片段匹配验证

通用方案(适配C列包含任意数量下划线的场景)

先计算C列包含的下划线数量,再动态确定需要提取的末尾片段数:

SUBSTRING_INDEX(你的表名.B, '_', - (CHAR_LENGTH(你的表名.C) - CHAR_LENGTH(REPLACE(你的表名.C, '_', '')) + 1)) = 你的表名.C

简化方案(如果C列固定包含1个下划线,如你的示例y1988_12)

直接提取B列最后2个下划线分隔的片段对比即可:

SUBSTRING_INDEX(你的表名.B, '_', -2) = 你的表名.C

你提供的示例数据中,两种方案提取结果均为y1988_12,与C列值完全相等。


完整查询示例

以下语句可以筛选出所有不符合匹配规则的异常记录:

SELECT 
    A,
    B,
    C,
    SUBSTRING_INDEX(B, '_', 1) AS 提取B列首段,
    SUBSTRING_INDEX(B, '_', - (CHAR_LENGTH(C) - CHAR_LENGTH(REPLACE(C, '_', '')) + 1)) AS 提取B列尾段
FROM 你的表名
WHERE 
    SUBSTRING_INDEX(B, '_', 1) <> A
    OR 
    SUBSTRING_INDEX(B, '_', - (CHAR_LENGTH(C) - CHAR_LENGTH(REPLACE(C, '_', '')) + 1)) <> C;

如果需要过滤B列无下划线、首尾带下划线的异常数据,可以在WHERE条件最前面新增B LIKE '%\_%' AND B NOT LIKE '\_%' AND B NOT LIKE '%\_'判断规则,避免提取结果偏差。

内容的提问来源于stack exchange,提问作者IvanIvanov1988

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.27 22:15:08