如何在BigQuery中筛选REPEATED类型的嵌套列?
正确的BigQuery筛选REPEATED列的语法
你的SQL报错核心原因是UNNEST后未给展开的元素指定别名,导致WHERE子句中的NAME同时匹配原数组列和展开后的单个值列,产生列名歧义。以下针对两种常见需求给出正确写法:
需求1:保留原始整行记录(含完整NAME数组),筛选数组中至少有一个元素匹配%VERMA%的记录
这种写法不会展开数组,直接判断数组内是否存在符合条件的元素:
SELECT CUST_ID, NAME FROM `你的项目.你的数据集.Table` WHERE EXISTS ( SELECT 1 FROM UNNEST(NAME) AS n WHERE n LIKE '%VERMA%' )
需求2:展开数组,只保留匹配%VERMA%的元素对应的行
如果需要把符合条件的数组元素拆分成单独行展示:
SELECT CUST_ID, n AS matching_name, -- 仅展示匹配的元素 NAME AS original_full_names -- 可选,保留原始完整数组 FROM `你的项目.你的数据集.Table`, UNNEST(NAME) AS n WHERE n LIKE '%VERMA%'
原SQL的问题说明
UNNEST(NAME)未指定别名,导致WHERE NAME LIKE '%VERMA%'中的NAME既指向原表的REPEATED列,又指向展开后的单个值列,BigQuery无法识别目标列。SELECT * EXCEPT(NAME)试图排除原数组列,但展开后的结果集中同时存在原数组列和展开后的元素列,EXCEPT无法处理这种歧义冲突。
内容的提问来源于stack exchange,提问作者Piyush
相关产品推荐
相关产品推荐

