Teradata SQL Assistant多行字符串拼接报‘不可转换字符’错误求助
Teradata多行字符串拼接解决字符不可翻译错误
问题场景
现有数据表内容:
ID TEXT 01 Hello 01 hello I have a question 02 Hi!! 02 Thank you
期望按ID聚合拼接TEXT字段,结果为:
ID TEXT 01 Hello; hello I have a question 02 Hi!!; Thank you
错误原因
使用XMLAGG时触发SELECT Failed: The string contains an untranslatable character错误,核心原因是XMLAGG会校验输入字符是否符合XML规范,TEXT字段中存在XML不允许的特殊字符(如控制字符、非打印字符)时,就会触发该报错。之前尝试的编码转换方法未解决问题,是因为没有针对XML兼容的字符校验做处理。
解决方案
方案1:使用LISTAGG(推荐,Teradata 14.10及以上版本支持)
LISTAGG是Teradata专门用于字符串聚合的原生函数,无需依赖XML转换逻辑,彻底避开XML的字符校验限制,语法更简洁直接:
SELECT ID, LISTAGG(TRIM(TEXT), '; ') WITHIN GROUP (ORDER BY TEXT) AS TEXT FROM my_table GROUP BY ID;
方案2:修复XMLAGG的字符兼容问题
若Teradata版本不支持LISTAGG,可以通过以下两种方式处理特殊字符,让XMLAGG正常工作:
方式A:用XMLENCODE转义特殊字符
将TEXT中的特殊字符转为XML实体,满足XML规范要求:
SELECT ID, TRIM(TRAILING '; ' FROM ( XMLAGG( TRIM(XMLENCODE(TEXT)) || '; ' ORDER BY TEXT ) (VARCHAR(2000)) )) AS TEXT FROM my_table GROUP BY ID;
方式B:过滤非打印字符
通过正则表达式直接移除所有非打印字符,确保输入XMLAGG的内容符合校验标准:
SELECT ID, TRIM(TRAILING '; ' FROM ( XMLAGG( TRIM(REGEXP_REPLACE(TEXT, '[^[:print:]]', '')) || '; ' ORDER BY TEXT ) (VARCHAR(2000)) )) AS TEXT FROM my_table GROUP BY ID;
内容的提问来源于stack exchange,提问作者pedritoanonimo
相关产品推荐
相关产品推荐

