如何在Azure Data Flow中按空值列分组并将空值作为单独聚合组
在Azure Data Flow中聚合时将空值作为单独分组的实现方法
操作步骤:
- 打开Aggregation transformation的Group by配置面板
- 不要直接选择原始列
col1作为分组键,点击分组键右侧的表达式编辑图标(笔形按钮) - 在表达式编辑器中输入:
iif(isNull(col1), '_NULL_PLACEHOLDER_', col1),用一个不会与col1现有值冲突的占位符临时替换空值 - 正常配置聚合操作
sum(col2),此时空值会被作为独立分组计算总和 - 若需要将结果中的占位符还原为空值,添加一个Derived Column转换,针对
col1列编写表达式:iif(col1 == '_NULL_PLACEHOLDER_', null(), col1)
原理说明:
Azure Data Flow默认在聚合分组时会跳过空值行,通过临时将空值替换为唯一占位符,让系统识别为独立分组,聚合完成后再还原为空值,全程不会修改原始CSV文件的数据,完全满足需求。
内容的提问来源于stack exchange,提问作者AzSurya Teja
相关产品推荐
相关产品推荐

