Power Query基于HANA表添加存在性判断列时性能缓慢的优化咨询
Power Query基于HANA表添加存在性判断列时性能缓慢的优化咨询
我现在通过HANA把两张表导入Excel(下面的Source指的是HANA的SQL查询语句),想通过Power Query给表2新增一列,用来判断表2里的CUSTOMER_NUMBER值是否存在于表1的CUSTOMER_ID列中。
但我的数据集非常大——接近100万行,虽然功能是实现了,但新增这一列居然要花好几个小时,看起来在添加列的过程中它在遍历数千万行数据。我调整过步骤顺序,也试过用缓冲,中间还触发过不少错误,好不容易能正常运行了,刷新一次还是慢得离谱。
想请教大家:
- 这种情况背后到底是怎么回事?
- 有什么方法能让这个操作变快?
- 有没有其他更高效的实现方式?
我当前用的Power Query代码是:
= Table2.AddColumn(Source, "Purchased", each if(List.Contains(List.Buffer(Table1[CUSTOMER_ID]),[CUSTOMER_NUMBER])=true) then "YES" else "NO")
备注:内容来源于stack exchange,提问作者Sam R.
相关产品推荐
相关产品推荐

