You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Power Query基于HANA表添加存在性判断列时性能缓慢的优化咨询

Power Query基于HANA表添加存在性判断列时性能缓慢的优化咨询

我现在通过HANA把两张表导入Excel(下面的Source指的是HANA的SQL查询语句),想通过Power Query给表2新增一列,用来判断表2里的CUSTOMER_NUMBER值是否存在于表1的CUSTOMER_ID列中。

但我的数据集非常大——接近100万行,虽然功能是实现了,但新增这一列居然要花好几个小时,看起来在添加列的过程中它在遍历数千万行数据。我调整过步骤顺序,也试过用缓冲,中间还触发过不少错误,好不容易能正常运行了,刷新一次还是慢得离谱。

想请教大家:

  • 这种情况背后到底是怎么回事?
  • 有什么方法能让这个操作变快?
  • 有没有其他更高效的实现方式?

我当前用的Power Query代码是:

= Table2.AddColumn(Source, "Purchased", each if(List.Contains(List.Buffer(Table1[CUSTOMER_ID]),[CUSTOMER_NUMBER])=true) then "YES" else "NO")

备注:内容来源于stack exchange,提问作者Sam R.

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.04.23 08:43:00