You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

关于Microsoft Fabric Data Flow Gen2按文件夹识别聚合数据的问询

在Microsoft Fabric Data Flow Gen2中基于SharePoint文件夹自动识别并聚合销售/采购数据

核心实现步骤

  • 保留文件夹路径作为识别依据
    连接SharePoint文件夹数据源时,选择加载整个文件夹(包含子文件夹),在Power Query编辑器中务必保留Folder Path列——这是区分销售/采购数据的核心标识,不要提前删除。

  • 添加数据类别标记列
    插入自定义列,通过文件夹路径文本匹配来标记数据所属类别,Power Query代码示例:

    = if Text.Contains([Folder Path], "销售") then "销售" else if Text.Contains([Folder Path], "采购") then "采购" else "未知"
    

    将该列命名为数据类别,后续所有数据都会带上明确的分类标签。

  • 合并文件并配置增量更新
    对所有文件执行「合并文件」操作(因你已确认两类数据结构一致,直接合并即可);开启Data Flow的增量刷新功能,选择文件的Modified Date或创建时间作为增量判断字段,确保新增文件仅被加载一次,避免重复处理。

  • 验证新增数据自动识别
    在SharePoint的销售/采购子文件夹分别新增测试文件,手动触发Data Flow刷新后,检查数据仓库中的数据类别列是否正确标记新增数据,确认数据已自动归入对应类别。

注意事项

  • 确保Data Flow拥有SharePoint所有目标子文件夹的读取权限,否则会出现数据加载不全的问题
  • 如果后续文件夹名称有变动,需同步修改Power Query中的文本匹配规则,保证分类逻辑有效
  • 若需在Data Flow内直接完成聚合,可按数据类别列分组,按需计算各类别的汇总指标

内容的提问来源于stack exchange,提问作者André Lourenço

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.30 05:58:12