Azure Synapse聚合数据存储位置咨询:是否生成OneLake新数据集或存于Synapse?
关于Azure Synapse Data Warehouse聚合数据存储位置的解答
已知OneLake可确保数据的单一副本,现咨询:使用Azure Synapse Data Warehouse将数据聚合至新表时,新生成的聚合数据是会在OneLake的新工作区/目录/位置创建新数据集,还是直接存储在Synapse中?
聚合数据的存储位置完全取决于你创建表的类型:
- 若创建外部表存储聚合结果:数据会被写入OneLake指定的工作区、目录或Lakehouse路径下,完全归OneLake统一管理,不会占用Synapse专用SQL池的本地存储,符合OneLake单一副本的设计理念。
- 若创建本地表存储聚合结果:数据会直接存在Synapse专用SQL池的本地存储里,这部分数据不属于OneLake的存储体系,相当于生成了额外的数据副本,违背OneLake单一副本的原则。
如果要严格遵循OneLake的单一副本架构,优先选择创建外部表,将聚合数据写入OneLake的指定位置,确保所有数据都在统一的存储层中管理。
内容的提问来源于stack exchange,提问作者kikee1222
相关产品推荐
相关产品推荐

