Databricks Serverless Compute Delta表读写支持及小查询性能相关问询
Databricks Serverless Compute 相关技术问题解答
前提说明:当前Databricks Serverless Compute仍处于AWS区域预览阶段,需单独申请开通后使用。
1 Delta表读写支持能力
- 该服务完整支持Delta表的全量读写操作,含常规写入、更新、删除、MERGE合并等事务操作,并非仅支持只读访问,预览阶段的功能限制不包含Delta表的基础ACID操作能力。
2 事务类小型查询的适配性
- Databricks Serverless不适用于高频事务类小型查询场景。其架构设计面向批量ETL、大数据量交互式分析、Ad-hoc查询等场景,服务启动、作业调度的基础开销远高于传统OLTP数据库。对于延迟要求为毫秒级、事务密集、单查询处理数据量小的场景,更推荐使用Azure SQL这类专门面向OLTP优化的关系型数据库。
3 Hive Metastore对Delta表查询性能的影响
- Databricks查询Delta表时访问Hive Metastore拉取元数据的机制,确实会对短查询性能产生负面影响。查询时需要先向元数据服务请求表结构、存储位置等信息,元数据未命中本地缓存时会产生额外的网络开销,叠加Databricks本身的查询执行链路是为大数据量扫描优化的特性,共同导致实测小型查询性能低于Azure SQL这类元数据内嵌、短查询链路高度优化的OLTP产品。
内容的提问来源于stack exchange,提问作者Sreedhar
相关产品推荐
相关产品推荐

