使用pg_dump导出Redshift表时CREATE TABLE语句为空问题求助
我之前也碰到过类似的情况,这本质上是Redshift的表结构特性和标准PostgreSQL的pg_dump工具兼容性导致的问题,下面给你拆解原因和解决方案:
问题根源
你用CREATE TABLE <table> (LIKE <parentTable>);创建的表,在Redshift的元数据中,列定义是依赖父表的引用关系,而标准PostgreSQL的pg_dump工具无法正确解析这种特殊的表结构,所以导出时只会生成空的CREATE TABLE ()语句;后续的ALTER语句是因为pg_dump能读取到列的约束信息,但没把列定义整合到CREATE TABLE里。另外,一定要确保你用的是Redshift官方适配的pg_dump工具,普通PostgreSQL版本的pg_dump对Redshift的特性支持不全,这也是常见的触发原因。
解决方案
1. 使用Redshift专用的pg_dump工具
这是最稳妥的解决办法:
- 从AWS官方下载和你的Redshift集群版本匹配的pg_dump工具(可以在Redshift控制台的「集群详情」→「连接参数」里找到对应的工具下载链接,或者参考Redshift官方文档)
- 替换你原来的pg_dump命令,用这个专用工具执行导出,它能正确识别LIKE创建的表的完整列结构,导出的CREATE TABLE语句会包含所有列定义。
2. 添加Redshift专属的导出参数
如果你暂时无法更换pg_dump工具,可以尝试添加--include-liked-columns参数(这个是Redshift pg_dump特有的选项),修改后的命令如下:
pg_dump -s --include-liked-columns -t test_data_sampling.customer -t test_data_sampling.orders -t test_data_sampling.addr --dbname=postgresql://<user>:<password>@<host>:<port>/dbName?ssl=true --file=backup_dbName.sql
这个参数会让pg_dump展开LIKE表的列定义,生成完整的CREATE TABLE语句。
3. 备选:手动生成DDL(应急方案)
如果上面的方法都无法生效,你可以通过Redshift内置函数批量获取表的完整DDL:
-- 获取单表的完整DDL SELECT pg_get_tabledef('test_data_sampling.orders', true); -- 批量获取多个表的DDL SELECT tablename, pg_get_tabledef(schemaname || '.' || tablename, true) as table_ddl FROM pg_tables WHERE schemaname = 'test_data_sampling' AND tablename IN ('customer', 'orders', 'addr');
把查询结果中的table_ddl字段内容拼接起来,就是完整的表结构脚本,同样能满足你的需求。
验证步骤
执行修改后的导出命令或生成DDL后,打开输出的SQL脚本,确认CREATE TABLE语句已经包含了所有列的定义(比如CREATE TABLE test_data_sampling.orders(orders_id int primary key, cust_id int, ...);),而不是空的括号。之后可以在测试环境执行脚本,检查表结构是否和原表一致。
内容的提问来源于stack exchange,提问作者Flo

