AWS Athena CTAS创建表的S3存储类型及转CSV方法咨询
AWS Athena CTAS表存储类型及转CSV方法
存储类型说明
你看到的是Parquet格式(gzip压缩版),这是Athena执行CTAS语句时的默认存储格式:
xxxxxxxecc-manifest.csv:记录数据文件存储路径的清单文件xxxxxxxecc.metadata:包含表结构、分区信息的元数据文件folder_xxxxxxx里的.gz文件:实际的Parquet列存数据,用gzip压缩,这种格式比CSV更适合大数据分析场景
转换成CSV的方法
方法1:CTAS语句直接生成CSV表
修改CTAS语句,指定存储格式为CSV,可按需设置压缩:
CREATE TABLE table1_csv WITH ( format = 'TEXTFILE', field_delimiter = ',', external_location = 's3://your-bucket/path/to/csv-table/', compression = 'NONE' -- 也可选'GZIP'启用压缩 ) AS SELECT col1, col2 FROM tbl;
执行后S3路径会直接生成CSV(或压缩后的CSV)文件,无额外的manifest和metadata文件。
方法2:INSERT INTO导出到CSV表
先创建CSV格式的目标表,再插入数据:
- 创建目标表:
CREATE EXTERNAL TABLE table_csv ( col1 string, -- 字段类型需与源表匹配 col2 int ) ROW FORMAT DELIMITED FIELDS TERMINATED BY ',' LOCATION 's3://your-bucket/path/to/csv-table/';
- 插入数据:
INSERT INTO table_csv SELECT col1, col2 FROM tbl;
方法3:直接导出查询结果为CSV
在Athena控制台执行SELECT col1, col2 FROM tbl;,查询完成后在结果页面点击「下载结果」,选择CSV格式即可,适合小批量数据导出。
内容的提问来源于stack exchange,提问作者user1783504
相关产品推荐
相关产品推荐

