如何通过Node.js编写Lambda函数读取Amazon S3存储桶文件并对内容数字求和
依赖库说明
AWS官方提供的SDK是唯一需要的工具,无需引入第三方库:
- Lambda Node.js 14.x及以上运行时默认预装了
aws-sdk(V2版本),不需要手动安装、上传依赖包,直接引入即可使用,推荐优先选择该版本 - 如果需要使用更新的V3版本SDK,手动安装
@aws-sdk/client-s3包即可
核心可用函数
aws-sdk V2(无需额外安装)
s3.listObjectsV2():用于列举指定存储桶下的所有文件,内置分页能力,文件数量超过1000个时可通过透传ContinuationToken拉取全量列表s3.getObject():用于读取单个文件的内容,返回的Body字段为Buffer类型,可按需转换为字符串、JSON等格式做后续处理
核心业务逻辑实现步骤
- 调用
listObjectsV2拉取存储桶内全量文件路径,处理分页逻辑确保不漏文件 - 遍历所有文件路径,逐个调用
getObject获取文件内容 - 用正则匹配提取内容中所有数字,累加得到总和即可
- 若桶内文件数量多、体积大,提前调整Lambda的内存和超时时间配置,避免执行中断
示例代码(基于aws-sdk V2)
const AWS = require('aws-sdk'); const s3 = new AWS.S3(); // 匹配规则支持整数、带正负号的小数,可根据业务需求调整 const NUMBER_REG = /[-+]?\d*\.?\d+/g; exports.handler = async (event) => { // 替换为你的存储桶名称 const bucketName = 'your-bucket-name'; let totalSum = 0; let continuationToken = null; do { // 拉取文件列表 const listParams = { Bucket: bucketName, ContinuationToken: continuationToken }; const listRes = await s3.listObjectsV2(listParams).promise(); // 遍历读取每个文件内容并求和 for (const file of listRes.Contents) { const getParams = { Bucket: bucketName, Key: file.Key }; const fileRes = await s3.getObject(getParams).promise(); // 文本类文件转utf-8字符串,二进制文件需自行调整解析逻辑 const content = fileRes.Body.toString('utf-8'); const numbers = content.match(NUMBER_REG) || []; numbers.forEach(num => { totalSum += parseFloat(num); }); } continuationToken = listRes.NextContinuationToken; } while (continuationToken); console.log('所有文件数字总和:', totalSum); return { statusCode: 200, body: JSON.stringify({ totalSum }) }; };
注意事项
- 确认Lambda执行角色的IAM权限包含对应存储桶的
s3:ListBucket和s3:GetObject权限 - 如果你的S3触发规则是仅新增文件时触发扫描,可直接从event参数中提取新增文件的Key,不需要全量拉取桶内文件列表,性能会高很多
内容的提问来源于stack exchange,提问作者Oren Sayag
相关产品推荐
相关产品推荐

