如何从AWS HealthImaging数据存储中获取患者ID列表?
获取AWS HealthImaging中所有研究的患者ID列表
服务名称与核心API说明
- 正确的服务标识:
- Python boto3客户端需使用
healthimaging - REST API端点前缀为
medical-imaging(例如medical-imaging.us-east-1.amazonaws.com)
- Python boto3客户端需使用
- 不存在直接返回患者ID列表的API,需通过两步遍历实现:
- 调用
ListStudies(boto3对应方法:client.list_studies())分页拉取目标数据存储下的所有研究ID - 对每个研究ID,调用
GetStudyMetadata(boto3对应方法:client.get_study_metadata()),从返回的DICOM元数据中提取PatientID字段(路径为DicomMetadata.Patient.PatientID)
- 调用
可运行的Python示例(解决服务名称报错)
import boto3 # 替换为你的AWS区域和目标数据存储ID REGION = 'us-east-1' DATASTORE_ID = 'your-target-datastore-id' # 初始化正确的HealthImaging客户端 hi_client = boto3.client('healthimaging', region_name=REGION) patient_ids = set() next_token = None # 分页遍历所有研究 while True: list_params = {'datastoreId': DATASTORE_ID} if next_token: list_params['nextToken'] = next_token studies_response = hi_client.list_studies(**list_params) # 逐个获取研究元数据并提取患者ID for study in studies_response['studies']: metadata_response = hi_client.get_study_metadata( datastoreId=DATASTORE_ID, studyId=study['studyId'] ) patient_id = metadata_response['DicomMetadata']['Patient']['PatientID'] patient_ids.add(patient_id) next_token = studies_response.get('nextToken') if not next_token: break # 输出去重后的患者ID列表 print("所有患者ID:", list(patient_ids))
避坑提示
- 不要混淆
healthlake:这是AWS用于临床数据存储的独立服务,和HealthImaging(影像存储)无关联,使用该服务客户端会直接报错 - REST API调用规则:ListStudies的请求格式为
GET /datastore/{datastore-id}/studies,GetStudyMetadata为GET /datastore/{datastore-id}/studies/{study-id}/metadata,需遵循AWS REST API的签名与授权规范
内容的提问来源于stack exchange,提问作者Paul Mullen
相关产品推荐
相关产品推荐

