如何从多字典结构中合并transcript并提取最后一个resultEndTime
解决方案
需求1:合并所有transcript为完整文本
遍历audio['results']中的每一条结果,提取每个结果下alternatives列表里的transcript内容,再将所有文本拼接成完整内容:
# 合并所有transcript full_transcript = " ".join([result['alternatives'][0]['transcript'] for result in audio['results']]) print(full_transcript) # 输出:His name is Charlie and he lives in xxx street
说明:示例中每个alternatives列表仅包含一条转录结果,若实际场景存在多条,可根据confidence字段筛选最优结果,或按需拼接全部内容。
需求2:提取最后一条结果的resultEndTime
通过列表负索引-1直接获取results的最后一个元素,再提取resultEndTime字段:
# 获取最后一条结果的结束时间 last_end_time = audio['results'][-1]['resultEndTime'] print(last_end_time) # 输出:11.900s
内容的提问来源于stack exchange,提问作者Lara19
相关产品推荐
相关产品推荐

