You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何从多字典结构中合并transcript并提取最后一个resultEndTime

解决方案

需求1:合并所有transcript为完整文本

遍历audio['results']中的每一条结果,提取每个结果下alternatives列表里的transcript内容,再将所有文本拼接成完整内容:

# 合并所有transcript
full_transcript = " ".join([result['alternatives'][0]['transcript'] for result in audio['results']])
print(full_transcript)
# 输出:His name is Charlie and he lives in xxx street

说明:示例中每个alternatives列表仅包含一条转录结果,若实际场景存在多条,可根据confidence字段筛选最优结果,或按需拼接全部内容。

需求2:提取最后一条结果的resultEndTime

通过列表负索引-1直接获取results的最后一个元素,再提取resultEndTime字段:

# 获取最后一条结果的结束时间
last_end_time = audio['results'][-1]['resultEndTime']
print(last_end_time)
# 输出:11.900s

内容的提问来源于stack exchange,提问作者Lara19

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.25 01:37:06