You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用Google Speech-to-Text API时RecognitionAudio构造器参数报错求助

解决Google Speech-to-Text API的RecognitionAudio构造错误

问题出在RecognitionAudio的参数传递方式上:你直接把字节内容作为位置参数传入,但这个类的构造函数需要通过关键字参数指定content字段,就像你之前用uri=gcs_uri的形式一样。

修正代码

把原来的构造代码改成:

with io.open(stream_file, "rb") as audio_file:
    content = audio_file.read()

# 必须用关键字参数指定content
audio = speech.RecognitionAudio(content=content)

额外注意事项

如果你的音频文件是base64编码的字符串文件(不是原始二进制音频),需要先解码成原始字节再传入:

import base64

with io.open(stream_file, "r") as audio_file:
    base64_str = audio_file.read()
    content = base64.b64decode(base64_str)

audio = speech.RecognitionAudio(content=content)

官方文档里的RecognitionAudio确实支持content字段,但要求以关键字参数的形式传递,直接传位置参数会被识别为无效输入,这就是你报错的原因。

内容的提问来源于stack exchange,提问作者Rahul Negi

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.17 12:01:20