能否从Amazon Alexa、Google Assistant等语音识别平台获取原始录音?
语音助理平台及Android语音识别API音频获取方案
Amazon Alexa、Google Assistant平台录音调取
- 普通开发者无法通过公开API获取两类平台的原始录音:平台的ASR服务仅对外返回识别后的文本结果,原始音频属于用户隐私数据,不会开放给第三方自有后端使用。
- 若有自定义音频处理需求,不要依赖官方语音助理的链路,直接在设备端自行集成麦克风采集逻辑,拿到原始音频后再调用自有API即可。
- 企业级定制场景可向平台方申请特殊白名单权限,需满足隐私合规要求、获得用户单独授权,流程极严格。
Android原生Speech Recognition API音频获取方案
原生SpeechRecognizerAPI确实仅提供识别文本结果,不暴露原始音频,可行替代方案:
- 使用系统
AudioRecord类自行实现麦克风音频采集,你可以完全控制音频的采样率、编码格式,采集到的音频直接传给自有后端即可,同时可以同步调用你需要的ASR能力。 - 接入第三方ASR SDK,绝大多数商用、开源的语音识别SDK都支持同时返回识别文本和原始音频流,无需适配原生API的限制。
- 注意Android 6.0及以上需要动态申请
RECORD_AUDIO权限,Android 12+如果需要后台采集还要额外申请相应权限,需符合应用商店的隐私合规要求。
内容的提问来源于stack exchange,提问作者Der_Reparator
相关产品推荐
相关产品推荐

