Google Conversational Actions停服后,纯语音交互自定义助手方案求推荐
替代Google Conversational Actions的纯语音交互方案推荐
针对你需要通过Google Assistant(Home/Android设备)纯语音调用自定义API并朗读结果的需求,以下是符合要求的替代方案:
1. Actions Builder(Google官方推荐的标准方案)
这是Google当前主推的Assistant集成框架,完全替代了已废弃的Conversational Actions和旧版Dialogflow集成,支持纯语音交互:
- 核心配置:在Actions Builder中创建无屏幕依赖的Action,定义语音触发词(如"调用我的自定义服务"),设置意图捕获用户的提问文本。
- 流程实现:
- 配置Webhook(可使用Cloud Functions、Firebase Functions或自建服务器)接收Assistant传递的用户问题参数。
- 在Webhook中发起HTTP请求到你的指定API,处理并获取返回结果。
- 将结果以纯文本格式返回给Assistant,配置语音响应模板,让助手直接朗读内容,全程无需屏幕操作。
- 关键注意点:在Action的交互设置中,禁用所有需要屏幕展示的组件(如卡片、表单),确保全程语音流转。
2. Google Assistant Routines + Webhook(轻量快速方案)
如果你的需求场景简单(无需复杂意图识别,仅需固定触发词+传递问题),可以用自定义Routines结合Webhook实现:
- 核心配置:在Google Home应用中创建自定义Routine,设置语音触发短语(如"查询我的API"),利用Routine的
$text变量捕获用户后续的语音提问内容。 - 流程实现:
- 给Routine添加"调用Webhook"操作,配置你的API地址并传入捕获到的问题参数。
- 你的API处理请求后返回纯文本结果,通过Routine的"朗读文本"操作,让Assistant直接读出结果。
- 优势:无需复杂的Action开发,快速上手,完全满足纯语音交互需求。
3. Google Assistant SDK(自定义设备/进阶场景)
如果需要深度定制交互逻辑或适配自定义硬件设备,可选择Assistant SDK:
- 核心配置:在目标设备(如自定义硬件、Android设备)上集成Assistant SDK,实现语音捕获与识别。
- 流程实现:
- 将识别后的文本发送HTTP请求到你的API。
- 调用Google Text-to-Speech API将API返回结果转换为语音,通过设备播放。
- 适用场景:更适合自定义硬件开发,普通Home/Android设备用户优先考虑前两个方案。
内容的提问来源于stack exchange,提问作者user3517818
相关产品推荐
相关产品推荐

