Cloud Speech to Text元数据收集及日志相关技术咨询
Cloud Speech to Text 日志与元数据相关问题解答
默认禁用日志后的调用记录情况
即使默认数据日志记录处于禁用状态,Google Cloud仍会记录必要的服务运维类信息,并非完全不记录任何调用相关内容。
具体记录的内容
- 基础调用元数据:调用时间、请求ID、API版本、调用所用的认证信息标识(如服务账号ID,而非完整密钥)、请求的地域节点、返回的HTTP状态码
- 资源使用数据:处理请求消耗的计算资源量、音频文件时长(仅统计数值,不存储音频内容)、请求处理耗时
- 错误信息:若调用过程中出现错误,会记录错误类型、错误代码及简短错误描述(不含敏感业务数据)
调用完成后的日志处理
- 运维类日志会按照Google Cloud通用数据保留政策存储,默认保留30天,你也可通过Cloud Logging配置自定义保留时长
- 这些日志仅用于服务监控、故障排查、性能优化,不会被用于训练Google的模型(除非你主动开启数据日志用于模型改进的选项)
- 日志保留期结束后会被永久删除,不会再留存
收集的元数据类型
- 请求层面:请求唯一标识符、发起请求的客户端IP地址、请求时间戳、使用的API方法(如
speech:recognize或speech:longrunningrecognize) - 资源层面:音频文件格式(如WAV、MP3)、音频采样率、声道数、提交的音频文件大小
- 认证与权限层面:发起请求的身份信息(如用户邮箱、服务账号ID)、调用时使用的IAM权限范围
内容的提问来源于stack exchange,提问作者Richard
相关产品推荐
相关产品推荐

