本部分演示了如何将流式音频(如麦克风输入)转录为文字。
流式语音识别允许您将音频流式传输到 Cloud Speech-to-Text,并在音频处理过程中实时接收语音识别结果流。另请参阅流式语音识别请求的音频限制。流式语音识别只能通过 gRPC 实现。
对本地文件执行流式语音识别
以下是对本地音频文件执行流式语音识别的示例。发送至 API 的所有流式传输请求不能超过 10 MB。此限制适用于初始 StreamingRecognize 请求和数据流中每一条消息的大小。超出此限制时,系统会抛出错误。
Go
如需了解如何安装和使用 Cloud STT 客户端库,请参阅 Cloud STT 客户端库。如需了解详情,请参阅 Cloud STT Go API 参考文档。
如需向 Cloud STT 进行身份验证,请设置应用默认凭证。如需了解详情,请参阅为本地开发环境设置身份验证。
Java
如需了解如何安装和使用 Cloud STT 客户端库,请参阅 Cloud STT 客户端库。如需了解详情,请参阅 Cloud STT Java API 参考文档。
如需向 Cloud STT 进行身份验证,请设置应用默认凭证。如需了解详情,请参阅为本地开发环境设置身份验证。