本文档介绍在与 Qwen-ASR Realtime API 的 WebSocket 会话中,服务端向客户端发送的事件。
error
当服务端检测到错误(包括客户端错误和服务端错误)时,向客户端发送的事件。
|
session.created
当客户端成功连接到服务端后,服务端响应的第一个事件。该事件包含服务端为此次连接设置的默认配置信息。
|
session.updated
当客户端发送session.update事件并成功被服务端处理后,服务端将发送该事件。如果处理过程中出现错误,则直接发送 error 事件。
|
input_audio_buffer.speech_started
此事件仅在 VAD 模式下发送。当服务端在音频缓冲区中检测到语音开始时发送。
该事件可能在每次音频添加到缓冲区时发生(除非已检测到语音开始)。
|
input_audio_buffer.speech_stopped
此事件仅在 VAD 模式下发送。当服务端在音频缓冲区中检测到语音结束时发送。
该事件触发后,服务端将紧接着发送一个conversation.item.created事件,包含从音频缓冲区创建的用户消息项。
|
input_audio_buffer.committed
- **VAD模式:**当客户端完成音频数据发送(通过input_audio_buffer.append事件)后,服务端发送该事件。
- **非VAD模式:**客户端完成音频数据发送(通过input_audio_buffer.append事件)并发送input_audio_buffer.commit事件后,服务端发送该事件。
|
conversation.item.created
当对话项(item)创建时发送该事件。
|
conversation.item.input_audio_transcription.text
此事件会高频发送,用于展示实时识别结果。
| text + stash。
点击查看示例 假设用户正在说:“今天天气不错,阳光明媚。”以下是您可能会收到的事件流以及如何解读它们:
|
conversation.item.input_audio_transcription.completed
向客户端发送最终识别结果。此事件标志着一个对话项(item)的结束。
|
conversation.item.input_audio_transcription.failed
当输入了音频但是识别失败时,服务端发送该事件。与其他 error 事件分开处理,便于客户端识别相关的具体项目。
|
session.finished
会话结束事件,表示当前会话中,所有音频识别已完成。
该事件只有在客户端发送session.finish后才会发送,客户端接收到该事件后可主动断开连接。
|