ElevenLabs· Jack Limebear·· 3 天前
ElevenLabs 详解带时间戳与事件标记的音频转写如何工作
How does audio transcription with timestamps and event tagging work?
AI 导读
ElevenLabs 的 Scribe 采用原生词级转写模型,单次 API 调用即可输出带时间戳的结构化 token 数组,每个 token 标记为 word、spacing 或 audio_event 三类,可识别笑声、掌声等非语音事件。
来源:ElevenLabs · elevenlabs.io