跳到正文
ElevenLabs· Jack Limebear·· 3 天前

ElevenLabs 详解带时间戳与事件标记的音频转写如何工作

How does audio transcription with timestamps and event tagging work?

AI 导读

ElevenLabs 的 Scribe 采用原生词级转写模型,单次 API 调用即可输出带时间戳的结构化 token 数组,每个 token 标记为 word、spacing 或 audio_event 三类,可识别笑声、掌声等非语音事件。

来源:ElevenLabs · elevenlabs.io