$ loading_
使用本地语音识别与说话人分离,快速生成多角色音频转写文本。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"vibevoice-asr" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请使用 vibevoice-asr 转写这段会议音频,并开启说话人分离。按时间顺序输出,每段标注说话人、时间戳和对应内容,最后总结 5 条关键结论。
一份带说话人标注和时间戳的会议逐字稿,并附关键结论摘要。
用 vibevoice-asr 识别这段采访录音,区分采访者和受访者,整理成可阅读稿,保留原意并去除明显口头语。
一份区分角色、表达清晰的采访文字稿,适合后续编辑或发布。
请通过 vibevoice-asr 转写这段课程音频,按主题分段,并提取每一段的重点内容和术语清单。
一份按主题整理的课程笔记,包含转写内容、重点摘要和术语列表。
将音频或视频中的语音转成文字,并可区分说话人与整理访谈记录。
将音频转写为文本并区分说话人,便于整理会议与访谈内容。
将音频自动转写为含说话人、时间戳、摘要和行动项的结构化文档
通过 OpenAI 音频转写接口,将语音录音快速转成文本或说话人分段结果。
将音视频与播客批量转写为带说话人和时间轴的字幕文本。
使用本地 Whisper CLI 将音频语音快速转成文本,无需 API 密钥。