VibeVoice-ASR

VibeVoice-ASR是一个统一的语音到文本模型,旨在通过一次传递处理60分钟的长格式音频,生成包含Who(发言人),When(时间戳)和What(内容)的结构化transmittance,支持自定义热词和50多种语言。
语音转文本
立即创建
支持自启动
0GB
2
推荐显存: 24G
上传时间:2026/01/28
模型创建
使用说明
本地部署
讨论

暂无文档

新人好礼
客服中心