跳到主要内容

voice-pro_abus-aikorea

voice-pro GitHub Repo stars

Voice-Pro是一款基于AI的语音识别、翻译和配音工具,主要功能包括:

  1. YouTube视频处理:下载视频并提取音频
  2. 语音分离:使用Demucs技术分离人声与背景音乐
  3. 语音识别:支持Whisper、Faster-Whisper等高精度识别模型,支持100+语言
  4. 实时翻译:支持100+语言即时互译
  5. 文本转语音:集成Edge-TTS、F5-TTS、E2-TTS、CosyVoice、kokoro等多种TTS引擎
  6. 语音克隆:支持零样本语音克隆,可模拟名人人声
  7. 字幕生成:自动生成并同步字幕文件

核心特点:免费开源、WebUI界面、支持Windows平台、可本地部署、无需管理员权限安装。