Chenyme AAVT: 一个功能强大、使用简单的全自动视频/音频开源翻译工具

13次阅读
没有评论

项目简介

Chenyme AAVT 是一个功能强大、使用简单的全自动视频 / 音频翻译工具。它可以快速识别声音并翻译生成字幕文件, 然后将翻译后的字幕与原视频合并, 生成翻译后的视频。

该项目主要基于 OpenAI 的 Whisper 进行声音识别, 支持多种语言, 并利用 LLMs 如 ChatGPT、KIMI、DeepSeek 等进行字幕翻译, 或使用本地大语言模型进行翻译。它还支持 GPU 加速和 VAD 辅助, 提高了识别和翻译的效率。此外, 该工具支持输出多种字幕格式, 并提供字幕修改和预览功能, 同时还支持对音频直接进行 AI 总结和问答。项目使用 Streamlit 搭建了一个快速使用的 WebUI 界面, 并利用 FFmpeg 实现了字幕与视频的合并。总的来说, 这是一个功能强大、使用简单的全自动视频 / 音频翻译工具, 值得广大用户尝试使用。

项目截图

Chenyme AAVT:一个功能强大、使用简单的全自动视频 / 音频开源翻译工具项目特点

  • 支持 openai调用和 faster-whisper 本地运行。
  • 支持 GPU 加速、VAD辅助。
  • 支持 ChatGPTKIMIDeepSeek翻译。
  • 支持本地大语言模型翻译。
  • 支持识别、翻译多种语言。
  • 支持输出多种字幕格式。
  • 支持对字幕修改、微调、预览。
  • 支持对音频直接进行 AI 总结、问答。
  • 支持视频生成博客。

项目地址

https://github.com/Chenyme/Chenyme-AAVT

资源下载

此资源仅限注册用户下载,请先

下载前请仔细阅读以下说明,如下载代表您了解并同意了以下说明:
(1)资源收集自互联网,仅供自我学习,请在下载后 24 小时内删除该资源;
(2)如下载者将此资源用于其他非法用途,本站不承担任何法律责任;
(3)如有侵权,请立即联系我,马上删除!
(4)下载单个资源则点击立即下载按钮;本站 VIP 可免费无延迟下载本站所有资源。
(5)请不要使用手机以及电脑浏览器的无痕模式进行支付操作,以免造成支付成功但未显示下载链接。
正文完
 0
资源蛙
版权声明:本站原创文章,由 资源蛙 于2024-05-20发表,共计547字。
转载说明:除特殊说明外本站文章皆由CC-4.0协议发布,转载请注明出处。
评论(没有评论)
验证码