Chenyme AAVT：一个功能强大、使用简单的全自动视频/音频开源翻译工具

2024-5-20

开源项目资源

项目简介

Chenyme AAVT是一个功能强大、使用简单的全自动视频 / 音频翻译工具。它可以快速识别声音并翻译生成字幕文件, 然后将翻译后的字幕与原视频合并, 生成翻译后的视频。

该项目主要基于 OpenAI 的 Whisper 进行声音识别, 支持多种语言, 并利用 LLMs 如 ChatGPT、KIMI、DeepSeek 等进行字幕翻译, 或使用本地大语言模型进行翻译。它还支持 GPU 加速和 VAD 辅助, 提高了识别和翻译的效率。此外, 该工具支持输出多种字幕格式, 并提供字幕修改和预览功能, 同时还支持对音频直接进行 AI 总结和问答。项目使用 Streamlit 搭建了一个快速使用的 WebUI 界面, 并利用 FFmpeg 实现了字幕与视频的合并。总的来说, 这是一个功能强大、使用简单的全自动视频 / 音频翻译工具, 值得广大用户尝试使用。

项目截图

项目特点

支持 openai调用和 faster-whisper 本地运行。
支持 GPU 加速、VAD辅助。
支持 ChatGPT、KIMI、DeepSeek翻译。
支持本地大语言模型翻译。
支持识别、翻译多种语言。
支持输出多种字幕格式。
支持对字幕修改、微调、预览。
支持对音频直接进行AI总结、问答。
支持视频生成博客。

项目地址

https://github.com/Chenyme/Chenyme-AAVT

版权声明

免责声明：本站提供用户下载的所有资源均来自网络，版权归作者本人所有，仅限学习和研究目的，请支持正版！

我们非常重视版权问题，如有侵权请邮件与我们联系处理。敬请谅解！邮件：goodlle@126.com

THE END

0

打赏

分享

二维码

海报

Streamer Sales：一个开源功能强大的人工智能卖货助手

fabritor：开源创意图片编辑器海报封面设计神器

发表评论

评论列表

赶快来坐沙发