Chenyme AAVT：一个功能强大、使用简单的全自动视频/音频开源翻译工具

78次阅读

Chenyme AAVT 是一个功能强大、使用简单的全自动视频 / 音频翻译工具。它可以快速识别声音并翻译生成字幕文件, 然后将翻译后的字幕与原视频合并, 生成翻译后的视频。该项目主要基于 OpenAI 的 Whisper 进行声音识别, 支持多种语言, 并利用 LLMs 如 ChatGPT、KIMI、DeepSeek 等进行字幕翻译, 或使用本地大语言模型进行翻译。它还支持 GPU 加速和 VAD 辅助, 提高了识别和翻译的效率。此外, 该工具支持输出多种字幕格式, 并提供字幕修改和预览功能, 同时还支持对音频直接进行 AI 总结和问答。项目使用 Streamlit 搭建了一个快速使用的 WebUI 界面, 并利用 FFmpeg 实现了字幕与视频的合并。总的来说, 这是一个功能强大、使用简单的全自动视频 / 音频翻译工具, 值得广大用户尝试使用。

开源地址：https://github.com/Chenyme/Chenyme-AAVT

正文完

Chenyme AAVT

发表至：值得一看开源项目

2024-05-18

转载说明：本站提供的一切软件、教程、电子书、视频、图片、音乐、文字以及所有内容信息仅供个人学习、研究或欣赏；不得将上述内容用于商业或者非法用途，否则，一切后果请用户自负。本站信息来自网友分享及网络收集整理，版权争议与本站无关。您必须在下载后的24个小时之内，从您的电脑或手机中彻底删除上述内容。如果您喜欢相关内容信息，请支持正版，进行购买注册，以得到更好的正版服务。我们非常重视版权问题，如有侵权请邮件与我们联系处理。敬请谅解！侵删请致信E-mail：tntwl@qq.com

小白初学者的机器学习：神经网络入门介绍

waifu2x：免费开源在线图片无损放大工具

1Remote：开源个人远程会话管理员和启动器

PDFMathTranslate：开源PDF文档翻译及双语对照工具

实时直播全球日落：足不出户看遍全球夕阳

txyz.ai：AI帮你快速get研究重点，告别熬夜翻文献

kaboompics：以生活化免费高质量图片素材为主的网站

PC微信防撤回插件适用3.9.12.31

全免小说v1.9.6 去广告更新会员解锁版

Streamer Sales：一个开源功能强大的人工智能卖货助手