应用详情
Easy Voice Toolkit 是一个可本地部署的多功能 AI 语音工具箱,它涵盖了从音频处理、语音转录到语音合成的全方位服务。这款工具箱支持中文、英文和日文三种语言,是处理大量音频文件的得力助手。
功能特点
1. 音频处理 :提供音频剪辑和处理功能。
2. 语音识别 :将语音转换为文本。
3. 语音转录 :将语音内容转录为书面形式。
4. 数据集制作 :轻松生成定制的数据集。
5. 模型训练 :支持语音模型的训练。
6. 语音合成 :将文本转换为语音输出。
部署指南
– 本地部署:
– 环境要求 Python >= 3.8。
– 克隆项目并安装依赖。
– 运行程序。
– 云端部署 ☁️:支持在 Google Colab 上云端运行使用。
– 客户端 💼:提供 Windows 系统客户端,可在项目的 Releases 页面下载。
开发者指南
1. Setup Environment
请确保您已安装Python version 3.8 or higher
2. Obtain Project
克隆仓库
git clone –recurse-submodules https://github.com/Spr-Aachen/Easy-Voice-Toolkit.git
切换目录
%cd Easy-Voice-Toolkit
3. Install Dependencies
安装 PyTorch(命令可从官方网站)
# e.g. (Mind your cuda version,here we take 11.8 as an example)
pip3 install torch torchvision torchaudio –extra-index-url https://download.pytorch.org/whl/cu118
安装项目依赖
pip install -r requirements.txt
安装GUI依赖项
pip install QEasyWidgets
4. Run Programm
启动客户端和服务器
run.py
官方使用条款
本项目仅用于学术交流,旨在促进沟通与学习,不适用于生产环境。
凡基于 Easy Voice Toolkit 制作并在视频平台发布的相关视频,均须在描述中明确标注其用于变声,并注明语音或音频的输入来源,例如使用他人发布的视频或音频,并将人声单独作为转换的输入源,同时需提供清晰的原始视频链接。如果使用您自己的声音或其他商业语音合成软件生成的合成声音作为转换的输入源,您还必须在说明中予以说明。
因输入源引发的任何侵权问题,均由您自行承担全部责任。在使用其他商业语音合成软件作为输入源时,请务必遵守该软件的使用条款。请注意,许多语音合成引擎在其使用条款中明确指出,不得将其用于输入源转换。
继续使用本项目即视为同意本仓库 README 中所载的相关条款。本仓库 README 仅具有说明和提示作用,不对由此可能引发的任何后续问题承担任何责任。
如果您分发本仓库的代码,或公开发布由本项目生成的任何成果(包括但不限于视频分享平台),请注明原作者及代码来源(即本仓库)。
如果您将本项目用于任何其他用途,请提前与本仓库的作者联系并告知。非常感谢。
作者
Spr-AachenSpr_Aachen

项目地址:https://github.com/Spr-Aachen/Easy-Voice-Toolkit
下载地址:https://github.com/Spr-Aachen/Easy-Voice-Toolkit/releases/tag/v1.3.5
文中介绍的软件版权归原作者所有,资源来源于互联网公开渠道,不对软件做任何修改或破解。
因使用本站介绍的软件产生的任何问题,请自行联系软件官方客服处理。


















暂无评论内容