Chat with Wiki - 如何复刻我的声音

Answer

以下是复刻声音的相关步骤和信息：

前置数据获取处理
- 选择音频，开启切割。
- 有噪音时，进行降噪处理。
- 降噪处理完成，开启离线 ASR。
GPT-Sowits-TTS
- 训练集格式化：开启一键三连，耐心等待即可。
- 微调训练：开启 SoVITS 训练和 GPT 训练。
- 推理：开始推理 - 刷新模型 - 选择微调后的模型 - yoyo。
声音复刻
- 开启声音复刻之旅。
- 实现跨多语种语言的声音。
- 实践的样本：AIyoyo 普通话 - 满江红满江红普通话.wav ；AIyoyo 粤语版 - 满江红满江红粤语.wav

GPT-SoVITS 的特点：

零样本 TTS：输入 5 秒的声音样本即可体验即时的文本到语音转换。
少量样本训练：只需 1 分钟的训练数据即可微调模型，提高声音相似度和真实感。模仿出来的声音会更加接近原声，听起来更自然。
跨语言支持：支持与训练数据集不同语言的推理，目前支持英语、日语和中文。
易于使用的界面：集成了声音伴奏分离、自动训练集分割、中文语音识别和文本标签等工具，帮助初学者更容易地创建训练数据集和 GPT/SoVITS 模型。
适用于不同操作系统：项目可以在不同的操作系统上安装和运行，包括 Windows。
预训练模型：项目提供了一些已经训练好的模型，你可以直接下载使用。

GitHub：https://github.com/RVC-Boss/GPT-SoVITS 视频教程：https://bilibili.com/video/BV12g4y1m7Uw/

使用技巧：

更换音色：一开始会感觉很简单，就只是字生成语音，能选的也就是不同的音色。音色因为基于网络红人训练，因此生成的语音音色会和对应的网络红人非常相像。只要选择和自己需要非常接近的音色即可。如果没有接近的音色，也可以自己训练一个，参考 WaytoAGI 的知识库：GPT-SoVITS 实现声音克隆

Content generated by AI large model, please carefully verify (powered by aily)

References

GPT-SoVITS-实现 AIyoyo 声音克隆

1.[heading4]微调训练[content]1.开启SoVITS训练，&开启GPT训练[heading4]推理[content]1.开始推理-刷新模型-选择微调后的模型-yoyo[heading4]成功[content]出现新的URL，说明你自己的声音微调完毕，然后可以进行啦[heading3]四、声音复刻[heading4]开启声音复刻之旅吧[content]1.实现跨多语种语言的声音，不是梦[heading4]实践的样本[content]AIyoyo普通话-满江红[满江红普通话。wav](https://drive.weixin.qq.com/s?k=AJMA1Qc4AAwbkbzYu0AQ8AbQYrAGo)AIyoyo粤语版-满江红[满江红粤语。wav](https://drive.weixin.qq.com/s?k=AJMA1Qc4AAwsRaRfHrAQ8AbQYrAGo)[heading2]五、关于我[content]大家好～我是yoyo🐱🐈坐标北京，铲屎官一枚🫡AIGC的小白，持续进阶成长，致力于打造一个自己的智能体☕️以上期待能够给到各位一点启发感谢家属带我在“[通往AGI之路](https://waytoagi.feishu.cn/wiki/QPe5w5g7UisbEkkow8XcDmOpn8e)”打开新世界，接触有趣的事情，结识有趣的人

GPT-SoVITS实现声音克隆

GPT-SoVITS：只需1分钟语音即可训练一个自己的TTS模型。GPT-SoVITS是一个声音克隆和文本到语音转换的开源Python RAG框架。5秒数据就能模仿你，1分钟的声音数据就能训练出一个高质量的TTS模型，完美克隆你的声音！根据演示来看完美适配中文，应该是目前中文支持比较好的模型。界面也易用。主要特点：1、零样本TTS：输入5秒的声音样本即可体验即时的文本到语音转换。2、少量样本训练：只需1分钟的训练数据即可微调模型，提高声音相似度和真实感。模仿出来的声音会更加接近原声，听起来更自然。跨语言支持：支持与训练数据集不同语言的推理，目前支持英语、日语和中文。3、易于使用的界面：集成了声音伴奏分离、自动训练集分割、中文语音识别和文本标签等工具，帮助初学者更容易地创建训练数据集和GPT/SoVITS模型。4、适用于不同操作系统：项目可以在不同的操作系统上安装和运行，包括Windows。5、预训练模型：项目提供了一些已经训练好的模型，你可以直接下载使用。GitHub：[https://github.com/RVC-Boss/GPT-SoVITS](https://t.co/BpHX4SlsO3)[…](https://t.co/BpHX4SlsO3)视频教程：[https://bilibili.com/video/BV12g4y1m7Uw/](https://t.co/Uo7WtSSUGO)[…](https://t.co/Uo7WtSSUGO)[[twi]@小互(@_twi(1).mp4](https://bytedance.feishu.cn/space/api/box/stream/download/all/RymsbKdweody4Cxwtsqc7Yuenxd?allow_redirect=1)使用：

Stuart：免费 AI 真人语音入门： GPT-SoVITS + Bert-VITS2

可变参数就是AIGC最有趣的地方，语音生成也一样：可变参数就是使用技巧。[heading3]更换音色🎵[content]一开始会感觉很简单，就只是字生成语音，能选的也就是不同的音色。音色因为基于网络红人训练，因此生成的语音音色会和对应的网络红人非常相像。只要选择和自己需要非常接近的音色即可。如果没有接近的音色，也可以自己训练一个，参考WaytoAGI的知识库：[GPT-SoVITS实现声音克隆](https://waytoagi.feishu.cn/wiki/SVyUwotn7itV1wkawZCc7FEEnGg?from=from_copylink)但是真正准备开始用就会发现，只改音色不够用了。😓我们真正说话，或者配音的时候，通常是边思考边说话，因此经常带着一些口头禅，类似“嗯”，“啊”，甚至更离谱的“m3？”😂说话过程中有些重音，停顿和一句手写语句也不全相同。