tts_transformer-ru-cv7_css10开源文本转语音模型 - 免费实现俄语男声语音合成

首页

Tts Transformer Ru Cv7 Css10

由 facebook 开发

基于fairseq S²的Transformer文本转语音模型，支持俄语单说话人男声，在Common Voice v7上预训练并在CSS10上微调。

语音合成其他#俄语TTS #单说话人男声 #Transformer架构

下载量 96

发布时间 : 3/2/2022

模型简介

这是一个俄语文本转语音(TTS)模型，采用Transformer架构，能够将俄语文本转换为自然语音。

模型特点

俄语单说话人男声

专门针对俄语优化的单说话人男声语音合成

Transformer架构

采用先进的Transformer架构，提供高质量的语音合成

多数据集训练

在Common Voice v7上预训练，在CSS10上微调，提高语音质量

模型能力

俄语文本转语音

高质量语音合成

使用案例

语音应用

语音助手

为俄语语音助手提供自然语音输出

生成自然流畅的俄语语音

有声读物

将俄语文本转换为语音用于有声读物制作

提供清晰自然的朗读效果

🚀 tts_transformer-ru-cv7_css10

这是来自fairseq S²的基于Transformer架构的文本转语音模型，可将文本转换为俄语语音。模型使用单男性语音，在Common Voice v7上预训练，并在CSS10上进行微调。

🚀 快速开始

本模型是基于fairseq S²的Transformer文本转语音模型，具备以下特点：

支持俄语
采用单男性语音
在 Common Voice v7 上预训练，并在 CSS10 上进行微调

✨ 主要特性

语言支持：支持将俄语文本转换为语音。
语音类型：使用单男性语音，发音清晰。
训练数据：结合了Common Voice v7和CSS10数据集，保证了模型的泛化能力。

📦 安装指南

暂未提供具体安装步骤，可参考相关依赖库的安装说明。

💻 使用示例

基础用法

from fairseq.checkpoint_utils import load_model_ensemble_and_task_from_hf_hub
from fairseq.models.text_to_speech.hub_interface import TTSHubInterface
import IPython.display as ipd

models, cfg, task = load_model_ensemble_and_task_from_hf_hub(
    "facebook/tts_transformer-ru-cv7_css10",
    arg_overrides={"vocoder": "hifigan", "fp16": False}
)
model = models[0]
TTSHubInterface.update_cfg_with_data_cfg(cfg, task.data_cfg)
generator = task.build_generator(model, cfg)

text = "Здравствуйте, это пробный запуск."

sample = TTSHubInterface.get_model_input(task, text)
wav, rate = TTSHubInterface.get_prediction(task, model, generator, sample)

ipd.Audio(wav, rate=rate)

更多使用示例可参考 fairseq S²示例。

📚 详细文档

本模型基于 Transformer 架构，来自fairseq S² (论文/代码)。

模型信息

属性	详情
模型类型	Transformer文本转语音模型
训练数据	Common Voice v7、CSS10

📄 许可证

暂未提供相关许可证信息。

📚 引用

如果您在研究中使用了该模型，请引用以下论文：

@inproceedings{wang-etal-2021-fairseq,
    title = "fairseq S{\^{}}2: A Scalable and Integrable Speech Synthesis Toolkit",
    author = "Wang, Changhan  and
      Hsu, Wei-Ning  and
      Adi, Yossi  and
      Polyak, Adam  and
      Lee, Ann  and
      Chen, Peng-Jen  and
      Gu, Jiatao  and
      Pino, Juan",
    booktitle = "Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing: System Demonstrations",
    month = nov,
    year = "2021",
    address = "Online and Punta Cana, Dominican Republic",
    publisher = "Association for Computational Linguistics",
    url = "https://aclanthology.org/2021.emnlp-demo.17",
    doi = "10.18653/v1/2021.emnlp-demo.17",
    pages = "143--152",
}