CosyVoice3 отличная TTS для озвучки текста
Описание
Cosy Voice 3 - это TTS модель (text to speech):
✔️ Хорошо работает с русским текстом, ошибок очень мало.
✔️ Хорошо клонирует голоса по 5-10 секундному голосовому отрывку.
✔️ Мало потребляет видео памяти от 6-8Гб VRAM.
✔️ Может работать в режиме диалогов, поддерживает до 4 спикеров и может сохранять, каждого спикера на отдельную дорожку.
✔️ Можно сохранять голоса в модели, чтобы потом не искать аудиофайл и не подбирать подрезку отрывка.
✔️ Есть поддержка некоторых тегов: вздох, грусть, радость, громче, тише, но в наборе узлов не реализовано.
МЕНЮ
00:41 - Установка Cosy Voice
01:18 - Разбор узлов и основных моментов работы с CosyVoice3
06:13 - Узел Cross Lingual
08:48 - Узел Voice Conversion
12:35 - Узел для работы с диалогами
17:05 - Как сохранить голоса в модель
https://github.com/filliptm/ComfyUI_FL-CosyVoice3.git
https://github.com/DarioFT/ComfyUI-Qwen3-ASR.git
🔥 Мой структурированный курс по "ComfyUI" с моей поддержкой на сайте https://stabledif.ru/comfyui
🔥 Мой структурированный курс по "AUTOMATIC 1111" с моей поддержкой на сайте https://stabledif.ru
🔑 Все ссылки и файлы доступны на Boosty:
https://boosty.to/stabledif/posts/17c1d1c6-1ba0-4026-baa9-2ec8f6a1385b
✔️Телеграм-канал: https://t.me/stabledif_lesson
✔️ Telegram ЧАТ: https://t.me/stable_dif
✔️VK Prompts: https://vk.com/stabledif
Рекомендуемые видео




















