Kitta Audio
Продукты
Продукты
Обзор продукта
Единый набор инструментов для создания аудио
Библиотека голосов
Голоса для любых ролей и персонажей
Создание
Текст в речь
Генерация естественной AI-речи
Диалог с несколькими голосами
Создавайте озвученные диалоги по сценариям с несколькими персонажами
Речь в текст
Расшифровка аудио и видео
Дизайн голоса
Создание собственного тембра
Изменение голоса
Скоро
Вывод аудио любым голосом
Изоляция голоса
Извлечение чистой речи
Клонирование голоса
Клонируйте свой голос
Звуковые эффекты
Скоро
Генерация любых звуков
Дубляж
Скоро
Локализация аудиоконтента
Музыка
Скоро
Превращайте идеи в песни
Изображения
Генерация изображений из текста
Видео
Генерация видео из текста или изображений
S2
Fish Audio S2.1 Pro
Много спикеров, многораундовая генерация и управление голосом через естественный язык.
API
Платформа
ОбзорДокументацияСправочник APIAPI-ключиЦены APIAPI Playground
API
Текст в речь
Генерируйте речь через API
Музыка
Скоро
Создавайте песни через API
Речь в текст
Пакетная расшифровка речи
Звуковые эффекты
Скоро
Генерируйте эффекты через API
Речь в текст в реальном времени
Расшифровка речи в реальном времени
Клонирование голоса
Клонируйте голоса для TTS
Речевой движок
Скоро
Добавьте голосовые возможности агентам
Агенты
Скоро
Запускайте голосовых агентов за минуты
Дубляж
Скоро
Переводите видео и аудио через API
API
Быстрый старт Fish Audio API
Онлайн-отладка генерации речи, транскрибации и ключей аккаунта
Синтез речи
Превращайте текст в речь с Fish Audio, MiniMax, Qwen и др.
Речь в текст
Точная расшифровка загруженного аудио
Клонирование голоса
Воспроизведите свой голос за ~1 минуту по коротким образцам
Галерея голосов
Просматривайте публичные модели и выбирайте пример
AI-изображения
Генерация изображений ведущими моделями по промпту
AI-видео
Создание видео по тексту и стилю
Синхронизация губ и цифровой человек
Совмещайте речь с видео для аватаров и презентаций
Рабочее пространство
Рабочее пространство для синтеза и проектов
Короткие видео и дубляж
Быстрый закадровый голос для соцсетей, рекламы и UGC
Аудиокниги и подкасты
Длинные озвучки с естественным темпом
Обучение и корпоративы
Чёткая озвучка курсов и внутренних коммуникаций
Компания
О насБлог
Материалы
Coze
Tavo
SillyTavern
Dify
Open WebUI
AnythingLLM
Home Assistant
n8n
Партнёрская программа
Скоро
API-песочница
Пробуйте REST онлайн с вашим API-ключом
API-ключи
Создание и управление токенами
Цены
Главная/AI-модели голоса/CosyVoice
Alibaba DAMO Academy

CosyVoice — Try Alibaba's Open-Source Voice Cloning TTS Online

CosyVoice is an open-source multilingual TTS model from Alibaba DAMO Academy. It supports zero-shot voice cloning, cross-lingual synthesis, and fine-grained emotion control — making it one of the most versatile open-source TTS models available.

Попробуйте CosyVoice бесплатно на Kitta Audio

Банковская карта не нужна. Каждый месяц доступно 2000 бесплатных кредитов.

Открыть студию ->Документация API

Ключевые возможности

  • ✓Zero-shot voice cloning
  • ✓Cross-lingual voice transfer
  • ✓Fine-grained emotion and style control
  • ✓Open-source (Apache 2.0)
  • ✓Instruction-based speech generation
  • ✓Natural prosody in Chinese and English

Лучше всего подходит для

  • →Zero-shot cloning experiments
  • →Cross-lingual dubbing
  • →Research and development
  • →Expressive storytelling

Поддерживаемые языки

10+

Chinese, English, Japanese, Cantonese, Korean & ещё

CosyVoice и альтернативы

ПлатформаКачествоСкоростьЯзыкиКлонирование голосаЦена
Fish Speech (CosyVoice)★★★★Fast10+✓ Zero-shotFree tier + from $9/mo
Fish Audio★★★★★Ultra-fast40+✓Free tier + from $9/mo
IndexTTS★★★★★Medium10+✓Free tier + from $9/mo
ElevenLabs★★★★★Fast32✓ Paid onlyFrom $5/mo (limited)

Частые вопросы

What is CosyVoice?

CosyVoice is an open-source multilingual TTS model from Alibaba DAMO Academy. It supports zero-shot voice cloning, cross-lingual synthesis, and instruction-based speech generation.

What makes CosyVoice different from other TTS models?

CosyVoice supports zero-shot voice cloning (clone a voice without fine-tuning) and cross-lingual transfer (speak in a different language while preserving the original voice characteristics).

Is CosyVoice free to use?

Yes. CosyVoice is open-source under Apache 2.0. You can try it for free on Fish Speech without any setup.

How do I try CosyVoice online?

Go to Fish Speech, create a free account, open the workspace, and select CosyVoice as your model. No GPU or API key required.

Больше на Kitta Audio

Все AI-модели голосаКак клонировать голосAPI синтеза речиПопробовать бесплатно
Продукт
  • Текст в речь
  • Диалог с несколькими голосами
  • Речь в текст
  • Дизайн голоса
  • Изменение голосаСкоро
  • Изоляция голоса
  • Клонирование голоса
  • Звуковые эффектыСкоро
  • ДубляжСкоро
  • МузыкаСкоро
  • Изображения
  • Видео
Решения
  • Короткие видео и дубляж
  • Аудиокниги и подкасты
  • Обучение и корпоративы
Исследования
  • Fish Audio S2.1 Pro
  • Обзор Fish Audio S2
  • Fish Audio S1
Ресурсы
  • Документация
  • Справочник API
  • Библиотека моделей
  • Как клонировать голос
  • Сравнение продуктов
Компания
  • О нас
  • Блог

Продукт

  • Текст в речь
  • Диалог с несколькими голосами
  • Речь в текст
  • Дизайн голоса
  • Изменение голосаСкоро
  • Изоляция голоса
  • Клонирование голоса
  • Звуковые эффектыСкоро
  • ДубляжСкоро
  • МузыкаСкоро
  • Изображения
  • Видео

Решения

  • Короткие видео и дубляж
  • Аудиокниги и подкасты
  • Обучение и корпоративы

Исследования

  • Fish Audio S2.1 Pro
  • Обзор Fish Audio S2
  • Fish Audio S1

Ресурсы

  • Документация
  • Справочник API
  • Библиотека моделей
  • Как клонировать голос
  • Сравнение продуктов

Компания

  • О нас
  • Блог
Kitta Audio
© 2026 Kitta Audio. Все права защищены.Kitta AI|Политика конфиденциальности|Условия использования|Сообщить о нарушении|support@kittaai.com
support@kittaai.com

Kitta Audio независимо управляется Kitta AI и не является официальным сервисом Fish Audio.