Eleven Multilingual V2
нейросеть
Eleven Multilingual V2 — модель синтеза речи от ElevenLabs для живой эмоциональной озвучки на 29 языках.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Как работает Eleven Multilingual V2?
Eleven Multilingual V2 — модель синтеза речи от ElevenLabs, рассчитанная на живое звучание и передачу эмоций. Поддерживает 29 языков, поэтому одну роль можно озвучить для разных рынков, сохраняя характер голоса. Вендор позиционирует её для закадровой озвучки, аудиокниг, постпродакшена и любого контента, где важна человеческая интонация. В BotHub модель работает без VPN и зарубежной карты: оплата российскими картами в рублях и по факту за использованные капсы, без подписки, а неизрасходованный баланс не сгорает. Рядом в одном окне больше 250 моделей — текст для озвучки можно написать в языковой модели и сразу отправить на синтез. Запросы шифруются по AES-GCM, а для команд есть единый API, договор, счёт и админ-панель с лимитами. Берите для озвучки роликов и рекламы, аудиокниг и подкастов, голоса обучающих курсов, дубляжа и локализации видео, а также чтобы заменить дикторскую запись на этапе монтажа.Частые вопросы о Eleven Multilingual V2
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это модель синтеза речи от ElevenLabs: вы передаёте текст, а на выходе получаете озвученную дорожку. Подходит для озвучки роликов и рилсов, подкастов, аудиоверсий статей и книг, обучающих курсов, голосовых ответов в сервисах и прототипов голосовых интерфейсов.
На выходе вы получаете аудио — синтезированную речь по присланному тексту. За один запрос модель работает с объёмом до 10000 токенов, так что длинные материалы удобнее резать на части. Точные параметры файла зависят от способа обращения: через интерфейс BotHub или API.
Режим пошаговых рассуждений в наших данных не отмечен — это и не её задача. Модель специализируется на озвучке текста, а не на логике и анализе. Если нужны рассуждения, подготовьте сценарий текстовой моделью в том же окне BotHub и отдайте готовый текст на синтез.
В наших данных function calling и структурированный вывод у этой модели не отмечены. При этом она доступна через единый OpenAI-совместимый API BotHub, поэтому вы встраиваете синтез речи в свой пайплайн как отдельный шаг — рядом с текстовыми моделями, которые такие функции поддерживают.
Приём файлов помимо текста в наших данных не отмечен: основной сценарий — отправить текст и получить аудиодорожку. Если нужно озвучить документ, сначала извлеките из него текст, а для разбора картинок или видео используйте мультимодальные модели в том же интерфейсе.
Модель относится к мультиязычной линейке ElevenLabs, однако точный перечень поддерживаемых языков в наших данных не указан. Поэтому надёжнее всего проверить звучание на коротком фрагменте вашего текста: в BotHub вы платите только за фактическое использование, без подписки.