Minimax Speech 2.8 Turbo
нейросеть
Minimax Speech 2.8 Turbo — модель синтеза речи от MiniMax с клонированием голоса и контролем эмоций для озвучки текста.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Как работает Minimax Speech 2.8 Turbo?
Minimax Speech 2.8 Turbo — решение MiniMax для озвучки текста: модель читает написанное живым голосом, передаёт интонации и эмоции, а клонирование голоса позволяет закрепить за проектом узнаваемое звучание. Заявлена поддержка более 40 языков, так что одна модель закрывает озвучку разноязычных материалов. В BotHub она открывается без VPN и зарубежной карты: платите российской картой в рублях и только за фактически использованные капсы, а неизрасходованный баланс не сгорает. Рядом в том же окне — более 250 моделей, поэтому цепочку легко собрать целиком: текст подготовили в одной, озвучили здесь. Для продуктовых задач есть единый OpenAI-совместимый API, компаниям доступны договор, счёт, ЭДО и админ-панель с лимитами, а трафик шифруется по AES-GCM. Пригодится, если вы озвучиваете обучающие курсы и подкасты, делаете голоса для игр и ассистентов, готовите аудиоверсии статей и рассылок, собираете локализацию роликов под разные рынки или тестируете голосовой интерфейс до студийной записи.Частые вопросы о Minimax Speech 2.8 Turbo
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
speech-2.8-turbo — модель синтеза речи от minimax: вы передаёте текст, а на выходе получаете озвучку. Подходит для видео и роликов, подкастов, аудиоверсий статей, голосовых ответов в IVR и обучающих материалов. Текст подаётся в пределах контекста 4095 токенов.
На выходе вы получаете готовую звуковую дорожку, а не текст. Конкретный формат файла и параметры задаются в запросе к API, в наших данных они не зафиксированы. Ограничение вывода — 4096 токенов за запрос, поэтому длинные сценарии удобнее озвучивать частями.
Пометки о рассуждениях перед ответом в наших данных нет, да и для озвучки они не требуются: модель работает с готовым текстом. Если нужно сначала продумать сценарий или реплики, подготовьте их текстовой моделью в том же окне BotHub, а затем отправьте в speech-2.8-turbo.
В наших данных вызов функций и структурированный вывод JSON у speech-2.8-turbo не отмечены — это модель озвучки, а не инструмент для агентов. Обращаться к ней можно через единый OpenAI-совместимый API BotHub, а логику вызовов держите на стороне вашего приложения.
Приём файлов помимо текста в наших данных не отмечен: speech-2.8-turbo работает по текстовому описанию и отдаёт аудио. Если нужно распознать запись, разобрать изображение или видео, выберите подходящую модель в том же окне — интеграция через общий API не меняется.
В наших данных список поддерживаемых языков не указан, поэтому обещать точность на русском не будем — проверьте на своём тексте, это быстро. Сам BotHub полностью на русском: интерфейс, поддержка, оплата картами РФ без VPN и зарубежной карты.