Grok-tts
Характеристики модели
Разработчик: xAi
Языковая модель: Grok
Название от разработчика: grok-tts
Дата выхода: март, 2026
Тип модели: для генерации аудио
Контекст: 15К
Статус: активная
Доступно в API: Да
Модальности и цены
На ввод (в запросе пользователя) модель может принимать:
На выводе модель выдает:
Поддержка файлов
Отправка файлов не поддерживается
Поддержка функций
Размышление: нет
Веб-поиск: нет
Описание модели
Grok TTS — технология преобразования текста в речь от xAI, предназначенная для создания естественного и выразительного голосового аудио. Она доступна через API и позволяет интегрировать синтез речи в приложения, сервисы и голосовые решения.
Grok TTS поддерживает многоязычную генерацию речи и позволяет управлять подачей голоса с помощью специальных инструкций, включая паузы, акценты, изменение темпа и эмоциональные особенности произношения. Доступны потоковая и пакетная генерация, а также несколько форматов аудиовывода.
Для персонализированной озвучки можно использовать пользовательские голоса, созданные на основе записи речи. Такие голоса доступны для использования в TTS и других голосовых сценариях xAI и сохраняют возможности многоязычной и выразительной генерации.
Grok TTS подходит для голосовых ассистентов, интерактивных приложений, подкастов, видео, аудиокниг, автоматической озвучки и других проектов, где требуется преобразование текста в естественную речь.
Применение Grok TTS
Для голосовых ассистентов: Преобразует ответы AI-систем в естественную речь и может использоваться в интерактивных голосовых сценариях.
Для контента: Подходит для создания озвучки видео, подкастов, аудиокниг и других цифровых материалов.
Для приложений: Позволяет добавлять голосовое взаимодействие, потоковую генерацию аудио и другие функции синтеза речи.
Для персонализации: Поддерживает пользовательские голоса и настройку подачи речи, включая темп, паузы, акценты и эмоциональные характеристики.