OrlimeGateway
Все модели

google

Gemini 3.1 Flash TTS Preview

google/gemini-3.1-flash-tts-preview

Gemini 3.1 Flash TTS Preview — предварительная версия модели синтеза речи Google, которая преобразует текст в аудио. Модель поддерживает более 70 языков и может озвучивать диалоги с участием до двух говорящих, для каждого из которых настраиваются голос и стиль подачи. В тексте можно использовать более 200 аудиотегов для управления эмоциями, темпом и манерой речи, в том числе в пределах одной фразы. Для работы со сценами предусмотрены профили аудио для персонажей и контекст сцены в Google AI Studio. Выходное аудио формируется в PCM, моно, с частотой 24 кГц и разрядностью 16 бит; записи автоматически маркируются SynthID.

ВозможностиAUDIO
ЦенаПо использованию
Контекст32,8 тыс.
Дата выхода модели24 апр. 2026 г.

API ENDPOINTS

Поддерживаемые операции

ЦЕНЫ КАТАЛОГА

Тарификация в рублях

В каталоге указаны цены «от». Итоговая стоимость запроса отражается в истории списаний.

Input / 1M токеновот 103,57 ₽
Output / 1M токеновот 2 071,34 ₽