Все моделиgoogle
Gemini 3.1 Flash TTS Preview
google/gemini-3.1-flash-tts-previewGemini 3.1 Flash TTS Preview — предварительная версия модели синтеза речи Google, которая преобразует текст в аудио. Модель поддерживает более 70 языков и может озвучивать диалоги с участием до двух говорящих, для каждого из которых настраиваются голос и стиль подачи. В тексте можно использовать более 200 аудиотегов для управления эмоциями, темпом и манерой речи, в том числе в пределах одной фразы. Для работы со сценами предусмотрены профили аудио для персонажей и контекст сцены в Google AI Studio. Выходное аудио формируется в PCM, моно, с частотой 24 кГц и разрядностью 16 бит; записи автоматически маркируются SynthID.
ВозможностиAUDIO
ЦенаПо использованию
Контекст32,8 тыс.
Дата выхода модели24 апр. 2026 г.
API ENDPOINTS
Поддерживаемые операции
ЦЕНЫ КАТАЛОГА
Тарификация в рублях
В каталоге указаны цены «от». Итоговая стоимость запроса отражается в истории списаний.
Input / 1M токеновот 103,57 ₽
Output / 1M токеновот 2 071,34 ₽
