Что это
Gemini 3.1 Flash TTS Preview - это модель преобразования текста в речь от Google. Она представляет собой существенный шаг вперед по сравнению с предыдущим поколением, принимая текстовый ввод и генерируя высококачественный аудиовыход.
Что умеет
Модель специализируется на создании естественного и качественного звучания из текста. Она эффективно закрывает задачи озвучки контента, создания аудио из текстовых данных и интеграции голосовых функций в приложения.
Кому подходит
Подходит разработчикам для внедрения синтеза речи в сервисы, создателям контента для озвучки материалов и всем, кому нужен программный генератор голоса из текста.
Любая модель отвечает только тем, что ей дали в контекст. ENGRAM держит знания команды - встречи, документы, переписку - в единой ИИ-памяти и подаёт модели нужное со ссылкой на источник. Данные в России.
Характеристики
| Провайдер | |
| Контекст | 32 768 токенов |
| Вход | текст |
| Выход | speech |
| Цена входа | $1 / 1М |
| Цена выхода | $20 / 1М |
| Макс. вывод | 16 384 токенов |
| Вызов инструментов | нет |
| Режим рассуждения | нет |
| Появилась | Апрель 2026 |
| ID для API | google/gemini-3.1-flash-tts-preview |
Где запустить: провайдеры
Модель раздаётся через 1 провайдеров. Сравнение по контексту, ценам:
| Провайдер | Контекст | Вход $/1М | Выход $/1М |
|---|---|---|---|
| 32.768K | $1 | $20 |
Цена входа по провайдерам, $/1М
Доступ из России
Прямого доступа из РФ обычно нет: нужен VPN, оплата - зарубежной картой или через посредника. Для доступа без VPN и данных в России выбирайте российские модели.