Что это
GPT Audio Mini - это экономичная версия мультимодальной модели от OpenAI, которая работает как с текстом, так и с аудио. Она принимает на вход текст или аудиофайлы и может генерировать текстовые ответы или синтезировать речь. Модель известна улучшенным качеством и естественностью голоса в выводе.
Что умеет
Главное преимущество модели - сочетание мультимодальности (аудио+текст) и относительно низкой стоимости входа по сравнению с флагманскими решениями. Она лучше всего подходит для задач преобразования речи в текст и текста в речь, создания голосовых интерфейсов и анализа аудиоконтента. Модель поддерживает инструменты (tools), что позволяет интегрировать её в автоматизированные системы.
Кому подходит
Подходит разработчикам для создания голосовых ассистентов, чат-ботов с поддержкой аудио, а также для задач транскрибации и генерации озвучки.
Любая модель отвечает только тем, что ей дали в контекст. ENGRAM держит знания команды - встречи, документы, переписку - в единой ИИ-памяти и подаёт модели нужное со ссылкой на источник. Данные в России.
Характеристики
| Провайдер | OpenAI |
| Контекст | 128 000 токенов |
| Вход | текст, аудио |
| Выход | текст, аудио |
| Цена входа | $0.600 / 1М |
| Цена выхода | $2.4 / 1М |
| Макс. вывод | 16 384 токенов |
| Вызов инструментов | да |
| Режим рассуждения | нет |
| Появилась | Январь 2026 |
| ID для API | openai/gpt-audio-mini |
Где запустить: провайдеры
Модель раздаётся через 1 провайдеров. Сравнение по контексту, ценам:
| Провайдер | Контекст | Вход $/1М | Выход $/1М |
|---|---|---|---|
| OpenAI | 128K | $0.600 | $2.4 |
Цена входа по провайдерам, $/1М
Доступ из России
Прямого доступа из РФ обычно нет: нужен VPN, оплата - зарубежной картой или через посредника. Для доступа без VPN и данных в России выбирайте российские модели.