Что это
Grok STT 1.0 представляет собой нейросетевую модель от компании xAI, специализирующуюся на преобразовании голосовых записей в текстовый формат. Модель способна не только транскрибировать речь, но и предоставлять временные метки для каждого слова, а также разделять речь по говорящим.
Что умеет
Модель Grok STT 1.0 сильна в точной транскрибации аудио с возможностью указания временных меток для каждого слова, что удобно для детального анализа. Она также выделяется функцией диаризации, то есть определения разных говорящих в одной записи, и поддержкой многоканального аудио. Это позволяет эффективно работать со сложными аудиоматериалами.
Кому подходит
Подходит для разработчиков, которым нужна высококачественная транскрибация аудио, а также для аналитиков и исследователей, работающих с голосовыми данными и требующих разделения речи по участникам.
Любая модель отвечает только тем, что ей дали в контекст. ENGRAM держит знания команды - встречи, документы, переписку - в единой ИИ-памяти и подаёт модели нужное со ссылкой на источник. Данные в России.
Характеристики
| Провайдер | xAI |
| Контекст | - |
| Вход | аудио |
| Выход | transcription |
| Цена входа | $100000 / 1М |
| Цена выхода | беспл. |
| Вызов инструментов | нет |
| Режим рассуждения | нет |
| Появилась | Июль 2026 |
| ID для API | x-ai/grok-stt-1.0 |
Где запустить: провайдеры
Модель раздаётся через 1 провайдеров. Сравнение по контексту, ценам:
| Провайдер | Контекст | Вход $/1М | Выход $/1М |
|---|---|---|---|
| xAI | - | $100000 | беспл. |
Цена входа по провайдерам, $/1М
Доступ из России
Прямого доступа из РФ обычно нет: нужен VPN, оплата - зарубежной картой или через посредника. Для доступа без VPN и данных в России выбирайте российские модели.