Русская речь распознаётся хорошо, и «российское происхождение» программы тут ни при чём: точность определяет модель и звук. Ошибки собираются в пяти местах: имена и фамилии, числа и даты, термины и названия, отрицания и смена говорящего. В ENGRAM расшифровка на русском бесплатна и идёт на вашем Mac; язык по умолчанию «Определять сам», это точнее жёстко заданного русского, когда в речи попадаются английские названия. Проверять надо не «похоже ли на правду», а «то ли слово сказано», по звуку, нажатием на реплику.
Пять мест для первого прохода
| Где ошибка | Как выглядит | Что делать |
|---|---|---|
| Имена и фамилии | Похожая по звучанию фамилия или два слова вместо одной | Найти все вхождения, поправить поиском с заменой |
| Числа и даты | «17» вместо «7», «в среду» вместо «в среду, двенадцатого» | Переслушать каждое число, где оно меняет смысл |
| Термины и названия | Английское название подогнано под русское слово | Оставить язык «Определять сам», термин поправить один раз |
| Отрицания | «пока не утвердили» превращается в «утвердили» | Искать «не», «нет», «пока» рядом с решениями |
| Смена говорящего | Реплика приписана не тому | Сверить по голосу, а не по подписи |
Исправление опирается на звук, а не на догадку
Встречаемся семнадцатого. Бюджет пока утвердили.
«Встречаемся семнадцатого. Бюджет пока не утвердили.»
17 или 7? Есть ли «не»? От двух звуков зависит смысл всей встречи.
Исправить по услышанному. Не заменять «пока не утвердили» на «согласовали»: это уже не расшифровка, а редактура смысла.

Про язык и «российскую» модель
Модель распознавания в ENGRAM локальная и многоязычная. Язык по умолчанию стоит «Определять сам», и это не лень настроить, а осознанный выбор: если в русской речи попадаются английские названия продуктов, жёстко заданный русский заставляет модель подгонять их под похожие русские слова. Автоопределение обычно точнее.
Отдельно про звук: половина ошибок закладывается до распознавания. Микрофон в углу, кондиционер, двое говорят разом. Запись созвона прямо приложением даёт чистый звук; телефон из кармана нет.

Сначала смысл, потом оформление
Первый проход только по пяти местам из таблицы. Второй проход, если нужен, по запятым и абзацам. Если делать наоборот, красивый текст с неверной датой уйдёт клиенту.
Имена и фамилии: Числа, суммы, даты: Термины и названия (особенно английские): Отрицания рядом с решениями: Смена говорящего: Что переслушать:
Почему распознавание ошибается именно там
Ошибки распознавания не случайны, и это хорошая новость: проверять надо не весь текст, а пять мест. Модель угадывает слово по звуку и по тому, какие слова обычно стоят рядом. Обычную речь она предсказывает хорошо, потому что фразы повторяются. Имя вашего клиента она предсказать не может, потому что видит его впервые.
Отсюда список: имена и фамилии, названия компаний и продуктов, числа и суммы, профессиональные термины и слово «не». Последнее особенно неприятно, потому что короткое отрицание легко теряется на быстрой речи, а смысл фразы от этого переворачивается.
Всё остальное в тексте обычно можно читать не глядя. Именно поэтому первый проход занимает несколько минут, а не час: вы ищете пять типов слов, а не вычитываете расшифровку целиком.
| Что проверять | Почему ошибается | Как быстро найти |
|---|---|---|
| Имена и фамилии | Модель их не знает | Поиск по заглавным буквам в тексте |
| Названия компаний | То же самое, плюс латиница | Ищите по первым буквам названия |
| Числа и суммы | Похоже звучат: пятьдесят и пятьсот | Ищите цифры |
| Термины | Редкие слова, мало контекста | Вы знаете свои термины, ищите их |
| Слово «не» | Короткое, теряется на быстрой речи | Поиск по «не» в спорных фразах |
Частые вопросы
- Насколько точно распознаётся русская речь?
- Обычная речь при нормальном звуке распознаётся уверенно. Ошибки почти всегда собраны в пяти местах: имена, названия, числа, термины и отрицания. Точных цифр мы не приводим: чужие замеры к вашей записи отношения не имеют, а свои надо делать на своём материале.
- Как быстро проверить расшифровку?
- Не читайте текст целиком. Пройдите по пяти типам слов из таблицы выше, это занимает несколько минут и снимает почти все реальные ошибки.
- Что сильнее всего портит распознавание?
- Звук. Микрофон в углу комнаты, кондиционер и двое говорящих одновременно испортят результат в любом сервисе. Запись созвона прямо с компьютера даёт чистый звук.
- Определяется ли язык автоматически?
- Да. Отдельно выбирать русский не нужно.
- Что делать со смешанной русско-английской речью?
- Термины на латинице это ровно то место, где ошибки чаще всего. Проверяйте их отдельным проходом.
- Можно ли исправить текст прямо в приложении?
- Да, текст правится, а исходная запись остаётся нетронутой: цитату всегда можно сверить по звуку.
Попробуйте на своей записи.
Установите ENGRAM и получите текст бесплатно, без лимита минут.
СКАЧАТЬ ДЛЯ MAC ↗Иллюстрации и примеры в материале подготовлены для объяснения. Они не являются историями клиентов или измерениями качества приложения.