DR.MAZIN / AI

Голосовой ввод: диктовать, а не печатать

Опубликовано 30 июн. 2026 г.Обновлено 8 июл. 2026 г.6 мин чтенияНачальный
8просмотров

Зачем врачу вообще диктовать

Посчитайте, сколько за день вы печатаете. Не карты - всё остальное. Заметка коллеге, ответ в чат, черновик письма поставщику, набросок поста, «надо записать мысль, пока не забыл». По отдельности - мелочь. За неделю - часы, потраченные на стук по клавишам.

И дело даже не в минутах. К вечеру устают руки, режет глаза, а главное - пропадает запал. Мысль в голове готова, а садиться её набирать - лень. И мысль уходит.

Диктовка ломает этот барьер. Вы говорите вслух - текст появляется сам, в том окне, где стоит курсор. Скорость речи против скорости печати - это не близко. Человек проговаривает мысль раза в три быстрее, чем набирает, и без усилия.

Я сам долго думал, что это игрушка для тех, кто не умеет печатать. Печатаю я как раз быстро. А потом попробовал наговаривать черновики - и понял, что зря держался за клавиатуру. Барьер «лень садиться писать» просто исчез.

Что выбрать: три инструмента

Не буду грузить десятком - возьмите один из трёх, они закрывают почти всё.

  1. MacWhisper - если у вас Mac

    Заточен под Mac, работает чисто, по-русски понимает хорошо. Если вы в экосистеме Apple - начните с него, меньше всего возни. Распознаёт точно, нажал кнопку - говоришь - получаешь текст.

  2. Handy - универсал на любой системе

    Кросс-платформенная (handy.computer), живёт и на Mac, и на Windows. Если у вас не Apple или вы скачете между устройствами - это ваш вариант. Один инструмент, одна привычка, везде одинаково.

  3. Wispr Flow - если хочется максимум удобства

    Бесплатна до лимита слов в неделю, дальше платная. За деньги вы получаете гладкость: само расставляет запятые, чистит «эээ» и «ну вот», на выходе - причёсанный текст, а не сырая расшифровка. Для тех, кто диктует много и хочет, чтобы это было приятно.

Принцип у всех один: ставите программу, назначаете горячую клавишу, зажали - говорите - отпустили, текст вставился туда, где курсор. В заметку, в мессенджер, в письмо, в окно нейросети - без разницы. Поле есть - текст будет.

Как это меняет рутину

Самое заметное - не «я стал быстрее печатать». А «я перестал откладывать».

Раньше: пришла мысль для поста - «запишу потом» - потом не пришло. Теперь: проговорил вслух за двадцать секунд, черновик лежит. Раньше: надо ответить коллеге развёрнуто - откладываю на вечер, печатать лень. Теперь: наговорил на ходу, отправил.

И отдельный кайф - диктовать в нейросеть. Вы же всё равно с ней разговариваете, только пальцами. А так - буквально голосом: «перепиши вот эту памятку проще, убери канцелярит» - и всё, не набирая ни буквы. Запрос длинный, подробный, со всеми деталями - наговорить его легко, а печатать такой ленились бы.

Диктовка - это пол. А где потолок?

Наговаривать черновики и сообщения - это приятный быт. А потолок - это когда голос становится входом в систему: вы проговариваете, а на выходе получаете не сырой текст, а готовый результат под вашу практику, по вашим шаблонам. Вот это «как собрать» мы и разбираем на практикуме: 2 живых вечера, своими руками, без кода, 2000 ₽. Записаться

Про автозаполнение карты по надиктовке меня спрашивают чаще всего. Да, в ту сторону всё и движется - наговорил приём, система разложила по полям. Но это уже не «поставил программку и диктуешь». Это отдельная сборка, со своими правилами безопасности, и собирается она руками. Это потолок, к которому идём, а не кнопка из коробки.

«А оно вообще распознает нормально?» - частые сомнения

Перед тем как поставить, у всех включается один и тот же набор возражений. Пройдусь по ним, потому что меня тормозили ровно они.

«У меня плохая дикция, оно не разберёт». Разберёт. Современная диктовка спокойно вытягивает обычную человеческую речь - не диктора, а живого уставшего врача в конце смены. Первые пару минут странно слышать себя со стороны, потом привыкаешь и говоришь как обычно.

«Я же не диктую по-английски, мне нужен русский». Все три инструмента русский тянут хорошо. Это давно не та история, где надо говорить медленно и по слогам, как роботу из нулевых.

«А термины? Оно же не знает стоматологию». С узкими терминами иногда промахивается - может услышать не то слово. Но это лечится: либо поправляете руками одно слово (а не печатаете весь абзац), либо проговариваете чуть чётче. Чистого выигрыша это не отменяет.

«Шумно в кабинете». Да, в гудящем помещении точность падает - микрофон ловит лишнее. Но большую часть диктовки вы и так делаете не у кресла, а за столом, в кабинете, дома вечером. Там тихо.

Приём «сам поднял возражение - сам ответил» я тут разложил специально. Потому что именно эти четыре мысли держат людей на клавиатуре дольше, чем стоило бы.

Одна граница, которую нельзя переходить

А теперь без шуток, потому что тема такая.

Облачная диктовка работает так: ваш голос уезжает на чужие серверы, там превращается в текст, возвращается обратно. Удобно. Но это значит, что всё сказанное вслух - покинуло ваш компьютер. Важная оговорка: MacWhisper и Handy распознают голос прямо на вашем компьютере, никуда его не отправляя, - с ними в этом смысле спокойнее. Правило ниже критично для облачных - Wispr Flow и диктовки в телефоне.

Поэтому простое правило: идентифицирующие данные пациента - ФИО, телефон, всё, по чему человека можно узнать, - в облачную диктовку не наговариваем. Надиктовать обезличенную формулировку «пациентка, такой-то зуб, такая-то жалоба» - пожалуйста. Назвать вслух фамилию - нет.

Где именно проходит безопасная граница, как устроить диктовку так, чтобы данные не утекали, и что для этого нужно - это отдельный разговор, и он у меня есть в отдельной статье про данные пациента и на практикуме. Тут главное - запомнить саму границу.

А для всего остального - заметок, писем, постов, мыслей на бегу - диктуйте смело. Руки скажут спасибо. Глаза тоже.

Попробуйте денёк. Обратно к клавиатуре уже не захочется)

Была ли статья полезной?
Автор
Евгений Мазин
Врач-стоматолог, основатель DR.MAZIN / AI

Стоматолог из Москвы, доказательный подход. Учу врачей собирать AI-ассистентов под свою практику - без кода.

Связанные статьи