Роман про Маркетинг и Нейросети
28.06.2026 15:51 · 👁 347
🎙 Четыре «говорилки» для надиктовки промтов — какую выбрал я
Сейчас отдельный тренд — наговаривать промпты голосом. Не то чтобы он появился вчера, диктовка была и раньше, но взлетела она именно с вайб-кодингом. Сам ловлю кайф: я и вслепую печатаю быстро, но когда наговариваю промпт — он получается лучше. Расшифровывается в текст моментально, и пока говоришь, всплывают детали, которые при печати банально забыл бы вставить. В итоге промпт выходит подробнее, точнее — и всё это быстрее.
Сдвиг тут фундаментальный: голос реально начинает вытеснять клавиатуру. Разработчики и дизайнеры первыми ушли в Vibe Coding и Vibe Design — когда код и макеты создаются и правятся прямо голосом, в диалоге с ИИ. Но есть и обратная сторона: на людях диктовать стесняются. По опросам, лишь 6% делают это в общественных местах — боятся побеспокоить окружающих и спалить, о чём вообще спрашивают нейронку. Отсюда феномен «тихого общения» с устройствами: сидишь в опенспейсе и нашёптываешь, чтобы коллеги не слышали 😅
Дело дошло до того, что под голосовую работу придётся переделывать сами офисы. Классические опенспейсы под неё не заточены — поэтому уже обсуждают отдельные «голосовые зоны», звукоизолированные капсулы для уединённой работы и пересмотр правил по шуму и гарнитурам.
В общем, перепробовал кучу сервисов для надиктовки. Свёл всё к четырём. Три реально гонял, четвёртый отсеял ещё на этапе чтения отзывов👇
🔥 AquaVoice — мой выбор. От $10 в месяц (на сайте показывают $8 при годовой оплате, плюс есть бесплатные 1000 слов на пробу). Из всех, что тестировал, он лучше всех считывает русский. Ориентирован в первую очередь на мгновенное диктование. Главная задача — как можно быстрее превратить устную речь в чистый текст. Ключевые особенности: высокая скорость транскрипции, учёт контекста на экране, пользовательские словари для технических терминов и настройка тона в зависимости от приложения. Сейчас сижу на нём и не нарадуюсь.
② Monologue — тестировал платную версию. Поначалу зашёл, работал вполне прилично. Но потом начались косяки: стал ловить лишнее, особенно если рядом кто-то говорит или играет музыка. Считывал не то, что я наговаривал. От $10 в месяц по early-bird (дальше $15), на Mac и iOS. Хорош, но русский держит хуже AquaVoice.
③ Handy — бесплатный, с открытым кодом, работает полностью оффлайн на Mac, Windows и Linux. Ничего платить не надо вообще — живёт на донатах. Выдаёт сырой текст без причёсывания, и есть задержка пару секунд после того, как замолчал. Но за ноль рублей — достойно👌 Можно самому выбрать модель распознавания.
④ WisprFlow — единственный, который не пробовал. Почитал отзывы: многие коллеги им довольны, но всплывает одна штука, которая меня сразу остановила — жалобы на обрыв записи на длинных диктовках без сохранения. У меня диктовки длинные, терять их я не готов, так что мимо. $15 в месяц или $144 в год, бесплатно 2000 слов в неделю.
Итог: AquaVoice. Лучше всех с русским, быстрее всех, точнее всех. Пока что фаворит без вопросов.
P.S. Если думаете, что я тут сгущаю краски про перестройку офисов — почитайте статью на WSJ. Там описывают рабочие пространства, которые уже превратились в подобие дорогих call-центров: инженеры сидят в игровых гарнитурах и громко диктуют ИИ, на столах — гибкие микрофоны на «гусиной шее» за $60, а самые упоротые прикупили программируемые ножные педали (геймерский аксессуар), чтобы активировать диктовку пальцами ног🦶Сооснователь LinkedIn Рид Хоффман вообще назвал себя «voicepilled» — что-то вроде «подсевший на голос», уверовавший в голосовой ввод так, что назад дороги нет (по аналогии с redpilled). Так что тренд — абсолютно реальный, просто до нас доезжает чуть медленнее.