История продукта

Почему мы сделали голосовой ввод под русскую речь

Короткий ответ: нормальные инструменты диктовки думают по-английски, а мы каждый день пишем по-русски — с именами, кодом и английскими терминами вперемешку. Дальше расскажу честно, как и зачем — я этот продукт делаю.

Поток: собственная модель под русскую речь — голос превращается в чистый русский текст с пунктуацией
Поток собран вокруг русского языка: голос → чистый русский текст с пунктуацией.

Поток — десктоп-приложение для Windows, macOS и Linux: зажал Ctrl+Space, сказал, отпустил — готовый текст встал туда, где стоит курсор. В письмо, в чат, в документ, в редактор кода. Мы собрали его вокруг русского языка, а не подвезли русский в последнюю очередь.

Сказал вслух: «Задеплой ветку на стейджинг и напиши Сергею в Notion»
Чужая модель, English-first
Задеплои ветку на staging и напиши Sergey в ноушн
Поток, модель под русский
Задеплой ветку на стейджинг и напиши Сергею в Notion

Пример иллюстративный — показывает типичные места, где распознавалки без русской заточки теряют имена, термины и RU↔EN-вперемешку.

С чего всё началось

Не с бизнес-плана, а с запястий. Я много пишу, и однажды к вечеру кисти начали ныть. Логичный выход — диктовать. Я попробовал — и упёрся в стену.

Зарубежные flow-инструменты на русском теряли запятые и точки: они дописывают пунктуацию отдельной языковой моделью, а она заточена под английский. Имя «Сергей» превращалось в «Sergey», «задеплой на стейджинг» — в кашу. Встроенная в Windows диктовка русский толком не понимает. То, что осталось от старого поколения, живёт в отдельном окошке родом из 2012 года: говоришь туда, копируешь оттуда, вставляешь руками. Какой уж тут поток.

Я полез чинить это для себя. Оказалось, проблема массовая. Так появился Поток.

Почему чужие модели спотыкаются на русском

Здесь есть нюанс, который со стороны не виден. Мультиязычные распознавалки понимают русский «вообще» — но спотыкаются ровно там, где у нас вся работа. Имена и фамилии. Профессиональный сленг. Русская речь, в которую вшиты английские термины: «скинь в Notion», «подними стейджинг», «зарефактори этот метод». Для модели, обученной в первую очередь на английском, это пограничная зона, и она там ошибается.

Заточка под язык — это не строчка в описании. Это другой уровень качества на той речи, которой вы реально говорите. Поэтому мы пошли от обратного: язык первичен, а не «добавлен в список поддерживаемых». Распознавание идёт в облаке, на собственной модели, обученной под русскую речь.

Чужая модель с английским в основе искажает имена и термины; собственная модель под русскую речь распознаёт их верно
English-first модель спотыкается на именах и RU↔EN; модель под русский — нет.

Что это даёт на практике

Не буду заваливать цифрами, дам три, которые для меня главные.

2,1%
ошибка распознавания (WER) на русском против 4,8% у зарубежных аналогов — бенчмарк GolosTest
~0,4 с
отклик облака против ~1,2 с у зарубежных: серверы стоят в России, а не за океаном
~900
знаков в минуту голосом против ~200 при наборе на клавиатуре
152-ФЗ
данные обрабатываются в России; для бизнеса — установка on-prem на свои серверы
Голосом примерно 900 знаков в минуту против примерно 200 при наборе на клавиатуре
На длинных текстах голос обгоняет клавиатуру по скорости в разы.

Про скорость честно: на практике выигрыш меньше четырёхкратного. Часть времени съедает правка, на совещании вслух не подиктуешь, код всё-таки удобнее руками. Но на длинных текстах — письма, заметки, промпты для нейросети, черновики — разница заметная. А нагрузка на кисти несравнима. Для меня последнее и было решающим.

Для кого мы это делаем

В первую очередь — для тех, кто пишет помногу и на русском. Продакты и менеджеры с их письмами и заметками. Разработчики, которые надиктовывают промпты для ИИ по-русски с английскими терминами. Копирайтеры, журналисты, техписатели. Юристы и врачи, которым нужна диктовка. И отдельно — те, у кого, как у меня тогда, устают руки.

Для бизнеса есть то, без чего к банкам, клиникам и юрфирмам вообще не зайти: данные обрабатываются в России, режим 152-ФЗ, для своих серверов — установка on-prem, когда звук вообще не покидает ваш контур.

Где мы не лучшие — и я это не прячу

Есть аудитория, которая хочет, чтобы звук не уходил с компьютера в принципе. Для неё существуют офлайн-решения, и в этом сценарии они нас обходят — облачная обработка такого не даёт. Я не делаю вид, что Поток закрывает всё. Это компромисс ради скорости и качества распознавания, и кому-то он не подойдёт. Сказать, где ты не первый, — по-моему, честнее, чем натягивать «мы лучше всех во всём».

С зарубежными эталонами вроде Wispr Flow та же история без передёргиваний: это сильные продукты. Просто они заточены под английский, а оплатить их картой из России штатно нельзя. Мы закрываем ровно ту связку, которую поодиночке закрыть легко, а вместе — мало кто: русская модель, оплата рублём, данные в РФ.

«Сказать, где ты не первый, честнее, чем натягивать „мы лучше всех во всём“».

Где мы сейчас

Поток работает в проде, без вейтлиста. Скачали установщик с сайта, зарегистрировались по email — и диктуете. Обновления приходят сами. Бесплатный тариф — 2500 слов в неделю, Pro — 690 ₽/мес (500 ₽/мес при оплате за год). Первые 14 дней — полный доступ без карты: голосовой ввод нельзя оценить по описанию, его надо попробовать на своей речи.

Я диктую этот текст. Год назад настучал бы его руками и к вечеру пожалел.

Короткие ответы

Почему чужие модели ошибаются на русском?

Мультиязычные распознавалки понимают русский «вообще», но спотыкаются там, где у нас вся работа: имена и фамилии, профессиональный сленг, русская речь с вшитыми английскими терминами — «скинь в Notion», «подними стейджинг». Для модели, обученной в первую очередь на английском, это пограничная зона. Поток распознаёт на собственной модели, обученной под русскую речь.

Где обрабатываются данные?

В России — серверы стоят здесь же, режим 152-ФЗ. Для бизнеса есть установка on-prem на свои серверы, когда звук вообще не покидает ваш контур.

Сколько стоит и есть ли бесплатный доступ?

Первые 14 дней — полный доступ без карты. Дальше бесплатный тариф 2500 слов в неделю и Pro за 690 ₽/мес (500 ₽/мес при оплате за год). Оплата рублём.

Кому Поток не подойдёт?

Тем, кому нужно, чтобы звук не уходил с компьютера в принципе. Поток распознаёт в облаке — для полностью офлайн-сценария есть локальные решения, и в этом они нас обходят. Это осознанный компромисс ради скорости и качества.

Попробовать «Поток»

Скачать для Windows, macOS и Linux, 14 дней полного доступа без карты:

Скачать «Поток»

Вопросы по продукту — support@potok.now. Как мы устроены — на странице «О проекте».

© 2026 Поток · ИП · Россия О проекте · Вопросы и ответы · Сравнения