Сначала про тайну, потом про удобство
Юрист не станет читать про экономию времени, пока не поймёт, где окажется его голос. Поэтому вперёд — неудобная часть.
Звук уходит на наш сервер. Распознавание идёт в облаке, а не на вашем компьютере. Пока зажата горячая клавиша, приложение пишет фрагмент речи и по защищённому соединению (TLS) отправляет его нам. Никакого локального режима у «Потока» сейчас нет, и делать вид, что аудио остаётся у вас, было бы враньём.
Дальше — что подтверждено нашими опубликованными документами:
- Сервер стоит в России. За границу аудио не отправляется. Базы данных с персональными данными размещены на территории РФ — это требование ч. 5 ст. 18 152-ФЗ, и оно описано в разделе 8 политики.
- Запись удаляется после обработки. Аудиофрагмент обрабатывается во временном хранилище в объёме, необходимом для распознавания, и удаляется после того, как текст готов (раздел 5 политики). Архива ваших диктовок у нас нет.
- Аудио не идёт на обучение моделей без отдельного, специально полученного согласия — это прямо записано в том же разделе.
- Локальные аудиозаписи удаляются через две недели. Приложение чистит их на вашем компьютере автоматически, без вашего участия.
- Голос не используется для идентификации личности. Биометрические персональные данные мы не обрабатываем (раздел 3 политики).
- Телеметрию можно выключить целиком. В приложении есть «Приватный режим»: при нём не уходит никакая техническая статистика, включая обезличенную. Содержимое диктовок в телеметрию не попадает. Оговорка, чтобы не вводить в заблуждение: это переключатель телеметрии, а не режим «ничего никуда не уходит» — распознавание всё так же идёт на сервере.
Чего мы не обещаем
Мы не проходили аттестацию по требованиям защиты информации и не выдаём заключений о том, что сервис пригоден для сведений, составляющих адвокатскую тайну. Такое решение принимает адвокат под свою ответственность, а не поставщик программы.
Практическая рамка простая. Если ваш внутренний порядок допускает облачные сервисы с российской юрисдикцией данных — вы понимаете, на что идёте, и факты выше вам их дают. Если сведения о доверителе не могут покидать ваш контур в принципе, диктовать их нельзя ни через нас, ни через любой другой облачный сервис. В этом случае честный ответ — локальные решения, которые считают речь прямо на устройстве.
Есть и третий путь, которым пользуются чаще, чем кажется: диктовать обезличенно. Формулировки, правовое обоснование, структура возражений — это девять десятых текста, и в них нет ни имён, ни номеров дел. Идентифицирующие детали дописываются руками за минуту. Такой режим работы снимает вопрос целиком и никак не мешает скорости.
Как это выглядит в обычный день
Утро, четыре документа в работе. Раньше это выглядело так: сесть, открыть шаблон, полтора часа набивать обстоятельства дела, к обеду устать так, что правовое обоснование переносится на завтра.
С диктовкой порядок другой. Открываете шаблон искового в том редакторе, где работаете. Ставите курсор в раздел «Обстоятельства дела», зажимаете сочетание клавиш и рассказываете фабулу вслух — так же, как рассказали бы её коллеге. Текст с пунктуацией встаёт прямо в документ. Отпустили клавишу, перечитали, поправили пару мест. Дальше — просительная часть, приложения, сопроводительное.
Что реально ложится на голос:
- обстоятельства дела и фабула — самая длинная и самая скучная для набора часть;
- правовая позиция и возражения на отзыв;
- претензии и ответы на претензии, где половина текста типовая;
- договоры по своему шаблону — надиктовать особенные условия, остальное подставить;
- внутренние документы: заключение для клиента, служебная записка, памятка по сделке;
- заметка сразу после заседания, пока помните формулировки судьи, — прямо в машине или в коридоре.
Что на голос не ложится: таблицы, реестры, сверки, нумерованные приложения на сорок позиций. Диктовать структуру мучительнее, чем набрать. И правку чужого текста голосом делать неудобно — там нужны курсор и мышь.
Что мы измерили на юридической лексике
31 июля 2026 года мы прогнали через наш боевой сервер распознавания 72 фразы в восьми категориях, включая юридическую. Считали ошибку распознавания (WER) и отдельно — сколько ключевых терминов вернулось в каноническом написании.
Замер от 31.07.2026 на собственном сервере распознавания. Речь синтезированная — идеальная дикция, ноль фонового шума, один голос. Это верхняя граница качества, потолок. На живой речи из ноутбучного микрофона в кабинете с окном на проспект цифры будут заметно хуже. Отклик 124 мс — медиана по 72 запросам (минимум 73 мс, максимум 689 мс).
Числа заслуживают отдельного абзаца, потому что для процессуального документа они важнее всего остального. Модель переводит сказанное в письменную форму сама: «пятнадцатое марта в четырнадцать тридцать» превращается в «15 марта в 14:30», «два миллиона восемьсот тысяч рублей» — в «2 800 000 ₽», «восемьдесят семь процентов» — в «87%». Не приходится потом переписывать прописью набранное. На десяти фразах этой категории смысловых ошибок не было ни одной.
Пунктуация тоже держится: на категории «пунктуация и структура» ошибок в словах не было, знаки местами свои — вопросительный вместо запятой в сложном предложении, восклицательный превратился в точку. Совпадение знаков по F1 — 0,74. То есть перечитывать и расставлять акценты придётся, а набирать заново — нет.
Где мы ошибаемся, и это стоит знать заранее
Латиница ломается
В том же замере правильное написание латиницей мы дали только в 9% случаев (2 из 22 названий). «Postgres» превратился в «Ptгr кas», «OpenAI» — в «опины». Для юриста это означает конкретное: иностранное наименование стороны, торговая марка, английская аббревиатура в договоре — всё это придётся править руками. Русские имена и фамилии, наоборот, берутся правильно: «Селезнёв», «Штейнберг», «Ильёй Мурадовым» — все восемь из восьми в нашем наборе.
И честно про общий уровень: по суммарной ошибке распознавания на всех восьми категориях мы не впереди зарубежных движков — 9,2% против 8,1% у Deepgram на том же наборе. Сильные стороны у нас конкретные: русская терминология, числа с автоформатированием, скорость отклика и то, что серверы стоят в России. Утверждать «мы лучше всех распознаём русский» мы не будем — это неправда, и проверяется одним тестом.
Что помогает в юридическом тексте
| Приём | Зачем это юристу |
|---|---|
| Личный словарь | Фамилии доверителей, названия компаний, редкие термины и латиница — то, что модель не знает и пишет на слух |
| Сниппеты (заготовки) | Короткая фраза разворачивается в типовой абзац: шапка искового, стандартная просительная часть, реквизиты для сопроводительного |
| Диктовка по разделам | Не весь документ подряд, а блок за блоком — так проще держать структуру и легче править |
| Проверка чисел глазами | Суммы, сроки и номера дел перечитывать обязательно, даже если в замере ошибок не было. Цена одной опечатки в требовании выше цены минуты проверки |
Чего диктовка не заменит
Она не пишет документ за вас. На выходе получается поток речи: живой, подробный, местами избыточный. Структуру, ссылки на нормы и выверенные формулировки собираете вы. Экономия появляется там, где текст рождается из головы, — и исчезает там, где текст нужно точно скомпоновать.
Она не заменит вычитку. Распознавание ошибается тише, чем опечатка на клавиатуре: слово похоже, падеж правильный, а смысл сдвинулся. В процессуальном документе такое ловится только чтением.
И она не решает вопрос конфиденциальности за вас. Мы его выше не обошли, а описали как есть — дальше решение ваше.
Короткие ответы
На наш сервер в России, по защищённому соединению, и только пока зажата горячая клавиша. Там фрагмент превращается в текст и удаляется после обработки — раздел 5 политики обработки персональных данных. Локального режима у «Потока» нет.
Это решение адвоката, а не поставщика софта. Наши факты выше: сервер в РФ, запись удаляется после распознавания, аудио не идёт на обучение без отдельного согласия, локальные записи чистятся через две недели. Аттестации по требованиям защиты информации у нас нет, и заключений о пригодности для адвокатской тайны мы не выдаём. Если сведения не могут покидать ваш контур — облачное распознавание вам не подходит, ни наше, ни чужое.
В замере 31.07.2026 — 0% ошибок на категории юридической лексики и 10 из 10 терминов в точном написании. Замер на синтезированной речи, это потолок: на живой речи будет хуже.
Модель сама приводит их к письменному виду: «15 марта в 14:30», «2 800 000 ₽». На десяти фразах этой категории смысловых ошибок не было. Перечитывать всё равно нужно.
Текст встаёт туда, где стоит курсор, — в любое поле ввода любой программы. Word, отечественные офисные пакеты, браузер, почта, мессенджер, поле CRM. Отдельного окна и копирования нет.
Нужен: распознавание облачное. Офлайн-режима сейчас нет.
Попробовать на своих документах
Голосовой ввод нельзя оценить по описанию — только на своей речи и своей лексике. Windows и macOS, 14 дней полного доступа без карты.
Практика: как надиктовать исковое и как распознаются суммы, даты и нормы.
Вопросы про обработку данных — privacy@potok.now. Что именно и на каком основании обрабатывается — в политике и согласии.