Денис Дудкин
Автоматизация

Написать пост с помощью нейросети: чтобы звучало как вы

8 октября 2026 г. · 14 минут чтения

Короткий ответ: нейросеть напишет пост за минуту, и он будет чужой. Я исследовал это и нашел разницу: 13.5 слова в фразе у неё против 22 у меня. Это не вылечить одним промптом, поэтому я собрал кое что еще

У меня это два файла рядом с моделью: ваш словарь и ваши правила ритма, собранные из ваших же текстов. И еще это дополнительный цикл, в котором вы переписываете черновик, а расхождение считается в процентах и превращается в новое правило.

Такой контур у меня работает на закадровых текстах к роликам. Он называется voice-texts, и ниже я расскажу как он устроен, какие цифры получились и где он врёт. Денег в нём ноль, кроме подписки на саму модель и конечно моего времени.

Почему пост от нейросети слышно с первого абзаца

Первая попытка провалилась при формально хороших метриках. Средняя фраза 13.5 слова, это звучит прилично, а текст всё равно читался как нейросетевой. Вот тогда я взял 50 своих голосовых, прогнал через Whisper и замерил живую речь: 73 минуты, 12 108 слов.

что мерилтекст моделимоя живая речь
средняя длина фразы13.5 слова20-22 слова
самая длинная фраза24 слова40-55 слов
доля фраз длиннее 25 слов0%30-37%
запятых на фразу1.63.0-3.2
фраз, начинающихся с союза0%35-40%

И последние две строки решают больше всего. Письменная речь отредактирована: каждая фраза самостоятельная, симметричная, мысль подана чисто и сразу. А живая речь не редактируется. Мысль тянется через запятые, сворачивает на уточнение, возвращается и договаривается, и следующая фраза цепляется за предыдущую союзом вместо того, чтобы начинаться заново.

Нейросеть пишет отредактированную речь. Вы говорите неотредактированной. Разница слышна раньше, чем читатель поймёт, о чём пост.

А второй признак - готовые конструкции-перевёртыши. Моя личная аллергия: «не потому что X, а…», с переворотом во второй половине фразы. В правилах она запрещена совсем, и запрет этот работает лучше любых советов про живость текста.

Что делать вместо длинного промпта

Почти все пытаются написать идеальный запрос. Но хороший запрос живёт одно сообщение, а правило в файле живёт всегда. Подробнее я разбирал это на своих проектах: как пользоваться Claude и что класть в проект.

Частоты и паузы меряются отдельно: первое честно берётся из расшифровки, второе только по звуку.

Для голоса нужны три файла, и у каждого своя работа.

  1. Словарь.Ваши слова с частотами: что вы говорите часто, что редко, чего не говорите никогда. Отдельным списком - чужой сленг, который подставлять нельзя.
  2. Правила.Ритм, связки, мостики между мыслями, запреты. Пишутся не из головы, а из замера.
  3. Журнал.Таблица правил со счётчиком подтверждений. Правило, подтверждённое однажды, ещё не правило.

И третий файл важнее, чем кажется. Без счётчика система начинает подстраиваться под последний текст, а через десяток правок правила уже спорят друг с другом.

Совет

Начните со словаря, а не с правил. Он собирается механически и сразу даёт результат, а правила ритма без замера превращаются в пересказ советов из интернета.

Как замерить свой голос бесплатно

Это самая полезная часть, и она не требует ни одного платного сервиса.

Берёте свои голосовые из мессенджера за пару месяцев, прогоняете через Whisper локально и считаете частоты слов. У меня на это ушёл вечер.

А результат меня осадил. До замера я составил список своих характерных слов вручную, по памяти и по переписке. И он оказался перекошен полностью.

словона 1000 словбыло в ручном списке
вот18.7упомянуто вскользь
типа9.7не было вообще
ну5.7упомянуто
короче4.9не было вообще
соответственно0.7стояло как характерное
прикольно0.3стояло как частое

То есть два самых частых слова в моей речи я про себя не знал, а книжные обороты переоценил в разы. Вывод для текстов получился арифметический: «вот» идёт примерно каждым пятидесятым словом, «короче» вчетверо реже, а «соответственно» не чаще одного раза на текст.

Там же вылезло то, чего пунктуация не показывает. Я считал паузы по звуку, а не по точкам, и мысли между паузами оказались заметно длиннее, чем разрешали мои же письменные правила. То есть правила я написал строже, чем говорю сам.

Два типа правок из четырёх уходят в журнал, два остаются внутри одной истории. Иначе правил станет больше, чем текстов.

Цикл: черновик, переписка, дифф, правило

Вот механизм целиком. Он простой, и именно в простоте всё дело.

  1. Модель пишет черновикпо правилам и словарю, с оглядкой на пару последних готовых текстов.
  2. Я переписываю его рукамии сохраняю свою версию отдельным файлом, дословно, не исправляя опечаток.
  3. Скрипт считает расхождениеи показывает, что поменялось в ритме.
  4. Каждая правка получает тип,и только два типа из четырёх становятся правилами.

А типы правок - это то, без чего всё рассыпается:

тип правкичто этообобщается
стилькак строятся фразы, связки, ритм, словада
драматургияпорядок, что в фокусе, что лишнееда
фактуточнение правдынет
вкусразовое «не хочу так»нет
Жёлтым помечено то, что машина считает подозрительным. Последние две строки - фразы, которые я уже использовал в предыдущих текстах.
Двадцать шесть процентов переписано, пятьдесят одна правка. Сам текст правок скрыт: в живых парах попадаются имена.

Соблазн сделать правило из каждой правки огромный, и он убивает систему. Человек поменял имя на «знакомый» - это факт, он касается одной истории. Поменял «садик» на «прескул» - это вкус. А в правила уходит только то, что повторится в следующем тексте.

Первая пара дала 26% переписанного. И видно, что правил он именно ритм: запятых стало меньше, «вот» вычистил больше чем вдвое, фразы чуть короче.

Но самая ценная правка оказалась не про слова. В зачине я назвал две вещи, а история была про одну:

Было

Вся моя жизнь состоит из попыток выучить английский и похудеть. Английский я учу с детства…

Стало

…выучить английский и похудеть. И если питание я все таки хакнул, то бой с английским затянулся.

Побочную линию он закрыл одной контрастной фразой, и главная осталась одна. Так появилось правило R007, и теперь я применяю его в каждом тексте. Кстати, правил из той пары вышло ровно три, и больше трёх за раз я не беру намеренно.

Линтер: что машина проверит, а что нет

Проверка текста перед показом - полторы сотни строк на голом Node, без зависимостей. Выглядит так:

Десять правил, выведенных из правок. Счётчик показывает, сколько раз правило подтвердилось новой парой.
557 слов · 3274 знаков · ≈207 сек
✓ средняя длина предложения: 22.4   (цель 18-24)
✓ начинаются с союза: 36%   (цель 30-45%)
✓ «вот» на 1000 слов: 3.6   (цель ≤12)
⚠ тема конфликта во второй половине: 1   (цель 0)
⚠ фирменная фраза «скажу по секрету» уже была в 1 из последних 2 текстов

И две последние строки - мои любимые. Первая следит, чтобы проблема, заявленная в начале, не возвращалась в финале: читатель уже внутри картинки, и возврат к проблеме выдёргивает его обратно. А вторая ловит повтор фирменного оборота между текстами. Однажды сказанный, он звучит находкой, а повторённый уже штампом, и заметить это без счётчика невозможно.

Осторожно

Линтер не знает, интересно ли написанное. Он не видит, работает ли шутка и связно ли идёт мысль. Все его цифры - про форму, и зелёная строка метрик означает только одно: текст не выдаёт себя ритмом.

Где это ломается

Метрики врут, если мерить не то. Средняя длина 13.5 слова выглядела нормально ровно до того момента, как я замерил себя. Пока у вас нет эталона собственной речи, любое число ничего не значит.

Пунктуацию в расшифровке ставит Whisper, а не вы. Поэтому всё, что зависит от запятых и точек, из расшифровки берётся только грубой границей. А точные пороги встают позже, по готовым текстам, которые вы вычитали руками.

Правила начинают спорить друг с другом. У меня на это заведено отдельное действие: периодически похожие правила сливаются, а правила с одним подтверждением, ни разу не сработавшие, удаляются. Без чистки файл правил превратится в свалку.

Мало пар - нет статистики. Одна пара даёт цифру расхождения, и это пока точка, а не график. Я честно держу её как точку и не делаю вид, что у меня тренд.

А онлайн-сервисы для постов? Чем они отличаются

Их много, и они работают. Только работают они над другой задачей.

что нужноонлайн-сервиссвой контур
быстро набросать рыбуда, сразумедленнее
структура и заголовкидада
писать вашим голосомнетда, к этому всё и сделано
учиться на ваших правкахнет, правки уходят в пустотуда, это главное
ценаподписка за подпискутолько подписка на модель

А разница ровно в одном. Онлайн-генератор учился на среднем интернете и выдаёт средний текст, и ваши правки после публикации никуда не записываются. Свой контур начинает с нуля и становится лучше с каждой переписанной статьёй.

Какой моделью это делать из России - вопрос отдельный, и я разбирал его без советов по обходу чего-либо: какие нейросети работают в России.

Сколько стоит и сколько заняло

Денег: ноль плюс подписка на модель. Whisper локально бесплатный, скрипты свои, правила - текстовые файлы.

И кода меньше, чем кажется: пара сотен строк вместе, без единой зависимости. Замер речи занял вечер. Пара черновик-финал с разбором укладывается в день, причём мои руки заняты минут сорок, остальное делает модель.

Весь контур живёт в Claude Code и запускается одной командой. Про него у меня есть отдельный разбор: что такое Claude Code и чем он отличается от чата.

Кому это не подойдёт

Тем, у кого нет своих текстов. Учиться не на чем. Сначала напишите десяток постов руками, а потом возвращайтесь: замер требует материала.

Тем, кто пишет от лица компании. Там нужен не ваш голос, а редполитика, и это другая задача с другими файлами.

Тем, кто ждёт кнопку. Четверть текста я всё равно переписываю руками, и упадёт эта доля не завтра. Если нужен готовый пост без участия, берите онлайн-сервис и не мучайтесь.

Тем, кто пишет изредка. Контур окупается на потоке. А на разовой задаче дешевле написать самому.

Отдельно про то, как я расшифровываю голосовые и встречи у себя на машине, не отправляя звук в облако: нейросеть для расшифровки аудио. Там же про разбор звонков отдела продаж - расшифровка оказалась только началом.

Урок по этой теме

Свой ИИ-агент: от пустой базы до бота, который ведёт ваши дела

Набор коротких уроков: собираем агента, который принимает задачи из телеграма, помнит людей и встречи и будит вас по срокам. На вашей подписке и бесплатном плане базы.

490 ₽ 790 ₽ цена по предзаписи

Уроки выходят по одному, начиная с октября. Доступ к набору один раз, новые части приходят на ту же почту. Если передумаете, отпишетесь одной кнопкой.

Пишу про свои автоматизации в телеграм-канале: короткие заметки по ходу работы, без расписания и без рекламы.

Читать канал

Если нужна не инструкция, а готовое решение под ваш бизнес — напишите мне, обсудим задачу.