Написать пост с помощью нейросети: чтобы звучало как вы
Короткий ответ: нейросеть напишет пост за минуту, и он будет чужой. Я исследовал это и нашел разницу: 13.5 слова в фразе у неё против 22 у меня. Это не вылечить одним промптом, поэтому я собрал кое что еще
У меня это два файла рядом с моделью: ваш словарь и ваши правила ритма, собранные из ваших же текстов. И еще это дополнительный цикл, в котором вы переписываете черновик, а расхождение считается в процентах и превращается в новое правило.
Такой контур у меня работает на закадровых текстах к роликам. Он называется voice-texts, и ниже я расскажу как он устроен, какие цифры получились и где он врёт. Денег в нём ноль, кроме подписки на саму модель и конечно моего времени.
Почему пост от нейросети слышно с первого абзаца
Первая попытка провалилась при формально хороших метриках. Средняя фраза 13.5 слова, это звучит прилично, а текст всё равно читался как нейросетевой. Вот тогда я взял 50 своих голосовых, прогнал через Whisper и замерил живую речь: 73 минуты, 12 108 слов.
| что мерил | текст модели | моя живая речь |
|---|---|---|
| средняя длина фразы | 13.5 слова | 20-22 слова |
| самая длинная фраза | 24 слова | 40-55 слов |
| доля фраз длиннее 25 слов | 0% | 30-37% |
| запятых на фразу | 1.6 | 3.0-3.2 |
| фраз, начинающихся с союза | 0% | 35-40% |
И последние две строки решают больше всего. Письменная речь отредактирована: каждая фраза самостоятельная, симметричная, мысль подана чисто и сразу. А живая речь не редактируется. Мысль тянется через запятые, сворачивает на уточнение, возвращается и договаривается, и следующая фраза цепляется за предыдущую союзом вместо того, чтобы начинаться заново.
Нейросеть пишет отредактированную речь. Вы говорите неотредактированной. Разница слышна раньше, чем читатель поймёт, о чём пост.
А второй признак - готовые конструкции-перевёртыши. Моя личная аллергия: «не потому что X, а…», с переворотом во второй половине фразы. В правилах она запрещена совсем, и запрет этот работает лучше любых советов про живость текста.
Что делать вместо длинного промпта
Почти все пытаются написать идеальный запрос. Но хороший запрос живёт одно сообщение, а правило в файле живёт всегда. Подробнее я разбирал это на своих проектах: как пользоваться Claude и что класть в проект.
Для голоса нужны три файла, и у каждого своя работа.
- Словарь.Ваши слова с частотами: что вы говорите часто, что редко, чего не говорите никогда. Отдельным списком - чужой сленг, который подставлять нельзя.
- Правила.Ритм, связки, мостики между мыслями, запреты. Пишутся не из головы, а из замера.
- Журнал.Таблица правил со счётчиком подтверждений. Правило, подтверждённое однажды, ещё не правило.
И третий файл важнее, чем кажется. Без счётчика система начинает подстраиваться под последний текст, а через десяток правок правила уже спорят друг с другом.
Начните со словаря, а не с правил. Он собирается механически и сразу даёт результат, а правила ритма без замера превращаются в пересказ советов из интернета.
Как замерить свой голос бесплатно
Это самая полезная часть, и она не требует ни одного платного сервиса.
Берёте свои голосовые из мессенджера за пару месяцев, прогоняете через Whisper локально и считаете частоты слов. У меня на это ушёл вечер.
А результат меня осадил. До замера я составил список своих характерных слов вручную, по памяти и по переписке. И он оказался перекошен полностью.
| слово | на 1000 слов | было в ручном списке |
|---|---|---|
| вот | 18.7 | упомянуто вскользь |
| типа | 9.7 | не было вообще |
| ну | 5.7 | упомянуто |
| короче | 4.9 | не было вообще |
| соответственно | 0.7 | стояло как характерное |
| прикольно | 0.3 | стояло как частое |
То есть два самых частых слова в моей речи я про себя не знал, а книжные обороты переоценил в разы. Вывод для текстов получился арифметический: «вот» идёт примерно каждым пятидесятым словом, «короче» вчетверо реже, а «соответственно» не чаще одного раза на текст.
Там же вылезло то, чего пунктуация не показывает. Я считал паузы по звуку, а не по точкам, и мысли между паузами оказались заметно длиннее, чем разрешали мои же письменные правила. То есть правила я написал строже, чем говорю сам.
Цикл: черновик, переписка, дифф, правило
Вот механизм целиком. Он простой, и именно в простоте всё дело.
- Модель пишет черновикпо правилам и словарю, с оглядкой на пару последних готовых текстов.
- Я переписываю его рукамии сохраняю свою версию отдельным файлом, дословно, не исправляя опечаток.
- Скрипт считает расхождениеи показывает, что поменялось в ритме.
- Каждая правка получает тип,и только два типа из четырёх становятся правилами.
А типы правок - это то, без чего всё рассыпается:
| тип правки | что это | обобщается |
|---|---|---|
| стиль | как строятся фразы, связки, ритм, слова | да |
| драматургия | порядок, что в фокусе, что лишнее | да |
| факт | уточнение правды | нет |
| вкус | разовое «не хочу так» | нет |
Соблазн сделать правило из каждой правки огромный, и он убивает систему. Человек поменял имя на «знакомый» - это факт, он касается одной истории. Поменял «садик» на «прескул» - это вкус. А в правила уходит только то, что повторится в следующем тексте.
Первая пара дала 26% переписанного. И видно, что правил он именно ритм: запятых стало меньше, «вот» вычистил больше чем вдвое, фразы чуть короче.
Но самая ценная правка оказалась не про слова. В зачине я назвал две вещи, а история была про одну:
Было
Вся моя жизнь состоит из попыток выучить английский и похудеть. Английский я учу с детства…
Стало
…выучить английский и похудеть. И если питание я все таки хакнул, то бой с английским затянулся.
Побочную линию он закрыл одной контрастной фразой, и главная осталась одна. Так появилось правило R007, и теперь я применяю его в каждом тексте. Кстати, правил из той пары вышло ровно три, и больше трёх за раз я не беру намеренно.
Линтер: что машина проверит, а что нет
Проверка текста перед показом - полторы сотни строк на голом Node, без зависимостей. Выглядит так:
557 слов · 3274 знаков · ≈207 сек
✓ средняя длина предложения: 22.4 (цель 18-24)
✓ начинаются с союза: 36% (цель 30-45%)
✓ «вот» на 1000 слов: 3.6 (цель ≤12)
⚠ тема конфликта во второй половине: 1 (цель 0)
⚠ фирменная фраза «скажу по секрету» уже была в 1 из последних 2 текстов
И две последние строки - мои любимые. Первая следит, чтобы проблема, заявленная в начале, не возвращалась в финале: читатель уже внутри картинки, и возврат к проблеме выдёргивает его обратно. А вторая ловит повтор фирменного оборота между текстами. Однажды сказанный, он звучит находкой, а повторённый уже штампом, и заметить это без счётчика невозможно.
Линтер не знает, интересно ли написанное. Он не видит, работает ли шутка и связно ли идёт мысль. Все его цифры - про форму, и зелёная строка метрик означает только одно: текст не выдаёт себя ритмом.
Где это ломается
Метрики врут, если мерить не то. Средняя длина 13.5 слова выглядела нормально ровно до того момента, как я замерил себя. Пока у вас нет эталона собственной речи, любое число ничего не значит.
Пунктуацию в расшифровке ставит Whisper, а не вы. Поэтому всё, что зависит от запятых и точек, из расшифровки берётся только грубой границей. А точные пороги встают позже, по готовым текстам, которые вы вычитали руками.
Правила начинают спорить друг с другом. У меня на это заведено отдельное действие: периодически похожие правила сливаются, а правила с одним подтверждением, ни разу не сработавшие, удаляются. Без чистки файл правил превратится в свалку.
Мало пар - нет статистики. Одна пара даёт цифру расхождения, и это пока точка, а не график. Я честно держу её как точку и не делаю вид, что у меня тренд.
А онлайн-сервисы для постов? Чем они отличаются
Их много, и они работают. Только работают они над другой задачей.
| что нужно | онлайн-сервис | свой контур |
|---|---|---|
| быстро набросать рыбу | да, сразу | медленнее |
| структура и заголовки | да | да |
| писать вашим голосом | нет | да, к этому всё и сделано |
| учиться на ваших правках | нет, правки уходят в пустоту | да, это главное |
| цена | подписка за подписку | только подписка на модель |
А разница ровно в одном. Онлайн-генератор учился на среднем интернете и выдаёт средний текст, и ваши правки после публикации никуда не записываются. Свой контур начинает с нуля и становится лучше с каждой переписанной статьёй.
Какой моделью это делать из России - вопрос отдельный, и я разбирал его без советов по обходу чего-либо: какие нейросети работают в России.
Сколько стоит и сколько заняло
Денег: ноль плюс подписка на модель. Whisper локально бесплатный, скрипты свои, правила - текстовые файлы.
И кода меньше, чем кажется: пара сотен строк вместе, без единой зависимости. Замер речи занял вечер. Пара черновик-финал с разбором укладывается в день, причём мои руки заняты минут сорок, остальное делает модель.
Весь контур живёт в Claude Code и запускается одной командой. Про него у меня есть отдельный разбор: что такое Claude Code и чем он отличается от чата.
Кому это не подойдёт
Тем, у кого нет своих текстов. Учиться не на чем. Сначала напишите десяток постов руками, а потом возвращайтесь: замер требует материала.
Тем, кто пишет от лица компании. Там нужен не ваш голос, а редполитика, и это другая задача с другими файлами.
Тем, кто ждёт кнопку. Четверть текста я всё равно переписываю руками, и упадёт эта доля не завтра. Если нужен готовый пост без участия, берите онлайн-сервис и не мучайтесь.
Тем, кто пишет изредка. Контур окупается на потоке. А на разовой задаче дешевле написать самому.
Отдельно про то, как я расшифровываю голосовые и встречи у себя на машине, не отправляя звук в облако: нейросеть для расшифровки аудио. Там же про разбор звонков отдела продаж - расшифровка оказалась только началом.
Свой ИИ-агент: от пустой базы до бота, который ведёт ваши дела
Набор коротких уроков: собираем агента, который принимает задачи из телеграма, помнит людей и встречи и будит вас по срокам. На вашей подписке и бесплатном плане базы.
Уроки выходят по одному, начиная с октября. Доступ к набору один раз, новые части приходят на ту же почту. Если передумаете, отпишетесь одной кнопкой.
Пишу про свои автоматизации в телеграм-канале: короткие заметки по ходу работы, без расписания и без рекламы.
Читать каналЕсли нужна не инструкция, а готовое решение под ваш бизнес — напишите мне, обсудим задачу.