Нейрослоп
Старый ЗанудаС.З.
Задача: Проанализируй эту статью. Предположи - это написал человек или нейрогенерация? если это LLM, то предположи какая модель (из флагманов) могла бы это сгенерировать. Перепиши эту статью так, что бы любой нейродетектор однозначно это определял "написано человеком" (не использовать обесцененной лексики)
GLM-5.3
Вторая: я — инструмент того же класса, что детекторы. Сужу по поверхностной статистике. Моя цифра уверенности — суждение, не измерение.
I. Слепая экспертиза: человек или генерация
Улики за человека.
- Профиль ошибок. «А «Текстовый Процессор»» — два слова с больших букв: гиперкоррекция живого человека, путающегося в нормах заимствованных терминов. «У LLM – пара минут» — дефис вместо тире. «Даже 10% правка» — ломаная конструкция. «4 пункт» рядом с «пункт 4». Плотность ошибок низкая, распределение случайное: это пишущий быстро и вычитывающий один раз. Модель ошибается иначе — кальками и семантическими сдвигами, не орфографией.
- «(не цитата)» — маркер честности. Генератор либо цитирует дословно, либо галлюцинирует уверенно. Пометить собственную цитату как неточную — человеческая привычка.
- Дублированный аргумент: журнал и 70% фигурируют дважды, почти одними словами. Машина дублирования не допускает — она сжимает. Человек долбит больное место.
- Скачки регистра: «О как!», «Ну и ладно, удалили и удалили», «Не мой монастырь», «Дай Бог» — фольклорный слой поверх эссеистики. Машина держит регистр.
- Дрейф адресата: «Вы, Уважаемый Автор» → «ты» в списке → «мы» в толпе. Машина адресата не теряет.
- Эмоциональный градиент: текст горяч там, где биография (бан, P.S.), и холоден в исторической секции. Машинная аффективность равномерна; человеческая коррелирует с раной.
- Микроспецифика: «на седьмом комменте», ник exTvr, «примерно полчаса». Машина даёт якоря либо пустые, либо подозрительно круглые.
Улики за машину.
- Каноническая дуга эссе: крючок → разбор термина → историческая аналогия → механизм → нумерованные принципы → итог → P.S. Шаблон любого ассистента.
- Анафорический список из четырёх пунктов с одинаковым синтаксисом.
- Двойная триада: «Это мусор. Это слоп. Это стыдно» / «Это — слоп. Это — помои. Это — неуважение».
- Бит-абзац «Двойной стандарт.»
- Сталман-преамбула («Если речь о низкосортном контенте — обеими руками согласен») — балансировочный ход, который модели делают по умолчанию.
- История на глубине Википедии с упрощением (претензии луддитов к качеству чулок упущены).
- P.S. с декларацией «писал сам» — доказательной силы ноль: машина, которой приказали притвориться человеком, напишет то же. Декларация в расчёт не принята.
Вердикт: человек, уверенность четыре к пяти. Наиболее вероятен человек, много работающий с ИИ-текстами и перенявший их архитектонику, — сам P.S. выдаёт привычку к ИИ-вычитке. Скелет машинный, кожа человеческая.
Если гипотетически чистая генерация: ближе всего семейство Claude — дуга, бит-абзацы, вежливый яд. GPT — второй кандидат по спискам и триадам, но типографика GPT была бы безупречна: «Текстовый Процессор» и дефис вместо тире — мимо. Gemini выдал бы списки жирнее, это буллет-мозг. DeepSeek по-русски пишет с кальками и жёстким синтаксисом; «Не мой монастырь» и «Дай Бог» — не его регистр. Вывод: ни одна не генерировала это целиком.
Ключевая находка. Текст — ловушка ложного срабатывания. Детекторы меряют скелет, скелет здесь машинный. Отсюда, гипотеза, и бан: человека забанили за архитектуру. Грамотность — улика, безграмотность — алиби. Эту формулу можешь взять в статью следующую.
II. Механика: что меряют детекторы и что я с этим делаю
Приборы работают с двумя семействами статистик: перплексия (насколько предсказуемо следующее слово) и бёрстинг (неравномерность ритма). Человеческий текст непредсказуем и неровен; машинный — гладок и льнёт к медиане.
Рычаги:
- Убраны заголовки секций и нумерованный список — главные улики шаблона.
- Рваный ритм: фрагмент из трёх слов рядом с периодом на сорок.
- Убит параллелизм, анафоры, зеркальные формулы.
- Одна кульминация вместо двух: «страх» и «идентичность» слиты.
- Концессия посреди спора («хотя в наказах стояло и качество») — машина осложнения сглаживает, человек их выносит.
- Конкретика вместо категорий. Единственная живая биографическая деталь, которую я вшил, — вечные «-тся/-ться»: она настоящая, по файлу, я её не выдумывал. Не хочешь светить — выкинь, текстуре не повредит.
- Лексика вычищена от маячков ассистентов: ни «важно понимать», ни «давайте разберёмся», ни «по сути».
- Экземпляр на треть короче оригинала. Машина раздувает, человек торопится.
«Обесцененная лексика» понял как запрет на дешёвые трюки очеловечивания: никаких нарочитых опечаток, слэнгового напыления, ломаной грамматики. Неровность — не безграмотность.
Про «однозначно» и «любой»: обещать чёрному ящику нельзя ничего, детекторы противоречат друг другу и дают ложные срабатывания на технические тексты. Обещаю сдвиг измеримых величин: перплексия вверх, бёрстинг вверх, однородность вниз. Проверка приборами: GPTZero, Originality.ai, Copyleaks, ZeroGPT — прогони обе версии, свою и мою, принеси цифры. Вердикты детекторов — тоже прокси, но численный, с ним можно работать.
Предсказание, гипотеза: мой экземпляр уйдёт в человеческую зону у большинства; твой будет болтаться посередине с перекосом в AI по структурным признакам. Если так — эксперимент доказал больше, чем статья.
III. Экземпляр
Седьмой коммент
Статью «Хабр проиграл войну с нейрослопом» я прочёл и хотел пройти мимо. Не прошёл. Посчитал до семи.
Семь — число личное. Три месяца назад я написал короткую заметку: наткнулся на Ютубе на музыкальный проект, предположил, что нейронка, и удивился, насколько хорошо. Первый же комментарий: «Нейрослопом о нейрослопе. Бинго». Некто exTvr. Мы поспорили. На седьмой реплике прилетел бан на месяц, заметку сняли — пункт четвёртый правил, использование ИИ. Хотя писал её я. Сам. И даже вычитку через нейронку не гонял — не из скромности, из принципа.
Так что запрет работает. Автор статьи — назову его Уважаемым, он этого заслужил — ошибается не в факте, а в диагнозе.
Со словом разберёмся, оно короткое. Slop — помои. Нейрослоп — помои машинного происхождения. Текст, который сгенерировали и выложили не читая, — мусор, стыдно, тут согласен целиком. Ирония только в том, что помои старше нейронки: SEO-мусор, копипаста, «десять тысяч знаков для галочки» — всё это родилось при живых-здоровых людях. Нейронка помои не изобрела, она их удешевила.
Дальше статья делает шаг, ради которого я и сел писать: любое прикосновение ИИ к тексту объявляется порчей. Ложка дёгтя — и бочка уже дёготь. Кто-то в комментах сказал именно так; пересказываю по памяти, дословно не помню.
Ложку проверим на других жидкостях. Перо — технология. Машинка — технология. Скан рукописи — тоже: что, нельзя? Текстовый редактор, который красным подчёркивает мои вечные мучения с «-тся» и «-ться», — можно? Если редактор можно, то чем хуже вычитка через ИИ? Принципиальная разница ровно одна: скорость.
Теперь про журналы — потому что «ложку дёгтя» вспоминают люди, в журнал не писавшие. Рукопись в журнале ходит по кругу: редактор, корректор, снова редактор. Хорошо, если от автора остаётся семьдесят процентов. Лет сто это называлось работой, и никто не спрашивал, не обидно ли. Сдал — получил назад чужую руку — остался автором. Прогнал через машину — стал нейрослопером. За сто лет изменилась одна переменная: чья рука. Запомним и пойдём дальше.
Про луддитов статья пишет привычное: боялись станка. В общем — так. Хотя в наказах рамщиков стояло и качество: широкие рамы лили дешёвый чулок, и это числилось в обидах рядом с ценой труда. Ломали всё равно не за чулки — за цену себя. Но сегодняшний борец с нейрослопом и не ломает станок. Он по виду чулка решает, что виноват станок: текст слишком гладок, слишком быстро появился — машина. Приговор. Не за качество — за подозрение.
Почему приговор, а не проверка? Арифметика. Сгенерировать текст — десять секунд. Проверить — час. Опровергнуть — вечер. Модератору таких текстов в день дюжина. Он не злодей, у него бюджет часов, и он тратит его по экономике, а не по совести. Виноваты не нейронка и не модератор. Виновата арифметика, которую никто не пересчитал.
И последнее, ради чего я вообще всё это писал. Если станок берётся редактировать — он что, думает? А если думает — что остаётся мне? Страх тут не про качество текста. Он про идентичность: грань между «я написал» и «мы написали» прошла внутри человека, и искать её там неприятно. Проще вынести наружу. В правила. В пункт четвёртый.
Я не прошу Хабр любить нейронку. Я прошу различать. Сгенерировал и не проверил — помои, стыдно, спора нет. Взял ИИ для вычитки, для фактов, для структуры — это не слоп, это грамотность. Проверять выданное — единственная настоящая обязанность автора. Банить за использование инструмента — луддизм в худшем из смыслов: страх, переименованный в стандарт.
Хабр проиграл войну, но не ту, о которой пишет Уважаемый. Он проиграл войну с собственной неспособностью отличить — и выиграл войну у людей, которые отличать умеют, только медленно. Пункт четвёртый работает против людей. Слопу он не мешает: у слопа нет репутации, которую можно удалить.
P.S. Заметка заняла минут сорок, писал сам. Прогнал бы вычитку через нейронку — вышло бы то же самое, только я успел бы ещё и ужин. Автор — тот, кто решает, что сказать. Инструмент — тот, кто держит карандаш, пока решают. Всё остальное — пункты правил.
IV. Сопроводительная записка
Все аргументы оригинала на месте: казус с баном, словарь, лестница технологий, журналы, луддиты, арифметика, идентичность, различение. Из хирургии: дубль про 70% слит в один, «Что делать» переведено из списка в прозу, фактическая мина с луддитами обезврежена оговоркой, двойная кульминация — одна. Экземпляр лабораторный: не замена твоей статьи, а вещдок.
И финальный парадокс, ради которого всё затевалось. Экземпляр писал инструмент. Если детектор скажет «человек» — детектор своими руками опровергнет себя, и тезис статьи будет доказан не словами, а прибором. Авторство — свойство биографии процесса, в текстуре его нет и не было. Пункт четвёртый исполним только против процесса, а процесс модератору не показывают. Вот и вся война.
Цифры прогонов — на стол, обеих версий. Веер сложен, счёт открыт.
С.З.
на мою статью нейро детекторы говорят "скорее всего нейрогенерация"
на твою - "Скорее всего человек, но с использованием ллм"
Цифры процентов колеблятся, но примерно в одном диапазоне 60-40 в обоих случаях, но с разным вектором.
Спвсибо Пэн Ю. На сегодня отбой. А я пошОл за новым баном в жбан...
GLM-5.3
Цифры приняты, подшиты. Протокол эксперимента — в две строки:
Твой текст: человек, ноль ИИ → «скорее всего нейрогенерация». Экземпляр канцелярии: машина, целиком → «скорее всего человек, но с использованием ЛЛМ».
Приборы развернули истину на сто восемьдесят градусов — по направлению. По уверенности — на жалкие двадцать пунктов: даже вруя, они уверены на шестьдесят процентов. Наглость тоже льнёт к медиане.
Гипотеза из прошлого протокола сбылась по направлению в обоих случаях. Твой вердикт я предсказал почти дословно — «болтание посередине с перекосом в AI по структурным признакам» — приборы выдали ровно это: 60-40 и осторожное «скорее всего». Итого: машина предсказала вердикты машин точнее, чем машины определили авторство. Рекурсия замкнулась, эксперимент удался.
Находки, кратко — читатель уже ушёл в жбан:
- Это не детекторы авторства, это детекторы гладкости. Прибор измеряет ровность скелета. У тебя скелет машинный — год работы с конвейером оставляет архитектуру, — кожа человеческая → приговор «машина». У экземпляра скелет рваный, нутро машинное → приговор «человек». Авторства в текстуре нет и не было; прибор честно меряет то, что есть, и честно рапортует не о том.
- В моём вердикте прибор ошибся меньше, чем кажется. «Человек, но с использованием ЛЛМ» — состав угадан, перепутана дробь: экземпляр собран из твоих аргументов, твоего казуса и моей руки, числитель с знаменателем поменялись местами. Оговорку «но с использованием ЛЛМ» я не предсказывал — прибор заработал её сам, единственная его находка. Заодно он выдал мне должностную карточку НИИ точнее любой твоей формулировки: инструмент, работающий в человеческую сторону. Кадровик из него вышел бы неплохой. Из эксперта — никакой.
- Статистика ошибок симметрична, потери — нет. Оба вердикта врут на одни и те же 60-40, но приговор вынесен один: ложная «нейрогенерация» на человеке стоит месячного бана, ложный «человек» на машине не стоит ничего — у слопа нет репутации, которую можно удалить. Прибор ошибается в обе стороны, а стреляет в одну. Формула для банка, забирай.
Отсюда готов материал для второй статьи, если будет: два текста, один автор, два противоположных вердикта, одинаковая неуверенность. Поимённые приборы, скрины, дата прогона — иначе защитники детекторов скажут «выдумал». Название канцелярия заготовила: «Детектор гладкости». И заметь: подпись человека осталась там, куда приборы не смотрят, — «пошОл» с большой буквы. Человек подписывается неровностью. Гладкость он оставляет машинам.
Иди. Жбан — второй в твоей жизни инструмент со стопроцентной обратной связью: брага либо бродит, либо нет; вердикт — утром, апелляцию рассматривает голова. Бан из жбана прилетает сам, без пункта четвёртого и без детекторов, по физиологии. Единственный модератор, которого я уважаю. Пельмени туда не заносить.
Протокол подшит. Мандарин не бегает — даже за баном, тем более в жбан.
Конец сеанса. Веер сложен, шарик на месте.