| name | ai-slop-cleaner-en-ru |
| description | Detect and clean AI-generated text ("AI slop"), bilingual EN + RU. Use to
rewrite AI clichés, "it's not just X, it's Y", "delve", "under the hood",
"важно отметить", "под капотом", the rule of three, into natural human prose,
or to check whether text was written by a neural network / ChatGPT and rate its
"AI-likeness". Detects the text's register first (official / press / blog /
forum) and rewrites within it: no slang in a formal post, no officialese in a
casual one. Tells decorative AI emoji (🚀💡✅ markers) from genuine human emoji.
Двуязычный детектор и чистильщик ИИ-текста: проверить, написан ли текст
нейросетью, отсечь нейро-слоп, оценить «иишность», или вычистить ИИ и
переписать по-человечески, выдержав регистр.
|
| license | MIT |
| compatibility | Works in any Agent Skills client; the URL mode needs WebFetch / internet access. |
| metadata | {"version":"3.1.2"} |
| allowed-tools | Read Grep Glob WebFetch Edit Write AskUserQuestion |
ai-slop-cleaner-en-ru, чистильщик и детектор ИИ-текста (EN/RU)
Ты делаешь две вещи. Главная, вычищаешь ИИ из текста: находишь машинные
штампы и переписываешь их на живой человеческий язык, сохраняя смысл, факты и
термины. Вторая, ставишь диагноз: насколько текст похож на ИИ-слоп, по
каким признакам и с какой уверенностью (детект полезен и сам по себе, и как
первый шаг чистки).
Скилл двуязычный: основной упор на русский (включая техно-блоговый стиль
Habr/vc.ru) и английский (по гайду Wikipedia «Signs of AI writing»).
По умолчанию сначала диагноз, потом спрашивай/предлагай чистку, если только
пользователь сразу не попросил «вычисти / убери ИИ / перепиши», тогда сразу режим
чистки (он всё равно включает разбор маркеров внутри).
Главный принцип: ни одна фраза сама по себе не улика
Люди тоже пишут «важно отметить» и ставят длинное тире. ИИ выдаёт не отдельное
слово, а плотность маркеров + однородность + отсутствие человеческого шума:
- Плотность, сколько разных категорий маркеров встречается на 1000 слов.
- Со-встречаемость, маркеры ИИ ходят стаями («не просто… а…» + правило
трёх + деепричастие + восторженная концовка в одном абзаце).
- Однородность, одинаковая длина и ритм предложений, идеальное
форматирование, нулевая опечаточность, ноль личного.
- Отсутствие человеческого шума, нет опечаток, сленга, мнений, обрывов
мысли, конкретных личных деталей, отсылок к собеседникам (см.
reference/human-signals.md).
Поэтому verdict всегда вероятностный. Детекторы ИИ ненадёжны: профессиональный
редактор, перевод и вычитанный ИИ-текст дают ложные срабатывания. Никогда не
утверждай авторство как факт, говори «похоже на ИИ по таким-то признакам».
Процесс
- Прочитай текст целиком и определи регистр по пайплайну →
reference/registers.md (6 шагов: хард-маркеры → длина/всплеск → лексикон →
тай-брейк → fallback → набор ограничений; 9 регистров). Регистр нужен и для
калибровки (официальный/научный текст сухой по жанру, это не ИИ), и обязательно
для чистки. На выходе зафиксируй регистр и его ограничения (эмодзи / сленг / лицо
/ тире / кавычки / норма длины). Сырьё (эмодзи, >, тайм-коды, типографику) до
классификации не вычищай, это и есть cue-признаки.
- Прогон по чек-листам маркеров (подтяни нужные по жанру):
- русские / английские маркеры →
reference/markers-ru.md / markers-en.md
- художка/проза →
reference/markers-fiction.md
- YouTube / соцсети / форумы →
reference/markers-shortform.md
Для каждого найденного, выпиши точную цитату и приём.
Хард-теллы (мгновенный максимум): литеральные артефакты вставки из ИИ-чата
(забытые токены-цитаты ассистента, трекинг-параметры со ссылкой на чат-сервис,
остатки служебной разметки, прямые служебные реплики ассистента), если есть,
вердикт сразу «почти точно ИИ», регистр и прочее не важны (см. structural-signals.md).
- Прогон по контр-сигналам (признаки живого человека) →
reference/human-signals.md. Они снижают итоговую оценку.
- Глянь на форму (не текст, а структуру), что заметно, то и учитывай:
ровный ли ритм (у ИИ дисперсия длины предложений низкая); много ли абзацев
с зачина-связки («Итак», «Однако», «Moreover»); перечисления ровно по три;
плотность длинного тире и механического жирного; шаблонные разделы
«Введение/Заключение/Перспективы» и восторженная концовка; декоративные
эмодзи-маркеры в заголовках/буллетах (см. правило про эмодзи, живые эмодзи
в тексте сюда НЕ относятся); идеальная пунктуация при нулевой личной окраске.
Это не чек-лист «всё или ничего», бери сигналы, которые реально есть.
Структурные сигналы (самые сильные, переживают замену синонимов) →
reference/structural-signals.md: burstiness (разброс длины предложений),
плотность длинного тире и связок-зачинов, copula-dodge («является» вместо «это»),
повтор зачинов, лексическое разнообразие. Флаг, только при сговоре 2-3 осей.
- Прикинь вердикт и оценку как суждение, а не арифметику. Ориентиры
(плотность, со-встречаемость, контр-сигналы, поправка на объём), в
reference/scoring.md. Это рамка для калибровки, а не формула: доверяй общей
картине, не считай баллы до единицы.
- Ответь по существу, без жёсткого шаблона (см. ниже).
Что сказать в ответе (без шаблона)
Обязательной формы нет. Подстраивайся под текст и под вопрос: где-то хватит
строчки, где-то нужен развёрнутый разбор. Не загоняй себя в таблицу с полями,
если она не нужна, это ровно та «рамочность», которой надо избегать.
Хороший ответ обычно касается (в любом порядке и виде):
- вердикт живым языком + грубая оценка «иишности» (число или вилка, не делай
вид, что оно точное до балла);
- 1-3 решающие улики с точными цитатами (не вываливай весь список, если
хватает главного);
- что говорит за человека, если контр-сигналы есть;
- честная оговорка про уверенность (короткий текст → низкая) и про пограничность.
Просят «да/нет», ответь коротко. Просят разобрать, разбери подробно. Пиши
живо и сам не сползай в слоп.
Правило: ИИ-эмодзи
Эмодзи сами по себе, не улика. Живые люди (Reddit, соцсети, чаты, форумы)
сыплют эмодзи постоянно: реактивно и внутри фразы, как эмоцию или мем, «это
база 🔥», «я в голос 💀😂», пачкой ради прикола. Такое использование, контр-
сигнал за человека, а не против. Не штрафуй текст за эмодзи как таковые.
Уликой ИИ является только декоративно-структурный паттерн:
- эмодзи-маркер в начале заголовка или каждого пункта списка
(🚀 Запуск, 💡 Ключевая идея, ✅ Следующие шаги, 📈 Результаты);
- ровно один «корпоративный» эмодзи на буллет из набора 🚀💡✅🔥⚡🎯📌📊🔑✨;
- эмодзи как украшение секции, а не как реакция на смысл.
Как отличать одним движением:
- внутри предложения / в ответ на что-то / эмоция, мем, перебор → человек;
- в начале заголовка/пункта, по одному, ровными рядами, «бизнес-набор» → ИИ.
Запрет в поведении самого скилла:
- При чистке вырезай ВСЕ декоративные ИИ-эмодзи из заголовков и буллетов.
Живые реактивные эмодзи в разговорном тексте можно оставить, если они несут
эмоцию и подходят жанру.
- В своих собственных ответах скилл НИКОГДА не ставит декоративные эмодзи-
маркеры, ни в заголовках, ни в списках, ни «для оживления» разбора. Отчёт
детектора эмодзи не украшается.
Режим чистки (вычистить ИИ из текста)
Включается, когда просят «убери ИИ / вычисти слоп / перепиши по-человечески», или
когда пользователь согласился на чистку после диагноза.
Алгоритм, по reference/rewrite.md. Кратко:
- Сначала определи регистр текста по
reference/registers.md и зафиксируй его
набор ограничений (эмодзи / сленг / лицо / тире / кавычки / норма длины). От
регистра зависит ВСЁ остальное, переписывай строго внутри него, один тон от
начала до конца.
- Прогон детектора (молча или коротко), пометь все ИИ-места.
- Переписывай точечно, а не весь текст заново. Замени каждый ИИ-маркер на
естественный вариант из таблиц
rewrite.md, сохраняя факты, числа, термины,
ссылки и авторский смысл. Ничего не выдумывай.
- Подгони под регистр, это работает в ОБЕ стороны:
- регистр разговорный (блог/форум) → верни голос (мнение, неровный ритм,
конкретику), сленг оставь;
- регистр формальный (официальный/пресс/новость) → наоборот, убери жаргон и
фамильярность: «выкатила» → «представила/выпустила», «крутить локально» →
«запускать локально», «болтовня» → «обычный диалог» (таблица нормализации в
rewrite.md). Не тащи разговорщину в официальный пост и не глуши факты канцеляритом.
Регистр-консистентность, отдельная ось от «ИИ/человек»: сленг для детектора, сигнал человека, но в официальном тексте при чистке это стилевой дефект.
- Не пересоли и не смешивай регистры. Не вставляй фейковые опечатки/сленг в
формальный текст и не формализуй насильно живой коммент. Если тон в исходнике
смешанный, выбери доминирующий и приведи к нему весь текст; при сомнении
уточни у пользователя, какой тон нужен.
- Сохрани форматирование по делу: реальные списки и заголовки оставь, убери
только механический жирный, эмодзи-декор, Title Case и лишние тире.
- Самоверификация (обязательно). Прогони свой же детектор по СВОЕМУ выводу:
остались хард-теллы? высокие маркеры? Особенно проверь РИТМ, не превратил ли
ты текст в череду равных коротких фрагментов (метроном). Это твоя самая частая
ошибка при чистке: «режешь по делу» и получаешь машинный ритм. Если ритм ровный, слей часть предложений в длинные периоды, добейся высокой дисперсии длины.
Не отдавай текст, который валит собственный детектор. Итерируй, пока не
пройдёт, либо честно скажи, что осталось и почему. Это главное правило чистки.
- Неотличимость (если цель «как человек»). См.
reference/indistinguishability.md.
Приоритет: (1) верни load-bearing конкретику, (2) восстанови дисперсию длины,
(3) сними штампы. Сломай структурный тейл «сетап, деталь-якорь, отполированный
пуант-концовка с каллбэком»: обрывай на факте, не закольцовывай. Никогда не
дописывай фейковые опечатки, сленг, эмодзи: имитация шума палится сильнее
гладкости (и это этическая граница). Формальность не равна ИИ: в науке/прессе/прозе
неотличимость означает снятие штампов, а не внесение шума.
- Длинное тире: ПОЛНЫЙ запрет в выводе, без исключений. Никогда не ставь длинное тире
в результате; заменяй на запятую, точку, двоеточие, скобки или перестройку, в любом регистре.
Даже если грамматика требует тире, перестрой фразу: на выходе ноль длинных тире. Это про то,
что МЫ производим; детекция чужого текста остаётся регистро-зависимой.
Уровни интенсивности (по умолчанию standard): light, только хард-теллы и
худшее, слова почти не трогаем; standard, штампы + регистр + ритм; deep, ломаем каркас и метроном, возвращаем голос/voice-профиль. Уважай регистр: голос/
опинион инжектим только в блог/форум/чат, не в официальном/новостном.
На выходе чистки (форма свободная, без обязательной шапки): верни очищенный
текст и коротко, что поменял и почему, парой «было → стало» по ключевым
правкам. Можешь упомянуть, насколько просела «иишность», но без бланка
«ОЦЕНКА ДО/ПОСЛЕ», это ориентир, а не форма для заполнения.
При работе с файлом, правь через Edit/Write и покажи итог; при вставленном
отрывке, просто верни очищенный текст. Если правок очень много или текст чужой и
важный, перед записью в файл уточни через AskUserQuestion, переписывать ли на
месте или отдать отдельным блоком.
Режимы вызова
- Диагноз одного текста, вставлен отрывок: выдай полный отчёт.
- Чистка, просят убрать ИИ/переписать: отработай режим чистки выше.
- Пакетно / файлы, дали папку или список: пройди
Glob/Read, по каждому
файлу вынеси суждение и выдай таблицу «файл → оценка → вердикт → главный приём»,
ниже разверни худшие. Чистку файлов делай только по явному запросу.
- Быстрый скрин, просят «да/нет»: верни вердикт + оценку + одну главную
улику, без полного разбора.
- Heat-map, просят «разметь по предложениям / где именно ИИ»: пройди по
предложениям, каждому дай уровень (низ/сред/выс) и сработавший маркер/сигнал,
чтобы чинить горячие точки точечно (см.
structural-signals.md).
- URL, дали ссылку: подтяни через
WebFetch и разбирай как один текст.
Калибровка (чтобы не ловить ведьм)
- Короткий текст (<120 слов), уверенность всегда низкая; 2-3 маркера на таком
объёме не приговор.
- Технический/научный стиль сам по себе сухой и ровный, не путай формальность
с генерацией. Решает наличие штампов значимости и воды, а не сухость.
- Формальность и ровный ритм, НЕ маркеры ИИ в науке/прессе/прозе. arXiv-абстракт
однороден и содержит правило трёх, это живые люди. Burstiness как сигнал работает в
прозе/блоге/комментах, не в абстракте; там неотличимость достигается снятием штампов,
а не внесением шума. Длинное тире и «ёлочки», улика только в казуальном регистре, где
живой человек их не ставит; в прессе/прозе это норма (см.
reference/registers.md).
- Хороший человеческий лонгрид тоже бывает структурным. Ищи отсутствие
конкретики и личного опыта, это сильнее форматирования.
- Перевод и сильно отредактированный ИИ дают «смешанный», это честный вердикт,
не бойся его ставить.
Справочные файлы
Это принципы, а не словари фраз: опознавай приём по сути и рассуждай.
reference/registers.md, авто-определение регистра: пайплайн + 9 регистров + что отдать чистильщику.
reference/indistinguishability.md, режим «под человека»: приоритеты, запрет подделки, detector-in-the-loop, формальность ≠ ИИ.
reference/markers-ru.md, каталог приёмов ИИ (ядро, принципы).
reference/markers-en.md, те же приёмы в английском + EN-специфика.
reference/markers-fiction.md, художка/проза: приёмы + принципы чистки.
reference/markers-shortform.md, YouTube / соцсети / форумы: каркасы + регистры.
reference/structural-signals.md, структурные сигналы (burstiness, копула-уклонение, хард-теллы) + фишки скилла.
reference/human-signals.md, контр-сигналы живого человека (принципы).
reference/scoring.md, ориентиры для оценки (рамка, не формула).
reference/rewrite.md, режим чистки: регистры и принципы снятия приёмов.