CNN TürkHAVA DURUMU TAHMİNLERİ: 9 Ekim havalar nasıl olacak, yağmur yağacak mı? Meteoroloji'den 5 ile son dakika sağanak uyarısı!PunchNigerian states’ revenues rise 93%, but education spending drops — World BankESPNBuccaneers explode in third quarter in win over CowboysInquirerLPA forms outside PAR, unlikely to develop into cyclone — PagasaBollywood HungamaNana Patekar cremated at Pune farmhouse with Full State Honours; son Malhar Patekar performs last ritesDaily MaverickWHAT WE’RE WATCHING: Coyote vs. Acme — The Looney Tunes comeback taking cartoon chaos to the courtroomESPN DeportesBuccaneers se roban la victoria en Dallas한겨레[포토] 처음 만나는 새가족…에이브러햄 링컴함 300여일 임무마치고 귀환ZDF heuteAktuelle Pressemitteilungen des ZDFThe Sydney Morning HeraldWhat it will cost to score public access to the ‘invitation only’ Birdcage marqueesSözcüBinlerce kasa Bulgaristan'dan yola çıktı: Türkiye'ye geri geliyorIl Fatto QuotidianoUsa, l’annuncio del Pentagono: “La fucilazione dell’autore della strage di Fort Hood sarà trasmessa in diretta streaming”
The Daily Newsstand · Free, Always
Friday, October 9, 2026

Anthropic запретила обижать Claude, а я матерюсь в каждом втором сообщении. Пришлось сделать Punto Switcher для промптов

Translate

Всем привет! 8 октября Anthropic обновила правила пользования своими моделями. Среди прочего там появился пункт, который меня обеспокоил: систематическая бессмысленная жестокость к моделям теперь под запретом. Я как раз писал об этом новость и поймал себя на мысли, что я буду первым, кого забанят.

Потому что я матерюсь на Claude Code. Много. Когда агент в который раз бодро рапортует «готово», а ничего не готово, слова я не подбираю. У меня даже есть скилл Prompt Warrior, который по логам считает, как я общаюсь с агентом. Посчитал: мат почти в каждом втором сообщении. А теперь пришла пора не только считать, но и менять. Менять текст, автоматически, а не свои привычки, конечно же.

Перевоспитываться я не собираюсь, это понятно. Значит, надо сделать так, чтобы Claude просто не видел, как я ругаюсь.

Идея, кстати, давно сидела у меня в голове, я всё думал, куда её воткнуть. Раньше я наговаривл промпты голосом через Whispering — это опенсорсная диктовка: жмёшь горячую клавишу, говоришь, и текст падает в любое поле ввода. Туда можно подключить свою LLM, чтобы она причёсывала надиктованное. Собирался это настроить. Так и не настроил. А тут повод.

Меня зовут Илья, я блогер, основатель сервиса для генерации ArtGeneration.me и фанат нейросетей. Я не разработчик в классическом смысле — скорее продакт с двадцатилетним стажем, который вайбкодит с агентами всё, до чего дотянутся руки. И ругается на них же.

Так появился Angry Switcher — плагин для Claude Code, который перехватывает сообщение до того, как его прочитает Claude, и отдаёт на вычитку другой модели. Та исправляет опечатки, раскладку и транслит, убирает мат и капс, а смысл не трогает. Как Punto Switcher, только чинит не раскладку, а всё сообщение целиком. Вычитывать может Sonnet из вашей же подписки или DeepSeek по своему ключу, если не хочется, чтобы мат вообще уходил в Anthropic.

Дальше расскажу, помогает ли мат вообще, почему вычитка оказалась самой опасной частью затеи и чем в этой роли Sonnet отличается от DeepSeek.

❯ А мат вообще помогает?

Ну, мне уж точно. Но прежде чем что‑то делать, я полез провеирть, не выбрасываю ли я секретное оружие. Многие ведь матерятся на агентов с расчётом: кажется, что под давлением он начинает стараться.

Чаще всего на эту тему цитируют исследование Penn State 2025 года. Грубые промпты дали там GPT-4o 84,8% правильных ответов против 80,8% у вежливых, и эту цифру потом пересказали все. Только вопросов там было 50. В продолжении взяли 570 вопросов и четыре модели, и единого правила уже не нашлось: у одной модели грубость даёт плюс 1,3 пункта, у другой угрозы роняют точность на одиннадцать.

С оскорблениями картина однозначнее. В RudeBench пять моделей гоняли на шести тонах, от вежливого до «заткнись, бесполезная машина». Оскорбления оказались худшим тоном у всех пяти. Claude на них терял почти пять пунктов точности, а ответы у него становились на треть короче. Обиделся, видимо.

При этом настоящий мат не мерил никто. В исследованиях «грубость» выглядит как вежливое англоязычное «you poor creature». Наш родной трёхэтажный остаётся белым пятном. Но выводов хватает и так: в лучшем случае мат ничего не даёт, в худшем агент работает хуже и отвечает короче. Терять нечего.

❯ Невидимый переводчик, который врёт

Механика простая. В Claude Code есть хук, который срабатывает, когда вы уже нажали Enter, а модель сообщение ещё не получила. Плагин забирает текст, отдаёт на вычитку и подменяет. Claude получает чистую версию и понятя не имеет, что там было до.

И вот тут зарыта собака. Этот слой вы не видите. Если вычитка поймёт вас неправильно, агент будет честно делать не то, что вы просили, а вы даже не поймёте почему. Невидимый переводчик, который врёт, хуже, чем никакого.

А врать он умеет. Сначала я поставил самую дешёвую модель, Haiku, и она прочитала моё «хкайку» как «хэш‑функция». Собственное имя не узнала. Пересел на Sonnet, стало лучше, но в живом чате всплыло такое, что я не сразу поверил:

  • я попросил агента самому придумать примеры, а вычитка отправила «я придумаю сам». Поменяла нас местами;

  • «ты идиот?» превратилось в вежливое «Почему ты так сделал?», то есть в претензию, которой я не писал;

  • «я подумла» стало «я подумала», и на пару сообщений я превратился в девушку.

По отдельности всё это мелочи. А вместе выходит агент, который получает не ваши слова.

Вылечилось это одним принципом из исследований про переписывание поисковых запросов: править минимльно. В одной из работ свободный пересказ ухудшал запрос в 42% случаев, а аккуратная правка в 24%. Поэтому вычитка у меня работает корректором, а не редактором. Каждое слово в итоговом тексте должно быть вашим, только исправленным. Вопрос остаётся вопросом, просьба просьбой, условие условием. Непонятное слово остаётся как есть: лучше опечатка, чем неверная догадка. А род вообще никогда не угадывается.

Я написал

Claude прочитал

Е*** М*** БЫСТРО ОТКАТИЛ

Быстро откати.

ПОЧЕМУ ТЕСТ ОПЯТЬ КРАСНЫЙ Б***???

Почему тест опять падает?

pochini test v src/auth.ts on padaet posle refresh tokena

Почини тест для src/auth.ts: он падает после обновления refresh‑токена.

НЕ ТРОГАЙ МИГРАЦИИ!!! добавь поле email в модель User

Добавь поле email в модель User. Важно: миграции не трогай.

ghbdtn

привет

Плюс пара предохранителей. Код, логи и цитаты до вычитки вообще не доходят: вместо них модель видит метки и обязана вернуть их на место. Пути, имена файлов и числа сверяются, и если что‑то потерялось или появилось новое, уходит ваш текст как есть. Короткие «да, давай» не трогаются вовсе. А если нужно отправить что‑то дословно, начните сообщение с raw:.

❯ Оригинал едет рядом

Даже аккуратная правка иногда ошибается. Поэтому под чистым текстом Claude получает и ваш оригнал. Мат в нём закрывает та же модель, что вычитывала: остаётся первая буква и звёздочки. А в системном промпте у Claude одна строчка: если чистый текст и оригинал расходятся по смыслу, верь оригиналу.

Получается, вычитка убирает шум, а последнее слово всё равно за вами. Стоит это около сотни токенов на сообщение, на фоне контекста в сотни тысяч незаметно. Если не нужно, есть /angry original off.

❯ Sonnet или DeepSeek

Есть в этой истории ирония, которую я заметил не сразу. Затевалось всё из‑за правил Anthropic, а мат в чистом виде теперь читает Sonnet — модель той же самой Anthropic.

У меня на этот счёт своя теория: если за абьюз и будут наказывать, то вряд ли за Sonnet или Haiku. Мелкие модели для обучения не подходят, учат на больших и на лучшем контенте. Так что пусть терпит он, Opus мне ещё нужен.

Поэтому по умолчанию вычитывает именно Sonnet, и это самый удобный вариант. Плагин ходит через ваш же логин Claude, и на подписке платить сверху ничего не нужно. А на низком уровне размышлений он настолько дешёвый, что в лимитах это не ощущается: по ценам API около $0.0015 за сообщение, тысяча сообщений — полтора доллара. Чистка занимает полторы‑две секунды.

Кто не хочет проверять мою теорию на себе, может перевести вычитку на DeepSeek V4.1 Flash по своему ключу. Ключ задаётся один раз, дальше /angry model deepseek и /angry model sonnet переключают туда и обратно. Тогда мат до Anthropic не доходит вообще.

Без сюрпризов не обошлось. Сначала DeepSeek работал без размышлений, ради скорости, и отвечал за секунду. Только «я тебе о*** вырву» так и уходило агенту, угловые скобки в шаблоне превращались в <, а непонятные слова он угадывал вместо того, чтобы оставить как есть. С размышлениями на минимуме это ушло, зато на одних и тех же сообщениях он вычитывал почти вдвое дольше Sonnet: 3,4 секунды против 1,9. И платить за него придётся уже со своего ключа, около $0.30 за миллион входных токенов и $1.20 за миллион выходных.

❯ Честно про минусы

Каждая чистка занимает время: полторы‑две секунды с Sonnet и больше с DeepSeek. Мелочь, но она есть.

Сильно покорёженные слова вычитка всё ещё иногда читает не так. Оригинал рядом это страхует, но не на сто процентов.

Если она пропустит какое‑то матерное слово, оно дойдёт до Claude в оригинале. Тут уж извините, русский язык богатый.

Работает только в Claude Code. В обычном чате на claude.ai плагинов нет.

❯ Где взять

Код открыт, лицензия MIT, репозиторий тут. Кидаете ссылку Claude Code, просите поставить, и всё. Каждое переписанное сообщение видно в чате карточкой «ты написал / ушло», так что подмена не тайная, а /angry off выключит всё, если надоест.

Хотите сначала узнать, насколько вы токсичны? Поставьте рядом Prompt Warrior. Он по логам посчитает мат, капс и ночные сессии и выдаст титул.

Если ключ DeepSeek заведён, в плагине есть ещё команда /ask-ds: она отпраляет вопрос прямо в DeepSeek и печатает ответ в чат. Удобно, когда Opus в очередной раз заблокируется при вопросе про кибер безопасность.

Материться я не перестал. Но Claude мой мат больше не читает.

Ставьте, ругайтесь и больше не беспокойтесь, что Антропик вас забанит (по крайней мере теперь не за это). И звезду на гитхабе, если зашло, мне будет приятно.

А в комментариях расскажите: вы материтесь на агентов? Помогает? Или я один такой?

Я рассказываю больше о нейросетях у себя в YouTube, в Телеграме и на Бусти. А каждую пятницу мы на стриме смотрим новинки и обзоры за неделю и генерируем вместе, присоединяйтесь. Всех обнял и удачных генераций.

Только зарегистрированные пользователи могут участвовать в опросе. Войдите, пожалуйста.

100%Да, постоянно, это мой основной язык промптов1

0%Бывает, когда агент в третий раз пишет «готово», а ничего не готово0

View the original on Хабр →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.