· 1 мин

Переехал пайплайн Claude Code на Opus 5 - и половина скиллов сломалась

Переезд на Opus 5 ломает не модель, а промпты, писанные под 4.8. Opus 5 сам себя перепроверяет, поэтому инструкции 'перепроверь' и 'перечитай файл' вызывают over-verification и жгут токены. Первое, что нужно сделать при миграции - удалить все явные самопроверки и лишних субагентов, а не добавлять новые правила.

Переехал агентский пайплайн Claude Code на Opus 5 - и половина скиллов посыпалась. Разбираю, почему инструкции 'перепроверь себя' и лишние субагенты жгут токены, и что переписал в промптах.

Переехал пайплайн Claude Code на Opus 5 - и половина скиллов сломалась

Переехал пайплайн Claude Code на Opus 5 - и половина скиллов сломалась

Когда вышел Opus 5, я обновил модель во всём своём агентском пайплайне на сервере фактически одной строкой и пошёл пить чай. Возвращаюсь - а половина скиллов ведёт себя странно. Черновики жиже, токенов жрёт больше обычного, а один скилл вообще ушёл перепроверять сам себя по кругу и чуть не выел дневной лимит. Первая мысль была "какого чёрта, новая же модель, должна быть лучше". А сломалась-то не модель. Сломались мои промпты, которые я год вылизывал под Opus 4.8.

Дальше - разбор, что реально поменялось в модели, почему старательно написанные инструкции вдруг стали вредить, и что конкретно я выкинул из скиллов, чтобы всё поехало снова.

Что изменилось в Opus 5 против 4.8 для агентских задач

Opus 5 вышел 23 июля 2026 года. Контекст вырос до 1 млн токенов, добавился режим рассуждений xhigh, а цена осталась прежней - 5 долларов за миллион входных токенов и 25 за миллион выходных, ровно как у 4.8. По агентским бенчам скачок заметный: на SWE-bench Verified модель показывает 96%, а на Frontier-Bench удваивает результат 4.8 (43,3% против 18,7% по данным MarkTechPost, июль 2026).

Есть и мелочь, которая бьёт прямо по агентам вроде моего: минимальная кэшируемая длина промпта на Opus 5 - 512 токенов, было 1024 на 4.8. Короткие системные куски скиллов, которые раньше не влезали в кэш, теперь кэшируются. Плюс у параметра fallbacks появился режим default - подсовываешь не свой ручной список резервных моделей, а рекомендованный Anthropic по категориям отказа.

Казалось бы, модель умнее и на тех же деньгах - сиди радуйся. Но именно рост самостоятельности модели и вскрыл всё, что я нахардкодил под её младшую версию.

Почему инструкции "перепроверь себя" теперь жгут токены

Потому что Opus 5 и так себя перепроверяет. Явные инструкции вроде "перепроверь вывод", "перечитай файл и убедись, что правка применилась", "сверься сам с собой" на новой модели вызывают over-verification: она гоняет лишние круги рассуждений впустую. В гайде Anthropic по Opus 5 это прописано прямым текстом - такие строки надо удалить, это срезает потраченные токены без потери качества.

И это не косметика. 24 июля 2026 Anthropic выкатили статью о том, что выпилили больше 80% системного промпта Claude Code под Opus 5 и Fable 5 - и на их же кодинг-бенчах качество не просело. Восемьдесят процентов. А теперь посмотрите на свой раздутый CLAUDE.md и прикиньте, сколько там страховок "на всякий случай".

У меня этих страховок было налеплено щедро. В стадии проверки черновиков - авторевизия до двух циклов при провале скоркарты. По другим скиллам - "прочитай ещё раз", "спот-чек self-research фактов", "перепроверка после правки". На 4.8 это реально спасало от галлюцинаций и кривых правок. На Opus 5 это просто жжёт лимит, потому что модель делает ту же работу сама, без напоминаний.

Отдельная беда - слои. Anthropic в собственных транскриптах нашли, что инструкции копятся пластами и внутри одного запроса начинают друг другу противоречить: один слой просит документировать, другой запрещает комментарии. Модель, скорее всего, разрулит. Но сначала потратит рассуждения на разбор конфликта, а уже потом на твою задачу. То есть ты платишь токенами за то, что сам себе противоречишь.

Лишние субагенты: когда фан-аут только тратит лимит

Раньше я на каждый чих плодил субагентов: отдельный на фактчек, отдельный на редактуру, отдельный на SEO. Логика была простая - разделяй и властвуй. На Opus 5 это чаще оверинжиниринг. Рекомендация Anthropic по субагентам прямая: делегировать стоит только крупные и реально независимые куски работы; там, где модель справляется в один проход, не нужно ни разворачивать несколько агентов, ни заводить отдельного "проверяльщика" самой себя.

Тут мне повезло, что грабли я собрал заранее. Пайплайн у меня headless - генерит черновики по расписанию, кроном, без человека в цикле. И валидаторов-субагентов в стадии генерации я вырубил ещё до всякого Opus 5, банально экономя недельный лимит (эту историю я разбирал отдельно). С переходом на новую модель это из вынужденной меры стало правилом. Цифры у меня получились показательные: из 48 черновиков, дошедших до скоркарты, приёмку с первого прохода прошли все 48, средний балл 87 из 100, и ни одному не понадобился цикл авторевизии. Если структурная стадия и так собирает потолок на модели попроще, старший Opus сверху - чистый оверхед по цене, а не прибавка к качеству.

Что я реально переписал в скиллах

Первым делом удалил всё, что пахнет самопроверкой. Это, как ни странно, самая доходная правка и самая контринтуитивная - потому что строки "перепроверь" и "убедись" кажутся ответственными, их рука не поднимается стереть. А удалять надо именно их в первую очередь.

Конкретно по пунктам:

  • Выкинул строки "перепроверь", "перечитай и убедись", "ещё раз сверься" - десятками, по всем скиллам генерации и правок.
  • Схлопнул конфликтующие слои: нашёл места, где один кусок промпта требовал одно, а соседний - обратное, и оставил одну версию.
  • Сократил число субагентов в горячих путях, оставив фан-аут только на реально тяжёлых стадиях с разветвлением.
  • Перестал захардкоживать примеры на каждый шаг: примеры сужают модель в узкий коридор, а Opus 5 лучше работает, когда ей дают хорошие инструменты и не мешают выбрать путь.

Покажу на пальцах, как это выглядело. Был у меня в скилле правок кусок вида: "внеси правку, затем перечитай файл целиком и убедись, что изменения применились корректно, при сомнении сверься с исходником ещё раз". Три действия там, где Opus 5 и так проверяет применённую правку сам. Стало просто: "внеси правку". Модель применяет, видит результат тула, идёт дальше. Никаких лишних чтений файла на 40 килобайт ради галочки.

Отдельно порадовал кэш. Раньше короткие системные куски скиллов не дотягивали до минимальной кэшируемой длины и каждый запуск гонялись заново. С порогом в 512 токенов на Opus 5 они наконец начали попадать в кэш - на пайплайне, который дёргает одни и те же инструкции по крону десятки раз в день, это отдельная невидимая экономия, которую я сначала даже не заметил.

Скиллы после этого заметно похудели, а стадия генерации перестала утекать в переперепроверки. Голос в статьях, кстати, от снятия страховок не пострадал - humanizer как чистил AI-следы, так и чистит, просто без дублирующего "а теперь проверь, что почистил".

Стоит ли вообще переезжать на Opus 5

Не всем и не везде. Цена та же, модель умнее - для новых агентских задач и творческой генерации переезд оправдан почти всегда. А вот там, где нужны жёсткие воркфлоу и предсказуемость под тесты за час-два, всё не так однозначно.

Показательна история из канала neuraldeep: автор гоняет целую армию Opus 5-агентов плюс Codex на ревью, но корпоративные проекты со строгими стандартами откатил обратно на 4.8. Он это назвал "границей послушности" - у более самостоятельной модели она своя, и на строгих регламентах эта самостоятельность иногда мешает. А Kimi K3 у него на тех же задачах дал ровно обратный результат. Мораль простая: выбор модели - это про задачу, а не про то, у кого циферка версии больше. Экономику именно этого перехода (дешевле ли Opus 5 за задачу, чем 4.8) я считал в отдельной статье, тут не повторяюсь.

Что забрать из этого

Главный вывод, за который я заплатил парой дней разбора: переезд на новую модель - это не "поднять версию в конфиге и пойти пить чай". Это ревизия промптов. И самая жирная правка почти всегда - удалить, а не добавить. Модель за год стала взрослее, а мои инструкции всё ещё разговаривали с ней как с младшей.

Пойду дальше вычищать простыни запретов в CLAUDE.md - про то, почему их пора перестать писать, была отдельная статья. А вы, если сидите на свежем Opus и он вдруг стал тупить или жрать лимит, начните не с промпта "старайся лучше", а с удаления всех "перепроверь". Такие дела.

Частые вопросы

Opus 5 дороже Opus 4.8?

Нет. Opus 5 стоит столько же, сколько 4.8 - 5 долларов за миллион входных токенов и 25 за миллион выходных (данные Anthropic, июль 2026). При этом контекст вырос до 1 млн токенов, а минимальная кэшируемая длина промпта упала с 1024 до 512 токенов.

Какие фразы удалять из промптов первыми после перехода на Opus 5?

Явные самопроверки: 'перепроверь вывод', 'перечитай файл и убедись', 'сверься сам с собой'. По гайду Anthropic они вызывают over-verification на Opus 5 и жгут токены без выигрыша в качестве. Это самая доходная правка.

Нужно ли переписывать вообще все промпты при миграции на новую модель?

Нет, но переезд - это ревизия промптов, а не смена версии в конфиге. Смотрите на накопленные слои: самопроверки, дублирующие инструкции, лишних субагентов. Чаще выигрывает удаление, а не добавление новых правил.

Как готовился материал: черновик собран моим AI-конвейером по темам и заметкам из практики, факты сверены с первоисточниками, финальный текст я прочитал, поправил и утвердил перед публикацией. Обложку к статье тоже рисует нейросеть. Про сам конвейер — в разделе обо мне.

Влад Новиков
Пишу про AI-разработку без глянца. Новые разборы — сначала в канале.
Подписаться