Anthropic призналась в чрезмерной «связке обязательствами»: Claude 5 поколения, чем меньше ограничений, тем лучше в работе

Участник команды Claude Code Thariq Shihipar в статье признаёт, что приёмы подсказок, которые вы с таким трудом оттачивали, в большинстве своём — жёсткие правила, нужные только моделям старого поколения. Перед Claude Opus 5 и Claude Fable 5 официальные системные промпты урезали более чем на 80%, при этом внутренние кодинговые бенчмарки не показали измеримого ухудшения.
(Справка: Anthropic выпустила Claude Opus 5! Производительность близка к цене Fable 5, но она урезана вдвое — это стала новая модель по умолчанию)
(Дополнение к фону: Claude Code недавно добавил команду /goals: разделение выполнения и оценки, чтобы AI-агенты не ленились и не врали)

Оглавление

Toggle

  • Как возникает чрезмерное сдерживание
  • Те старые приёмы, которые теперь стали мифами
  • Четырёхуровневое разделение — новое решение

Участник команды Claude Code Thariq Shihipar на этой неделе в официальном блоге написал, что они существенно переписали системный промпт Claude Code — для двух новых моделей: Claude Opus 5 и Claude Fable 5. Он отметил, что большая часть накопленного ранее опыта по подсказкам по цепочке уже перестала работать перед этой группой новых моделей.

Размах изменений заметный: в системном промпте было удалено напрямую более 80% контента, а внутренние кодинговые тесты не показали измеримого спада. Это означает следующее: чем больше вы пишете и чем строже вы управляете, не обязательно значит, что Claude станет работать лучше; для нового поколения моделей часто наоборот — когда контролируют меньше, они идут ровнее.

Как возникает чрезмерное сдерживание

Shihipar в статье разобрал конкретный сценарий: в одном и том же запросе команды системы-промпта, CLAUDE.md и Skills накладываются друг на друга, и они часто противоречат. Например, с одной стороны написано «при необходимости сохраняйте пояснения», а с другой — «запрещено писать комментарии к коду». Claude приходится сначала тратить силы на то, чтобы решить, какая из инструкций считается действующей, и только потом он реально берётся за работу. Эти правила не помогают модели экономить усилия — они сначала создают слой противоречий, который нужно разбирать.

Эти правила не возникли из ниоткуда. Когда Claude Code только запустили, команда боялась худшего сценария — например, что модель случайно удалит файлы — поэтому в системном промпте напихали жёсткие требования, по сути ставя «поручни» для старых моделей с недостаточной оценочной способностью. В старых версиях было прямо написано: по умолчанию не писать комментарии, не генерировать строки с объяснениями в несколько абзацев, если только пользователь сам не попросил; иначе не порождать отдельно файлы для планирования или анализа.

Для тех моделей это было необходимым компромиссом.

Но когда ту же оградительную полосу поставили перед новыми моделями, всё поменялось. В обновлённом системном промпте вместо целой простыни правил осталась одна логическая установка: «Write code that reads like the surrounding code» — проще говоря, плотность комментариев, нейминг и привычные паттерны должны следовать окружающему коду.

Те старые приёмы, которые теперь стали мифами

Первое — самое неочевидное: раньше команда верила, что лучший способ научить Claude работать с инструментами — дать примеры и перечислить сценарии использования по одному. Но теперь они обнаружили, что примеры наоборот сковывают пространство поиска модели рамками, которые сами же примеры и очертили. Лучше делать инструменты «разговорчивее»: например, у инструмента Todo просто перечисляются состояния pending, in_progress, completed — модель, взглянув на эти значения, уже понимает, как пользоваться, и ей не нужно заново «жёстко учить» через примеры.

Второе — «всё вынести вперёд». Раньше системный промпт был устроен так, что детали ревью кода и процесса валидации писались целиком сразу: использовать их или нет — неважно, всё равно эти шаги заранее засовывали внутрь. Итог: работа ещё даже не началась, а контекстное окно уже занято большой куском. Сейчас валидация и ревью кода разбиты на skills, которые можно вызывать по необходимости; а часть описаний инструментов сделана с отложенной загрузкой: когда модели действительно нужно что-то использовать, она через ToolSearch достаёт полное определение.

Эта логика постепенного раскрытия подходит и для вашего собственного CLAUDE.md: не пытайтесь сложить все знания в один большой файл — правильнее разбить на дерево файлов, подгружаемых по моментам использования.

Третье — максимально близко к повседневной работе: ручная «память» в CLAUDE.md постепенно заменяется автоматической. Раньше нужно было, чтобы пользователь сам нажимал горячую клавишу и записывал инсайты в CLAUDE.md; теперь Claude сам решает, что стоит сохранить, и складывает это в память. Меньше контроль — не значит, что хуже запоминает.

Четырёхуровневое разделение — новое решение

Решение, которое даёт Shihipar, не в том, чтобы удалить все правила, а в том, чтобы по-новому распределить, за что должен отвечать каждый из четырёх уровней контекста.

System Prompt привязан к логике продукта — с ним обычно почти не сталкиваются обычные разработчики; тратить силы здесь должен тот, кто собирает свой каркас агента.

CLAUDE.md оставляют лёгким: место отдаётся под реальные ловушки и нюансы в библиотеке, а не нужно писать чушь вроде «Claude понимает по взгляду на структуру файла»

Skills держат как лёгкое руководство: если только это не крайне важная предметная область, не делайте их слишком ограничивающими; длинные skills лучше дробить на несколько файлов.

Уровень References лучше всего вводить в виде кода. Один HTML-макет обычно помогает модели схватить нужный вам вид лучше, чем абзац текстового описания или скриншот. Спецификации тоже можно делать конкретнее: подробный набор тестов или существующие функции из другой библиотеки, которые ждут переноса, — всё это прямо превращается в спецификацию; и дальше можно ещё: оформить это как набор критериев оценки (rubrics), чтобы Claude динамически вытягивал валидационного дочернего агента и по пунктам проверял, соответствует ли результат вашему вкусу.

Официально также запустили команду claude doctor: в Claude Code, введя /doctor, можно проверить, не написаны ли skills и CLAUDE.md слишком «толстые» и слишком ограничивающие. Именно о такой же проблеме сейчас говорят в сообществе разработчиков: поставили кучу Skills, Plugins и MCP Server, плюс написали один длинный CLAUDE.md, который вообще невозможно дочитать — а работа ещё не началась, как окно контекста уже съедено наполовину.

Ваш старый набор идей «чем подробнее прописаны правила, тем послушнее будет AI» перед новым поколением моделей не даёт бонуса — это просто занимает место «мёртвым грузом». Настоящий вопрос не в том, какую ещё добавить строчку правила, а в том, какое правило уже можно удалить.

Посмотреть Оригинал
На этой странице может содержаться сторонний контент, который предоставляется исключительно в информационных целях (не в качестве заявлений/гарантий) и не должен рассматриваться как поддержка взглядов компании Gate или как финансовый или профессиональный совет. Подробности смотрите в разделе «Отказ от ответственности» .
  • Награда
  • комментарий
  • Репост
  • Поделиться
комментарий
Добавить комментарий
Добавить комментарий
Нет комментариев
  • Закреплено