Skip to content

v2 — frontier-агентные модели, 17 практик, протокол миграции

Latest

Choose a tag to compare

@kravcovtech kravcovtech released this 04 Sep 12:42

Третий класс моделей и субтрактивный промптинг.

Поколение frontier-агентных моделей (Claude Opus 5 и новее, GPT-5.6 на высоких effort) сломало часть практик, работавших год назад: обвязка под 3.x/4.x складывается со встроенным поведением и работает против качества.

Главное

Развилка по классу модели стала тройной. Было «reasoning или обычная», стало: обычные (детальные инструкции, few-shot, CoT) → reasoning (outcome-first, zero-shot, глубина параметром) → frontier-агентные (промпт настраивается вычитанием). У третьего класса thinking включён по умолчанию и модель верифицирует себя сама, поэтому инструкции проверки из промпта нужно удалять, а добавлять то, что модель не угадывает: калибровку длины, границы задачи, лимит на делегирование субагентам.

Self-check переосмыслен. Обязателен на обычных моделях, заменяется критерием готовности на reasoning, вреден на frontier: «дважды проверь» и «субагент-ревьюер» жгут токены без прироста качества.

Практик стало 17 вместо 12.

Пять новых практик

№ Практика Что чинит
13 Длину задавай явно Многословность растёт по трём независимым каналам — длина ответа, нарратив о ходе работы, длина файлов на диске; effort не управляет ни одним
14 Контракт задачи вместо здравого смысла Scope creep: незапрошенные исправления, рефакторинг, новые файлы
15 Evidence вместо самоотчёта Выдуманный вывод команд и цитаты; «я проверил» не заменяет артефакт
16 Конфликты между слоями инструкций Системный промпт, CLAUDE.md/AGENTS.md, скилл и сообщение спорят друг с другом
17 Миграция протоколом «После смены модели стало хуже»: промпт и параметры переехали одним куском

Новые справочники

  • references/claude-opus-5.md — что удалить из промпта, что добавить, готовые блоки калибровки длины и границ задачи, разбор жалоб.
  • references/sources.md — реестр источников со статусом проверки: проверено (дата и ссылка) / не перепроверялось / требует проверки. Волатильные цифры не переписываются по памяти.

Пополнение существующих

  • models.md — Grok (xAI), Mistral, open-weight (Qwen, DeepSeek, Kimi, GLM, Llama)
  • context-engineering.md — CLAUDE.md / AGENTS.md как отдельный слой инструкций
  • evals.md — авто-оптимизация промптов (DSPy, GEPA); при temperature=0 прогоны всё равно расходятся, поэтому проверяются свойства ответа, а не строки
  • audit.md — пошаговые протоколы миграции по вендорам
  • template.md — седьмой шаблон: контракт под frontier-агентную модель
  • security.md — OWASP Top 10 for LLM Applications 2026 и первая Agentic (ASI01–ASI10), честные пределы защиты, «летальная триада»

Скилл теперь срабатывает и на жалобы, которые чинятся промптом: многословность, действия сверх задачи, лишние перепроверки, рой субагентов, выдуманные логи, «после смены модели стало хуже».

Английская версия в en/ пока на v1.

Полный журнал — CHANGELOG.md.