- Зачем:
- README отстал от SKILL.md после двух раундов self-review — формы инвокации, /agent, disallowedTools описаны неверно.
- Рекомендация Codex sandbox_mode = "read-only" была ошибочной: она запрещает не только запись, но и exec — ревьюер не сможет запускать тесты, линтеры, git, MCP-запросы (а это основа верификации находок).
- Что:
- README и SKILL.md: блок «Tool restrictions» переписан — briefing-only по умолчанию на обоих хостах; жёсткая sandbox упомянута как опция с явным trade-off (на Codex теряется exec).
- README: Usage block обновлён — добавлены code-vs-plan и code-vs-plan <plan-path>, явное правило bare <file-path> → plan, xhigh как ортогональный effort flag.
- README: новая короткая секция Language (ответы ревьюера на языке оператора, без флага).
- README: bullet про structural-only паузы оператора в «What the lead does».
- README: /agent в Codex section переформулирован как CLI оператора, а не tool лида.
- Проверка:
- git diff main..HEAD -- README.md SKILL.md
- Прочитать README целиком и убедиться, что нет противоречий с SKILL.md.
Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
- Зачем:
- Ревьюер отвечал на английском вне зависимости от языка сессии — оператор тратил усилия на чтение и перевод.
- Скилл паузил оператора непредсказуемо (то спрашивал, то применял молча) — нужен явный критерий, что требует мнения оператора, а что не требует.
- Накопились фактические неточности из двух раундов self-review (детекция мёртвого ревьюера, disallowedTools, /agent, грамматика инвокации).
- Что:
- Step 2: новый блок Language — лид определяет язык сессии и добавляет директиву в брифинг; парсимые литералы (VERDICT, severity tags, заголовки секций) остаются английскими.
- Step 4: новый блок «structural vs non-structural» с батч-паузой — одна пауза на раунд только при наличии structural-фиксов; non-structural применяются молча.
- reviewer-prompt.md: добавлен плейсхолдер {LANGUAGE_BLOCK} и описание в таблице placeholders.
- Фиксы из ревью: детекция мёртвого ревьюера переписана под async-модель Agent Teams; disallowedTools — путь через кастомный subagent; /agent описан как CLI оператора, а не tool лида; bare <file-path> резолвится в mode=plan; добавлены формы code-vs-plan и code-vs-plan <plan-path>; xhigh — orthogonal effort flag; «plan in context» получило конкретные критерии.
- Проверка:
- git diff main..HEAD -- SKILL.md reviewer-prompt.md — посмотреть итоговый набор правок.
- Запустить /claude-team-review на самой ветке и убедиться, что директива Language вставляется и батч-пауза срабатывает только на structural.
Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
- Зачем:
- Round 1 adversarial self-review нашёл 6 находок (3 high, 3 medium).
Артефакт первой итерации содержал противоречия между SKILL и README,
неточности про upstream-механики (Codex continuation, Agent Teams
gating SendMessage), и оставлял undefined load-bearing branch
"Operator available?". Без фиксов скилл вводил пользователей без
Agent Teams в ступор при Round 2.
- Что:
- SKILL Step 2: уточнено, что SendMessage gated на Agent Teams; Task
spawn без Agent Teams one-shot; Codex поддерживает intra-session
continuation.
- SKILL Step 4: "REQUIRED SUB-SKILL ... if available" заменено на
"Use ... when available" с явным fallback на inlined принципы.
- SKILL Step 6: добавлена continuation-support table по хостам,
восстановлена секция "Detecting an operator" с heuristic
(interactive если direct human message + user-facing channel).
- README: переписан Agent Teams блок под operator-gated модель; Codex
section — корректное описание intra-session continuation через /agent.
- EXPERIMENT.md: добавлен banner о предшествии редизайну и устаревших
ссылках на adversarial-reviewer.md.
- Проверка:
- Прогнать /claude-team-review в новой сессии с Agent Teams enabled
(env var добавлен в ~/.claude/settings.json) — Round 2 для проверки
continuation через SendMessage и operator-gating паттерна.
- Зачем:
- Скилл был привязан к Claude Code Agent Teams, в Codex приходилось
вручную комбинировать /receiving-code-review и /claude-team-review.
В реальной L4-сессии lead применял findings без верификации, что
привело к большой структурной правке на основе неверной цитаты
из upstream-issue.
- Что:
- SKILL.md: platform-agnostic спавн (Claude Code Task/Agent Teams,
Codex native subagents). Новые шаги Evaluate findings (matrix +
verification-by-type, REQUIRED SUB-SKILL на receiving-code-review)
и Apply/push-back (three-section response — applied / re-scoped /
rejected-with-reasoning). Fresh-spawn теперь operator-gated на
любой платформе. Добавлена Red Flags table.
- reviewer-prompt.md: новый briefing template с placeholders,
заменяет Claude Code-specific agent definition.
- README.md: пути установки исправлены на ~/.claude/skills/ и
~/.codex/skills/, формулировка cross-platform смягчена, секция
эксперимента переведена в английский для единого языка.
- adversarial-reviewer.md: удалён (содержимое переехало в
reviewer-prompt.md).
- .gitignore: tmp/ для локальных рабочих заметок.
- Проверка:
- Прогнать /claude-team-review на этих же изменениях в отдельной
ветке для self-review.
Закрывает три failure mode SendMessage: tool нет, ошибка, routing ack
без контента (тиммейт завершился, inbox мёртв). Лид теперь обнаруживает
проблему сам, не ждёт репорта от юзера.
Для plan mode с inline планами: полный текст ревизированного плана
передаётся inline (и в same-teammate, и в re-spawn), не через temp file —
Write tool недоступен в Plan Mode.
Re-spawn briefing стал mode-aware. Step 6 получил явное NOT VERIFIED
терминальное состояние с WARNING.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
SendMessage для тиммейтов Agent Teams работает нестабильно: может быть
недоступен как инструмент или создавать нового агента без контекста.
Step 5 теперь проверяет доступность тиммейта перед отправкой. Если
тиммейт неактивен — спрашивает оператора (interactive) или завершает
со статусом "fixes applied, not re-verified" (headless). Re-spawn
доступен как опция, не как дефолт.
Также: multi-round секция в adversarial-reviewer.md, исправленные
пути установки в README, убраны ложные утверждения о statefulness.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
- Зачем:
- зафиксировать оценку: чьё ревью ценнее по влиянию на план.
- Что:
- добавлен вывод #4: Opus ценнее для плана (спасает от провала
реализации), Codex ценнее для продакшена (ловит security/ops).
- существующий вывод "оба нужны" стал #5.
- Проверка:
- просмотр секции "Выводы" в EXPERIMENT.md.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
- Зачем:
- зафиксировать вывод о целесообразности persistent memory для
полноты фактуры.
- Что:
- добавлена секция "Послесловие: стоило ли реализовывать план?"
с аргументами против и выводом, что эксперимент оказался ценнее фичи.
- Проверка:
- просмотр EXPERIMENT.md.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
- Зачем:
- подробно задокументировать ход и детали эксперимента, чтобы
использовать как фактуру для статьи на Habr.
- Что:
- добавлена предыстория (как эксперимент возник из тестирования скилла).
- описана техническая механика обоих подходов (Agent Teams vs Codex CLI).
- добавлена сводная таблица последовательного ревью (13 находок рядом).
- расширена таблица характера мышления (фокус, ценные/слабые находки,
характер фиксов, пересечения).
- добавлены детали фиксов для обоих ревьюеров.
- добавлены дословные цитаты из момента осознания методологической ошибки.
- добавлены наблюдения по ходу работы и раздел "что бы сделал иначе".
- Проверка:
- просмотр EXPERIMENT.md в репозитории.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
- Зачем:
- задокументировать эмпирическое сравнение двух adversarial-ревьюеров
(Claude Opus vs GPT-5.4) на одном плане — материал для статьи на Habr.
- Что:
- добавлен EXPERIMENT.md с полным ходом эксперимента: последовательное
и параллельное ревью, все находки обоих моделей, анализ пересечений,
характеристики мышления моделей, выводы и ограничения.
- в README.md добавлена секция "Эксперимент: сравнение ревьюеров"
со ссылкой на EXPERIMENT.md.
- Проверка:
- просмотр EXPERIMENT.md и README.md в репозитории.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
- Зачем:
- проверка через Bash триггерила permission prompt, создавая лишний UX-барьер до начала работы.
- Что:
- удалена секция Prerequisites check с явной проверкой CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS.
- добавлен fallback: если спавн тиммейта не удался — сообщить пользователю, как включить Agent Teams.
- добавлена рекомендация не создавать вспомогательные файлы (memory, state, logs).
- Проверка:
- /claude-team-review — не должно быть промпта на echo $ENV_VAR.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
- Зачем:
- реализация adversarial code/plan review без внешних зависимостей, целиком внутри Claude Code Agent Teams.
- Что:
- добавлен SKILL.md — основной скилл claude-team-review с логикой авто-определения режима, итеративного ревью (до 5 раундов) и stateful тиммейта.
- добавлен adversarial-reviewer.md — определение тиммейта-ревьюера (read-only, Opus, adversarial stance).
- добавлен README.md с описанием, установкой и сравнением с adversarial-review (Codex).
- добавлена лицензия Apache-2.0.
- Проверка:
- /claude-team-review в проекте с включённым CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>