Commit Graph
17 Commits
Author SHA1 Message Date
ddadmin 264ce9017f feat(skill): добавлены правила pedigree-ревью, idle-guard и защита хоста
- Зачем:
  - внедрить в SKILL.md требования к ревью кода агентами и ограничения по безопасности.
- Что:
  - добавлено правило pedigree-ревью изменений.
  - добавлен idle-guard для явного завершения задач.
  - запрещён поиск/использование чужого хоста.
- Проверка:
  - прочитать SKILL.md и убедиться в корректности новых разделов.
2026-07-03 19:11:14 +03:00
ddadminandClaude Fable 5 2f2f7446a5 feat(skill): pedigree ревью, idle-guard и запрет поиска чужого хоста
- Зачем:
  - реальный инцидент 2026-07-03: Codex-координатор искал механизм Claude
    вместо своих субагентов, пропустил ревью и записал выдуманную причину;
    там же трижды воспроизведён недоставленный отчёт живого ревьюера.
- Что:
  - Step 7: строка **Reviewer:** (pedigree) во всех трёх итоговых шаблонах;
    в Rules — запрет молча пропускать/подменять ревью.
  - Step 6: idle-уведомление больше не «авторитетный сигнал смерти» —
    unreachable только после повторного idle-without-report вслед за nudge;
    указатель из Step 3 (действует и на Round 1).
  - Step 2: спавн только на исполняющем хосте, запрет щупать чужой механизм;
    две новые строки в Red Flags.
- Проверка:
  - adversarial team review порта: APPROVED (вердикт тиммейта-ревьюера,
    Claude, Agent Teams), NIT-правки формулировок применены.

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-03 18:06:45 +03:00
ddadmin 8a0e5b8879 Merge branch 'feat/cross-platform-receiving-review' 2026-05-15 16:28:15 +03:00
ddadmin 933c48fb3c feat(skill): union-of-scopes детект изменений для code-режима
- Зачем:
  - типичный PR-флоу: ветка ahead of base + (часто) локальный твик поверх. Прежняя логика смотрела только unstaged/staged и пропускала коммиты ветки, давая пустое или неполное ревью.
- Что:
  - Step 1 auto-detect: добавлен третий независимый scope `git diff <base>...HEAD` с резолвом base (`symbolic-ref refs/remotes/origin/HEAD` → `origin/main` → `origin/master` → `main` → `master`).
  - Step 2 dispatch: briefing для `code` и `code-vs-plan` переписан с fallback на union трёх скоупов, явное "do not skip branch-vs-base because working tree is non-empty".
  - reviewer-prompt.md: `{ARTIFACT}` placeholder теперь спеллует все три scope (a)(b)(c) с инструкцией про labeling mixed-state.
  - README.md: таблица "Three modes" и пояснение синхронизированы с union-семантикой.
- Проверка:
  - на ветке feat/cross-platform-receiving-review одновременно непустые `git diff` и `git diff origin/main...HEAD` — финальная формулировка прошла Codex review (3 раунда, VERDICT: APPROVED).
2026-05-15 16:25:23 +03:00
ddadminandClaude Opus 4.7 657e7c3507 docs(skill): синхронизация README, фикс рекомендации Codex sandbox
- Зачем:
  - README отстал от SKILL.md после двух раундов self-review — формы инвокации, /agent, disallowedTools описаны неверно.
  - Рекомендация Codex sandbox_mode = "read-only" была ошибочной: она запрещает не только запись, но и exec — ревьюер не сможет запускать тесты, линтеры, git, MCP-запросы (а это основа верификации находок).
- Что:
  - README и SKILL.md: блок «Tool restrictions» переписан — briefing-only по умолчанию на обоих хостах; жёсткая sandbox упомянута как опция с явным trade-off (на Codex теряется exec).
  - README: Usage block обновлён — добавлены code-vs-plan и code-vs-plan <plan-path>, явное правило bare <file-path> → plan, xhigh как ортогональный effort flag.
  - README: новая короткая секция Language (ответы ревьюера на языке оператора, без флага).
  - README: bullet про structural-only паузы оператора в «What the lead does».
  - README: /agent в Codex section переформулирован как CLI оператора, а не tool лида.
- Проверка:
  - git diff main..HEAD -- README.md SKILL.md
  - Прочитать README целиком и убедиться, что нет противоречий с SKILL.md.

Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
2026-05-15 16:06:01 +03:00
ddadminandClaude Opus 4.7 a9f8d032f3 feat(skill): язык ответа ревьюера, батч-пауза, фиксы из ревью
- Зачем:
  - Ревьюер отвечал на английском вне зависимости от языка сессии — оператор тратил усилия на чтение и перевод.
  - Скилл паузил оператора непредсказуемо (то спрашивал, то применял молча) — нужен явный критерий, что требует мнения оператора, а что не требует.
  - Накопились фактические неточности из двух раундов self-review (детекция мёртвого ревьюера, disallowedTools, /agent, грамматика инвокации).
- Что:
  - Step 2: новый блок Language — лид определяет язык сессии и добавляет директиву в брифинг; парсимые литералы (VERDICT, severity tags, заголовки секций) остаются английскими.
  - Step 4: новый блок «structural vs non-structural» с батч-паузой — одна пауза на раунд только при наличии structural-фиксов; non-structural применяются молча.
  - reviewer-prompt.md: добавлен плейсхолдер {LANGUAGE_BLOCK} и описание в таблице placeholders.
  - Фиксы из ревью: детекция мёртвого ревьюера переписана под async-модель Agent Teams; disallowedTools — путь через кастомный subagent; /agent описан как CLI оператора, а не tool лида; bare <file-path> резолвится в mode=plan; добавлены формы code-vs-plan и code-vs-plan <plan-path>; xhigh — orthogonal effort flag; «plan in context» получило конкретные критерии.
- Проверка:
  - git diff main..HEAD -- SKILL.md reviewer-prompt.md — посмотреть итоговый набор правок.
  - Запустить /claude-team-review на самой ветке и убедиться, что директива Language вставляется и батч-пауза срабатывает только на structural.

Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
2026-05-15 15:53:05 +03:00
ddadmin bb8c9cf0e1 fix(skill): self-review — operator detection и continuation framing
- Зачем:
  - Round 1 adversarial self-review нашёл 6 находок (3 high, 3 medium).
    Артефакт первой итерации содержал противоречия между SKILL и README,
    неточности про upstream-механики (Codex continuation, Agent Teams
    gating SendMessage), и оставлял undefined load-bearing branch
    "Operator available?". Без фиксов скилл вводил пользователей без
    Agent Teams в ступор при Round 2.
- Что:
  - SKILL Step 2: уточнено, что SendMessage gated на Agent Teams; Task
    spawn без Agent Teams one-shot; Codex поддерживает intra-session
    continuation.
  - SKILL Step 4: "REQUIRED SUB-SKILL ... if available" заменено на
    "Use ... when available" с явным fallback на inlined принципы.
  - SKILL Step 6: добавлена continuation-support table по хостам,
    восстановлена секция "Detecting an operator" с heuristic
    (interactive если direct human message + user-facing channel).
  - README: переписан Agent Teams блок под operator-gated модель; Codex
    section — корректное описание intra-session continuation через /agent.
  - EXPERIMENT.md: добавлен banner о предшествии редизайну и устаревших
    ссылках на adversarial-reviewer.md.
- Проверка:
  - Прогнать /claude-team-review в новой сессии с Agent Teams enabled
    (env var добавлен в ~/.claude/settings.json) — Round 2 для проверки
    continuation через SendMessage и operator-gating паттерна.
2026-05-15 15:03:11 +03:00
ddadmin 2d88edcf52 feat(skill): поддержка Codex и интеграция с receiving-code-review
- Зачем:
  - Скилл был привязан к Claude Code Agent Teams, в Codex приходилось
    вручную комбинировать /receiving-code-review и /claude-team-review.
    В реальной L4-сессии lead применял findings без верификации, что
    привело к большой структурной правке на основе неверной цитаты
    из upstream-issue.
- Что:
  - SKILL.md: platform-agnostic спавн (Claude Code Task/Agent Teams,
    Codex native subagents). Новые шаги Evaluate findings (matrix +
    verification-by-type, REQUIRED SUB-SKILL на receiving-code-review)
    и Apply/push-back (three-section response — applied / re-scoped /
    rejected-with-reasoning). Fresh-spawn теперь operator-gated на
    любой платформе. Добавлена Red Flags table.
  - reviewer-prompt.md: новый briefing template с placeholders,
    заменяет Claude Code-specific agent definition.
  - README.md: пути установки исправлены на ~/.claude/skills/ и
    ~/.codex/skills/, формулировка cross-platform смягчена, секция
    эксперимента переведена в английский для единого языка.
  - adversarial-reviewer.md: удалён (содержимое переехало в
    reviewer-prompt.md).
  - .gitignore: tmp/ для локальных рабочих заметок.
- Проверка:
  - Прогнать /claude-team-review на этих же изменениях в отдельной
    ветке для self-review.
2026-05-15 14:01:04 +03:00
ddadmin ef97a43791 Merge branch 'fix/multi-round-resilience'
Устойчивость multi-round ревью: детекция мёртвого тиммейта,
fallback-логика, NOT VERIFIED state, исправлена установка в README.
2026-04-16 17:07:02 +03:00
ddadminandClaude Opus 4.6 097808d158 fix(skill): детекция мёртвого тиммейта, inline plan artifact, NOT VERIFIED state
Закрывает три failure mode SendMessage: tool нет, ошибка, routing ack
без контента (тиммейт завершился, inbox мёртв). Лид теперь обнаруживает
проблему сам, не ждёт репорта от юзера.

Для plan mode с inline планами: полный текст ревизированного плана
передаётся inline (и в same-teammate, и в re-spawn), не через temp file —
Write tool недоступен в Plan Mode.

Re-spawn briefing стал mode-aware. Step 6 получил явное NOT VERIFIED
терминальное состояние с WARNING.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-16 13:24:34 +03:00
ddadminandClaude Opus 4.6 d9c78861e2 fix(skill): устойчивость multi-round ревью при нестабильном Agent Teams
SendMessage для тиммейтов Agent Teams работает нестабильно: может быть
недоступен как инструмент или создавать нового агента без контекста.

Step 5 теперь проверяет доступность тиммейта перед отправкой. Если
тиммейт неактивен — спрашивает оператора (interactive) или завершает
со статусом "fixes applied, not re-verified" (headless). Re-spawn
доступен как опция, не как дефолт.

Также: multi-round секция в adversarial-reviewer.md, исправленные
пути установки в README, убраны ложные утверждения о statefulness.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-16 12:18:52 +03:00
ddadminandClaude Opus 4.6 a1e20f9c84 docs(experiment): добавлен вывод о сравнительной ценности ревью
- Зачем:
  - зафиксировать оценку: чьё ревью ценнее по влиянию на план.
- Что:
  - добавлен вывод #4: Opus ценнее для плана (спасает от провала
    реализации), Codex ценнее для продакшена (ловит security/ops).
  - существующий вывод "оба нужны" стал #5.
- Проверка:
  - просмотр секции "Выводы" в EXPERIMENT.md.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-09 23:09:23 +03:00
ddadminandClaude Opus 4.6 e7d77ac47d docs(experiment): добавлено послесловие — фича не нужна, эксперимент ценнее
- Зачем:
  - зафиксировать вывод о целесообразности persistent memory для
    полноты фактуры.
- Что:
  - добавлена секция "Послесловие: стоило ли реализовывать план?"
    с аргументами против и выводом, что эксперимент оказался ценнее фичи.
- Проверка:
  - просмотр EXPERIMENT.md.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-09 22:10:21 +03:00
ddadminandClaude Opus 4.6 e8767515d6 docs(experiment): расширена фактура эксперимента для будущей статьи
- Зачем:
  - подробно задокументировать ход и детали эксперимента, чтобы
    использовать как фактуру для статьи на Habr.
- Что:
  - добавлена предыстория (как эксперимент возник из тестирования скилла).
  - описана техническая механика обоих подходов (Agent Teams vs Codex CLI).
  - добавлена сводная таблица последовательного ревью (13 находок рядом).
  - расширена таблица характера мышления (фокус, ценные/слабые находки,
    характер фиксов, пересечения).
  - добавлены детали фиксов для обоих ревьюеров.
  - добавлены дословные цитаты из момента осознания методологической ошибки.
  - добавлены наблюдения по ходу работы и раздел "что бы сделал иначе".
- Проверка:
  - просмотр EXPERIMENT.md в репозитории.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-09 22:07:15 +03:00
ddadminandClaude Opus 4.6 47b9fb72a2 docs(experiment): добавлен эксперимент сравнения Opus и Codex ревьюеров
- Зачем:
  - задокументировать эмпирическое сравнение двух adversarial-ревьюеров
    (Claude Opus vs GPT-5.4) на одном плане — материал для статьи на Habr.
- Что:
  - добавлен EXPERIMENT.md с полным ходом эксперимента: последовательное
    и параллельное ревью, все находки обоих моделей, анализ пересечений,
    характеристики мышления моделей, выводы и ограничения.
  - в README.md добавлена секция "Эксперимент: сравнение ревьюеров"
    со ссылкой на EXPERIMENT.md.
- Проверка:
  - просмотр EXPERIMENT.md и README.md в репозитории.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-09 21:14:36 +03:00
ddadminandClaude Opus 4.6 f15052d15a fix(skill): убрана превентивная проверка env-переменной Agent Teams
- Зачем:
  - проверка через Bash триггерила permission prompt, создавая лишний UX-барьер до начала работы.
- Что:
  - удалена секция Prerequisites check с явной проверкой CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS.
  - добавлен fallback: если спавн тиммейта не удался — сообщить пользователю, как включить Agent Teams.
  - добавлена рекомендация не создавать вспомогательные файлы (memory, state, logs).
- Проверка:
  - /claude-team-review — не должно быть промпта на echo $ENV_VAR.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-09 20:08:45 +03:00
ddadminandClaude Opus 4.6 c922800bd0 feat(skill): добавлен скилл adversarial review через Agent Teams
- Зачем:
  - реализация adversarial code/plan review без внешних зависимостей, целиком внутри Claude Code Agent Teams.
- Что:
  - добавлен SKILL.md — основной скилл claude-team-review с логикой авто-определения режима, итеративного ревью (до 5 раундов) и stateful тиммейта.
  - добавлен adversarial-reviewer.md — определение тиммейта-ревьюера (read-only, Opus, adversarial stance).
  - добавлен README.md с описанием, установкой и сравнением с adversarial-review (Codex).
  - добавлена лицензия Apache-2.0.
- Проверка:
  - /claude-team-review в проекте с включённым CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-04-09 19:48:51 +03:00