docs(experiment): добавлен эксперимент сравнения Opus и Codex ревьюеров
- Зачем:
- задокументировать эмпирическое сравнение двух adversarial-ревьюеров
(Claude Opus vs GPT-5.4) на одном плане — материал для статьи на Habr.
- Что:
- добавлен EXPERIMENT.md с полным ходом эксперимента: последовательное
и параллельное ревью, все находки обоих моделей, анализ пересечений,
характеристики мышления моделей, выводы и ограничения.
- в README.md добавлена секция "Эксперимент: сравнение ревьюеров"
со ссылкой на EXPERIMENT.md.
- Проверка:
- просмотр EXPERIMENT.md и README.md в репозитории.
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
This commit is contained in:
@@ -149,6 +149,17 @@ and inspecting related code before reporting.
|
||||
- [ ] Integration with CI (GitHub Actions)
|
||||
- [ ] Comparison benchmarks: Codex backend vs Team backend
|
||||
|
||||
## Эксперимент: сравнение ревьюеров
|
||||
|
||||
Мы запустили оба ревьюера (Opus и GPT-5.4) на одном и том же плане
|
||||
и сравнили находки. Ключевой вывод: модели ревьюят из принципиально
|
||||
разных парадигм — Opus как архитектор ("сработает ли этот дизайн?"),
|
||||
Codex как security/ops инженер ("что сломается в продакшене?").
|
||||
Ноль полных совпадений, ~30% частичных пересечений.
|
||||
|
||||
Подробности: [EXPERIMENT.md](EXPERIMENT.md) — полный ход эксперимента,
|
||||
все находки, анализ пересечений, выводы.
|
||||
|
||||
## Related
|
||||
|
||||
- [adversarial-review](https://github.com/dementev-dev/adversarial-review) —
|
||||
|
||||
Reference in New Issue
Block a user