Superpowers, GSD и GSTACK: какой фреймворк оркестрации выбрать для AI-агента

· 2 мин чтения
ai-agents orchestration review claude-code
Superpowers, GSD и GSTACK: какой фреймворк оркестрации выбрать для AI-агента

AI-кодинг-агенты впечатляют первые 30 минут. Потом всё идёт наперекосяк. Контекстное окно заполняется, и агент забывает первоначальные требования. Код выглядит правдоподобно, но без тестов — это бомба замедленного действия. Агент решает добавить «полезные» фичи, о которых никто не просил.

Три команды независимо друг от друга создали фреймворки, решающие эти проблемы: Superpowers, GSD и GSTACK. Все три начинались с Claude Code, но теперь работают с Cursor, Codex, Windsurf, Gemini CLI и другими.

Общая проблема

Все три фреймворка бьют в три одни и те же боли:

Контекстное гниение. LLM имеет ограниченное контекстное окно. Через два часа и 200K токенов агент создаёт новые ресурсы без требований, которые вы задали в начале. Инструкции теряют вес по мере заполнения окна.

Отсутствие тестовой дисциплины. Агент пишет код, который выглядит правдоподобно. Компилируется, даже работает — какое-то время. Но без тестов новая фича тихо ломает две старые.

Расширение.scope. Вы просите VPC с тремя подсетями, а получаете ещё NAT gateway, transit gateway, VPN endpoint и DNS-резолвер. Платить за это будете вы.

Superpowers: дисциплина TDD

Superpowers создал Jesse Vincent. Более 149K звёзд на GitHub. Главная идея: никакого продакшн-кода без сначала упавшего теста.

Фреймворк enforcing 7-фазный воркфлоу: brainstorm → spec → plan → TDD → subagents → review → finalize. Между фазами — ворота, перепрыгнуть нельзя. Продакшн-код существует только для того, чтобы упавший тест прошёл.

Skill Фаза Что делает
brainstorming Design Уточняет идеи через сократические вопросы
writing-plans Planning Декомпозирует на задачи по 2-5 минут
test-driven-development Implementation RED-GREEN-REFACTOR
subagent-driven-development Implementation Запускает субагента на каждую задачу
requesting-code-review Review Проверяет соответствие плану
finishing-a-development-branch Finalize Проверяет тесты, предлагает merge/PR

Мейнтейнер chardet переписал chardet v7.0.0 с нуля через Superpowers — получил 41x ускорение. Не 41%, а в 41 раз. Когда каждый кусок кода проходит через тест, агент оптимизирует агрессивно, потому что есть страховка.

Минус: мега-оркестратор может упереться в лимит контекста на очень длинных сессиях с десятками файлов.

Поддерживает: Claude Code, Cursor, Codex, OpenCode, GitHub Copilot CLI, Gemini CLI.

GSD: защита от контекстного гниения

GSD (Get Shit Done) создал Lex Christopherson. Более 51K звёзд. GSD атакует проблему контекстного окна напрямую.

Примечание: После странной выходки автора, контрибьюторы решили форнуть проект и развивать отдельно:
GSD (Get. Ship. Done.)

Ключевое архитектурное решение: отдельный оркестратор на каждую фазу работы. Каждый оркестратор не превышает 50% контекстной ёмкости. Когда фаза завершается, оркестратор записывает состояние на диск (XML-формат — LLM парсят его надёжнее, чем Markdown), а свежий оркестратор подхватывает с того же места.

Команда Что делает
/gsd-new-project Полная инициализация: вопросы, исследования, требования, roadmap
/gsd-discuss-phase Фиксация решений перед планированием
/gsd-plan-phase Исследование, план и верификация одной фазы
/gsd-execute-phase Параллельное выполнение планов
/gsd-verify-work Ручное пользовательское тестирование
/gsd-ship Создание PR из верифицированной работы
/gsd-fast Быстрые задачи без планирования

GSD эволюционировал от v1 (чистый Markdown) до v2 (TypeScript SDK), что говорит об уровне инженерной проработки.

Минус: больше церемоний, чем у конкурентов. Для быстрого скрипта или правки одного файла — overkill. GSD окупается на проектах, которые охватывают несколько файлов, сессий или дней.

Поддерживает 14+ агентов: Claude Code, Cursor, Windsurf, Codex, Copilot, Gemini CLI, Cline, Augment, Trae, Qwen Code и другие.

GSTACK: ролевая модель для целой команды

GSTACK создал Garry Tan (CEO Y Combinator). Более 71K звёзд. Принципиально другой подход: вместо дисциплинирования одного агента GSTACK моделирует команду из 23 специалистов — CEO, PM, QA, инженер, дизайнер, security reviewer и так далее.

Каждая роль видит только нужный ей контекст. Инженер не видит продуктовый roadmap. QA не видит детали реализации. Это не просто эффективность — это предотвращение scope creep, когда агент, знающий всё, пытается делать всё.

Принцип «boil the lake» — любимый у автора оригинальной статьи. Вместо того чтобы пытаться сделать всё и выдать посредственный результат, каждая роль делает меньше, но качественнее.

Команда Роль Что делает
/office-hours YC partner Шесть вопросов, переформулирующих продукт до кода
/plan-ceo-review CEO 4 режима: расширить, выборочно расширить, держать, сократить
/plan-eng-review Eng manager Фиксирует архитектуру, мапит данные
/review Staff engineer Ищет баги, которые проходят CI, но ломаются в проде
/qa QA lead Реальное тестирование через Playwright
/ship Release engineer Деплой с аудитом покрытия
/cso Security officer OWASP и STRIDE аудиты

Минус: 23 роли — тяжеловесно для чистой инфраструктурной работы. GSTACK shines при создании продукта, а не при provisioning ресурсов.

Поддерживает: Claude Code, Codex CLI, OpenCode, Cursor, Factory Droid, Slate, Kiro.

Когда что выбирать

Что ломается Решение Почему
Код работает сегодня, ломается завтра Superpowers Каждое изменение через failing test
Качество падает через час GSD Свежий контекст на каждую фазу
Шлёте фичи, о которых не просили GSTACK Продуктовый review до инженерии

Честная рекомендация из статьи: ни один фреймворк не универсален. Знайте свой типичный failure mode — он и определяет выбор.

Для комбинирования: GSTACK для направления + Superpowers для TDD — на сегодняшний день лучший из известных вариантов.

Установка

# Superpowers
/plugin install superpowers@claude-plugins-official

# GSD (установщик спросит про агенты и тип установки)
npx get-shit-done-cc@latest

# GSTACK
git clone --single-branch --depth 1 https://github.com/garrytan/gstack.git ~/.claude/skills/gstack && cd ~/.claude/skills/gstack && ./setup

Инструкции для других агентов — в README каждого репозитория. Попробуйте один фреймворк на реальном проекте — через час будет понятно, решает ли он ваш конкретный failure mode.

Источник: https://www.pulumi.com/blog/claude-code-orchestration-frameworks/