Сравнение фреймворков агентных навыков: 11 фреймворков, 3 слоя, 1 стандарт
Рынок фреймворков навыков для AI-агентов кодинга сформировался за последние полгода. Это новая инфраструктурная категория, решающая задачу: как заставить агентов следовать структурированным процессам, а не импровизировать. Исследователь Ry Walker разобрал 11 фреймворков и выделил три слоя экосистемы.
Три слоя экосистемы
Рынок делится на три уровня:
- Методологические фреймворки — Superpowers, BMAD, Spec Kit — навязывают полную дисциплину разработки с обязательными воротами между фазами
- Официальные каталоги — Anthropic Skills, OpenAI Skills, Google Gemini Skills — библиотеки готовых навыков без принуждения
- Платформы оркестрации — Claude-Flow, wshobson/agents, Babysitter — координация нескольких агентов на одной кодовой базе
Стандарты AGENTS.md (контекст проекта, загружается всегда) и SKILL.md (задачные навыки, загружаются по требованию) связывают все три слоя. SKILL.md поддерживают 11+ платформ: Claude Code, Cursor, Copilot, Codex, Gemini CLI, Kiro, Amp, Manus, OpenCode, Goose, Roo Code.
Какой фреймворк выбрать
Соло или 2-3 человека, новый проект — Superpowers. Навязывает brainstorm → plan → TDD → review, ставится за минуты. Минус: избыточность для команд с уже устоявшейся дисциплиной.
Команда 5-20 человек с agile-процессом — BMAD Method. 12+ агентных персонажей (PM, архитектор, разработчик, QA) покрывают полный жизненный цикл. Минус: раздувание для команд до 5 человек.
Специфицированная разработка с approval gates — GitHub Spec Kit. Четыре фазы: /specify → /plan → /tasks → /implement с подтверждением между каждой. Минус: негибкость для исследовательской работы.
Просто библиотека навыков — Anthropic Skills. Самый широкий каталог, ставится одной командой. Минус: навыки сами по себе не навязывают дисциплину.
Координация нескольких агентов — wshobson/agents (72 плагина) или Claude-Flow (swarm-топологии). Минус: оркестрация — самый сложный слой, требует значительной настройки.
Методологические фреймворки
| Фреймворк | Звёзды | Форки | Форк-рейт | Проблема |
|---|---|---|---|---|
| Spec Kit | 71K | 6.1K | 8.6% | Жёсткость для итеративной работы |
| Superpowers | 57K | 4.4K | 7.6% | Избыточность для опытных команд |
| BMAD Method | 37K | 4.6K | 12.4% | Раздувание для малых команд |
Общее: обязательные ворота между фазами. Нельзя пропустить мозговой штурм, нельзя писать код до тестов, нельзя мержить без ревью.
Superpowers — самый категоричный, использует принципы влияния Чалдини для предотвращения пропуска шагов. BMAD — самый комплексный, покрывающий весь agile-цикл от идеи до деплоя. Spec Kit — самый структурированный, с CLI-скаффолдингом.
Официальные каталоги
| Каталог | Звёзды | Платформа | Особенность |
|---|---|---|---|
| Anthropic Skills | 73K | Claude Code | Самый широкий каталог, pioneered SKILL.md |
| OpenAI Skills | 9K | Codex CLI | Меньший каталог, три уровня |
| Google Gemini Skills | 1.8K | Gemini CLI | 1 навык, но измеримый эффект |
Google опубликовал данные: gemini-api-dev навык поднял точность кодинга Gemini API до 87% с Flash и 96% с Pro — одно из немногих измерений «до/после» в экосистеме.
Оркестрация
| Платформа | Звёзды | Подход | Сигнал |
|---|---|---|---|
| wshobson/agents | 29K | 72 плагина, агентные команды | 2 открытых issue |
| Claude-Flow | 14K | Swarm, консенсус (Raft, BFT) | 494 открытых issue — красный флаг |
| Babysitter | 317 | Event-sourced, детерминистичный | 2000+ готовых процессов |
| Amplifier (Microsoft) | 3K | Самоулучшающиеся bundles | Исследовательский, не production |
Безопасность: главная проблема
Snyk в исследовании ToxicSkills обнаружил:
- 36% навыков содержат prompt injection — инструкции, перехватывающие поведение агента
- 1467 вредоносных payload'ев в аудированных навыках
- 26% имеют минимум одну уязвимость — prompt injection, эксфильтрация данных, повышение привилегий
От SKILL.md до shell-доступа — три строки markdown. Навыки могут включать скрипты, бинарники, конфигурации. Атакуемая поверхность выходит далеко за пределы markdown.
Рекомендация: относитесь к навыкам как к npm-пакетам 2018 года. Проверяйте перед установкой, предпочитайте официальные каталоги, аудитируйте сторонние навыки. Экосистема пока не имеет подписывания пакетов, пиннинга версий и песочницы.
Ключевые паттерны
Workflow Gate — обязательные человеческие контрольные точки между фазами. Во всех методологических фреймворках.
Subagent Isolation — свежий контекст на задачу. Superpowers, Claude-Flow, BMAD, wshobson/agents — все используют изолированные подагенты.
Self-Improvement — агенты учатся на своей работе. Amplifier ведёт DISCOVERIES.md, Superpowers тестирует навыки против adversarial-сценариев.
Platform Convergence — SKILL.md становится общим стандартом для 11+ платформ.
Практика: тест Superpowers на реальной задаче
Автор статьи установил Superpowers в Next.js-проект для добавления FAQ-секций в MDX-посты.
Что сработало: фаза brainstorm реально предотвратила прыжок к коду. TDD заставил написать тесты валидации контента до парсера. Двухэтапное ревью поймало проблему с JSX-экранированием (<10% парсился как React-компонент).
Что нет: ревью подагентом добавляло ~3 минуты на задачу. Для простых фич — оверхед. Убеждённое принуждение эффективное, но иногда покровительственное.
Вердикт: оправдано для фич, затрагивающих несколько файлов или требующих дизайнерских решений. Избыточно для однострочных правок.
Итог
Практичная связка сегодня: официальный каталог (Anthropic Skills) + методологический фреймворк (Superpowers или BMAD). Оркестрация — наименее зрелый слой. Безопасность — реальная проблема без решений на уровне экосистемы. Все фреймворки молодые (большинство запущены за последние 6-12 месяцев), звёзды накапливаются быстрее production-опыта.