Сравнение фреймворков агентных навыков: 11 фреймворков, 3 слоя, 1 стандарт

· 1 мин чтения
ai-coding review frameworks comparison
Сравнение фреймворков агентных навыков: 11 фреймворков, 3 слоя, 1 стандарт

Рынок фреймворков навыков для AI-агентов кодинга сформировался за последние полгода. Это новая инфраструктурная категория, решающая задачу: как заставить агентов следовать структурированным процессам, а не импровизировать. Исследователь Ry Walker разобрал 11 фреймворков и выделил три слоя экосистемы.

Три слоя экосистемы

Рынок делится на три уровня:

  1. Методологические фреймворки — Superpowers, BMAD, Spec Kit — навязывают полную дисциплину разработки с обязательными воротами между фазами
  2. Официальные каталоги — Anthropic Skills, OpenAI Skills, Google Gemini Skills — библиотеки готовых навыков без принуждения
  3. Платформы оркестрации — Claude-Flow, wshobson/agents, Babysitter — координация нескольких агентов на одной кодовой базе

Стандарты AGENTS.md (контекст проекта, загружается всегда) и SKILL.md (задачные навыки, загружаются по требованию) связывают все три слоя. SKILL.md поддерживают 11+ платформ: Claude Code, Cursor, Copilot, Codex, Gemini CLI, Kiro, Amp, Manus, OpenCode, Goose, Roo Code.

Какой фреймворк выбрать

Соло или 2-3 человека, новый проект — Superpowers. Навязывает brainstorm → plan → TDD → review, ставится за минуты. Минус: избыточность для команд с уже устоявшейся дисциплиной.

Команда 5-20 человек с agile-процессом — BMAD Method. 12+ агентных персонажей (PM, архитектор, разработчик, QA) покрывают полный жизненный цикл. Минус: раздувание для команд до 5 человек.

Специфицированная разработка с approval gates — GitHub Spec Kit. Четыре фазы: /specify → /plan → /tasks → /implement с подтверждением между каждой. Минус: негибкость для исследовательской работы.

Просто библиотека навыков — Anthropic Skills. Самый широкий каталог, ставится одной командой. Минус: навыки сами по себе не навязывают дисциплину.

Координация нескольких агентов — wshobson/agents (72 плагина) или Claude-Flow (swarm-топологии). Минус: оркестрация — самый сложный слой, требует значительной настройки.

Методологические фреймворки

Фреймворк Звёзды Форки Форк-рейт Проблема
Spec Kit 71K 6.1K 8.6% Жёсткость для итеративной работы
Superpowers 57K 4.4K 7.6% Избыточность для опытных команд
BMAD Method 37K 4.6K 12.4% Раздувание для малых команд

Общее: обязательные ворота между фазами. Нельзя пропустить мозговой штурм, нельзя писать код до тестов, нельзя мержить без ревью.

Superpowers — самый категоричный, использует принципы влияния Чалдини для предотвращения пропуска шагов. BMAD — самый комплексный, покрывающий весь agile-цикл от идеи до деплоя. Spec Kit — самый структурированный, с CLI-скаффолдингом.

Официальные каталоги

Каталог Звёзды Платформа Особенность
Anthropic Skills 73K Claude Code Самый широкий каталог, pioneered SKILL.md
OpenAI Skills 9K Codex CLI Меньший каталог, три уровня
Google Gemini Skills 1.8K Gemini CLI 1 навык, но измеримый эффект

Google опубликовал данные: gemini-api-dev навык поднял точность кодинга Gemini API до 87% с Flash и 96% с Pro — одно из немногих измерений «до/после» в экосистеме.

Оркестрация

Платформа Звёзды Подход Сигнал
wshobson/agents 29K 72 плагина, агентные команды 2 открытых issue
Claude-Flow 14K Swarm, консенсус (Raft, BFT) 494 открытых issue — красный флаг
Babysitter 317 Event-sourced, детерминистичный 2000+ готовых процессов
Amplifier (Microsoft) 3K Самоулучшающиеся bundles Исследовательский, не production

Безопасность: главная проблема

Snyk в исследовании ToxicSkills обнаружил:

  • 36% навыков содержат prompt injection — инструкции, перехватывающие поведение агента
  • 1467 вредоносных payload'ев в аудированных навыках
  • 26% имеют минимум одну уязвимость — prompt injection, эксфильтрация данных, повышение привилегий

От SKILL.md до shell-доступа — три строки markdown. Навыки могут включать скрипты, бинарники, конфигурации. Атакуемая поверхность выходит далеко за пределы markdown.

Рекомендация: относитесь к навыкам как к npm-пакетам 2018 года. Проверяйте перед установкой, предпочитайте официальные каталоги, аудитируйте сторонние навыки. Экосистема пока не имеет подписывания пакетов, пиннинга версий и песочницы.

Ключевые паттерны

Workflow Gate — обязательные человеческие контрольные точки между фазами. Во всех методологических фреймворках.

Subagent Isolation — свежий контекст на задачу. Superpowers, Claude-Flow, BMAD, wshobson/agents — все используют изолированные подагенты.

Self-Improvement — агенты учатся на своей работе. Amplifier ведёт DISCOVERIES.md, Superpowers тестирует навыки против adversarial-сценариев.

Platform Convergence — SKILL.md становится общим стандартом для 11+ платформ.

Практика: тест Superpowers на реальной задаче

Автор статьи установил Superpowers в Next.js-проект для добавления FAQ-секций в MDX-посты.

Что сработало: фаза brainstorm реально предотвратила прыжок к коду. TDD заставил написать тесты валидации контента до парсера. Двухэтапное ревью поймало проблему с JSX-экранированием (<10% парсился как React-компонент).

Что нет: ревью подагентом добавляло ~3 минуты на задачу. Для простых фич — оверхед. Убеждённое принуждение эффективное, но иногда покровительственное.

Вердикт: оправдано для фич, затрагивающих несколько файлов или требующих дизайнерских решений. Избыточно для однострочных правок.

Итог

Практичная связка сегодня: официальный каталог (Anthropic Skills) + методологический фреймворк (Superpowers или BMAD). Оркестрация — наименее зрелый слой. Безопасность — реальная проблема без решений на уровне экосистемы. Все фреймворки молодые (большинство запущены за последние 6-12 месяцев), звёзды накапливаются быстрее production-опыта.

Источник: https://rywalker.com/research/agentic-skills-frameworks