Anthropic выпустила Claude Security — плагин для поиска уязвимостей прямо в терминале
Anthropic запустила бета-версию Claude Security — плагина для Claude Code, который сканирует код на уязвимости с помощью мультиагентной системы. Плагин работает прямо в терминале, находит проблемы безопасности в репозитории или отдельных коммитах, а затем генерирует патчи, которые разработчик проверяет и применяет сам. Каждая находка проходит трёхступенчатую верификацию независимыми AI-агентами перед попаданием в отчёт.
Это первая попытка встроить полноценный security-аудит в ежедневный workflow разработки через AI, причём с архитектурой, которая сама себя проверяет. Если сработает, снизит порог входа в code security для команд без dedicated security-специалистов.
Claude Security: AI-аудитор безопасности в терминале
Anthropic запустила бета-версию Claude Security — плагина для Claude Code, который превращает IDE в станцию анализа безопасности с мультиагентной архитектурой.
Как это работает
Плагин добавляет одну команду /claude-security с тремя режимами:
- Scan codebase — полный аудит репозитория или его части
- Scan changes — проверка diff'а ветки, PR или коммита перед пушем
- Suggest patches — автогенерация .patch-файлов для найденных уязвимостей
Установка — две строки из официального маркетплейса Anthropic.
Мультиагентный конвейер
Сканирование проходит через шесть фаз: инвентаризация компонентов, моделирование угроз, исследование по четырём категориям (инъекции, авторизация, небезопасная память, криптография), gap-заполнение, панель верификации и адверсальная проверка.
Система использует модели по уровням задач: Opus для оркестратора, Sonnet для навигации по коду, модель текущей сессии — для исследователей.
Ключевая фишка — трёхступенчатая верификация. Каждая находка проходит через три независимых AI-верификатора с разными линзами: REACHABILITY (достижимость), IMPACT (влияние), DEFENSES (защиты). Чтобы попасть в отчёт, нужно 2 из 3 голосов. Единогласие даёт уверенность «high», простое большинство — «medium».
Что получаешь на выходе
Каждое сканирование создаёт timestamped-директорию с: - Markdown-отчётом с ID находок, severity, CWE ID, строками кода и сценариями эксплуатации - JSONL-версией для автоматизации - Revision stamp — метаданные скана с проверяемым статусом верификации
Патчи генерируются в отдельном клоне репозитория, чтобы не трогать рабочее дерево. Независимый агент проверяет каждый патч и прогоняет тесты проекта перед тем, как предложить его разработчику.
Масштабируемость
Четыре уровня глубины: low, medium, high, max. На максимуме система обрабатывает до 24 компонентов, использует по 2 исследователя на каждую ячейку матрицы и проводит red-team атаки на выжившие находки.
Плагин open source, версия 0.10.0 доступна в репозитории claude-plugins-official.
Ключевые выводы
- Первый AI-инструмент безопасности с встроенной трёхступенчатой верификацией находок через независимых агентов
- Сканирование масштабируется от быстрой проверки diff'а перед коммитом до полного аудита с red-team атаками
- Система различает языки: для memory-safe (Python, TypeScript) отключает проверку небезопасной работы с памятью
- Патчи генерируются в изолированном клоне и тестируются перед предложением — рабочее дерево остаётся чистым
- Отчёт содержит проверяемую метаинформацию о качестве верификации, а не просто заявления модели
Автор: Павел Заславский · Источник: marktechpost.com
Интересно не то, что AI ищет уязвимости — это уже делают десятки сервисов. Интересна **архитектура недоверия к самому себе**: три независимых верификатора спорят о каждой находке, причём счёт ведёт Python-скрипт, а не модель, которая нашла проблему. Это редкая попытка сделать AI-инструмент, который сам объясняет, насколько себе доверяет.
Осторожнее стоит быть с ожиданиями эффективности. Даже на максимальных настройках система обрабатывает до 24 компонентов — для крупного монолита это капля в море. И неясно, как она справляется с бизнес-логикой, где уязвимости часто прячутся в комбинации формально безопасных операций. Тем не менее, как zero-cost first-pass для команд без секьюрити-специалистов — любопытная штука. Особенно фишка с проверкой diff'а перед коммитом — это может реально встроиться в привычку.
Инструменты из статьи
Агентный кодинг в терминале от Anthropic: сам пишет, тестирует и правит код...
Доступ из РФ →
Комментарии