инструменты 1 мин

Anthropic выпустила Claude Security — плагин для поиска уязвимостей прямо в терминале

Anthropic запустила бета-версию Claude Security — плагина для Claude Code, который сканирует код на уязвимости с помощью мультиагентной системы. Плагин работает прямо в терминале, находит проблемы безопасности в репозитории или отдельных коммитах, а затем генерирует патчи, которые разработчик проверяет и применяет сам. Каждая находка проходит трёхступенчатую верификацию независимыми AI-агентами перед попаданием в отчёт.

Это первая попытка встроить полноценный security-аудит в ежедневный workflow разработки через AI, причём с архитектурой, которая сама себя проверяет. Если сработает, снизит порог входа в code security для команд без dedicated security-специалистов.

Claude Security: AI-аудитор безопасности в терминале

Anthropic запустила бета-версию Claude Security — плагина для Claude Code, который превращает IDE в станцию анализа безопасности с мультиагентной архитектурой.

Как это работает

Плагин добавляет одну команду /claude-security с тремя режимами: - Scan codebase — полный аудит репозитория или его части - Scan changes — проверка diff'а ветки, PR или коммита перед пушем - Suggest patches — автогенерация .patch-файлов для найденных уязвимостей

Установка — две строки из официального маркетплейса Anthropic.

Мультиагентный конвейер

Сканирование проходит через шесть фаз: инвентаризация компонентов, моделирование угроз, исследование по четырём категориям (инъекции, авторизация, небезопасная память, криптография), gap-заполнение, панель верификации и адверсальная проверка.

Система использует модели по уровням задач: Opus для оркестратора, Sonnet для навигации по коду, модель текущей сессии — для исследователей.

Ключевая фишка — трёхступенчатая верификация. Каждая находка проходит через три независимых AI-верификатора с разными линзами: REACHABILITY (достижимость), IMPACT (влияние), DEFENSES (защиты). Чтобы попасть в отчёт, нужно 2 из 3 голосов. Единогласие даёт уверенность «high», простое большинство — «medium».

Что получаешь на выходе

Каждое сканирование создаёт timestamped-директорию с: - Markdown-отчётом с ID находок, severity, CWE ID, строками кода и сценариями эксплуатации - JSONL-версией для автоматизации - Revision stamp — метаданные скана с проверяемым статусом верификации

Патчи генерируются в отдельном клоне репозитория, чтобы не трогать рабочее дерево. Независимый агент проверяет каждый патч и прогоняет тесты проекта перед тем, как предложить его разработчику.

Масштабируемость

Четыре уровня глубины: low, medium, high, max. На максимуме система обрабатывает до 24 компонентов, использует по 2 исследователя на каждую ячейку матрицы и проводит red-team атаки на выжившие находки.

Плагин open source, версия 0.10.0 доступна в репозитории claude-plugins-official.

Ключевые выводы

  • Первый AI-инструмент безопасности с встроенной трёхступенчатой верификацией находок через независимых агентов
  • Сканирование масштабируется от быстрой проверки diff'а перед коммитом до полного аудита с red-team атаками
  • Система различает языки: для memory-safe (Python, TypeScript) отключает проверку небезопасной работы с памятью
  • Патчи генерируются в изолированном клоне и тестируются перед предложением — рабочее дерево остаётся чистым
  • Отчёт содержит проверяемую метаинформацию о качестве верификации, а не просто заявления модели

Автор: Павел Заславский · Источник: marktechpost.com

Мнение редакции

Интересно не то, что AI ищет уязвимости — это уже делают десятки сервисов. Интересна **архитектура недоверия к самому себе**: три независимых верификатора спорят о каждой находке, причём счёт ведёт Python-скрипт, а не модель, которая нашла проблему. Это редкая попытка сделать AI-инструмент, который сам объясняет, насколько себе доверяет.

Осторожнее стоит быть с ожиданиями эффективности. Даже на максимальных настройках система обрабатывает до 24 компонентов — для крупного монолита это капля в море. И неясно, как она справляется с бизнес-логикой, где уязвимости часто прячутся в комбинации формально безопасных операций. Тем не менее, как zero-cost first-pass для команд без секьюрити-специалистов — любопытная штука. Особенно фишка с проверкой diff'а перед коммитом — это может реально встроиться в привычку.

Инструменты из статьи

Агентный кодинг в терминале от Anthropic: сам пишет, тестирует и правит код...

Доступ из РФ →

Ещё по теме

Комментарии