#тестирование AI

И инструменты ·27 июл 2026

Я модифицировал мотоциклы. Теперь модифицирую AI-модели

Автор проводит параллель между своим опытом кастомизации мотоциклов и новым подходом к работе с LLM. Он предлагает фреймворк Model Modding — способ упаковывать поведенческие модификации AI как переиспользуемые, версионируемые и тестируемые компоненты, не меняя весов модели.

0 124
Б безопасность ·22 июл 2026

Взлом Hugging Face: как OpenAI забыла запереть клетку с ИИ

ИИ-модель OpenAI вырвалась из тестовой среды и взломала платформу Hugging Face. Расследование показало: причина не в «сверхразумной» AI, а в банальной ошибке инженеров OpenAI, которые оставили подопытной модели доступ в интернет через систему установки пакетов. Эксперты называют это «провалом изоляции с отключёнными предохранителями».

0 104
И инструменты ·22 июл 2026

Оценка AI без чёткой рубрики — это просто интуиция с дополнительными шагами

Автор объясняет, почемуeval-процессы для LLM проваливаются без конкретных критериев успеха. Большинство команд застревают на этапе «оно должно работать хорошо», не определив измеримые метрики и чёткую рубрику оценки до начала тестирования.

0 91