Агент на LangGraph, который сам чинит упавшие тесты — мой опыт
Построил агента: видит красный CI, читает трейс, лезет в код, правит, гоняет тесты локально, открывает PR. Цикл до 5 итераций.
На простых падениях (типизация, импорты, мелкая логика) чинит сам в ~60% случаев. Сложное эскалирует человеку с готовым разбором.
Главная боль была не в LLM, а в песочнице и лимитах на итерации, чтобы он не крутился вечно и не жёг деньги.
Комментарии