Я попытался доказать превосходство одной AI-модели над другой. Вот что произошло на самом деле
Автор решил сравнить две AI-модели (ChatGPT и Kimi K3) не по бенчмаркам, а на реальной задаче — поиске багов в коде. Он подготовил программу с неочевидной race condition в асинхронном rate limiter'е и прогнал одинаковый запрос через каждую модель по три раза, получив неожиданные результаты.
0
87