ASCIITermDraw-Bench: новый бенчмарк проверяет, умеют ли AI-модели рисовать схемы текстом
Исследователи представили ASCIITermDraw-Bench — бенчмарк из 80 задач для оценки способности мультимодальных моделей создавать и редактировать диаграммы в формате ASCII. Лучшие результаты показали Gemini-4-31B-IT (73.8%) и Qwen3.7-Plus (70.2%). Оказалось, что модели могут описывать схемы словами, но точно расставить блоки, стрелки и связи — отдельная сложная задача.
0
71