Запускаем GPT-5.6 Sol на задачах ARC-AGI-2 и сравниваем результат с таблицей ARC Prize. Ниже — цифры, задания и ответы модели. Исходные данные и методика открыты.
GPT-5.6 Sol · medium · ARC-AGI-2 public evaluation
Результаты модели могут меняться от запуска к запуску. Такая разница может быть связана с этим разбросом; его диапазон для этих прогонов отдельно не измерялся.
Сравниваем полностью решённые задачи без частичных баллов. 65% рассчитаны по отметкам ARC Prize в разделе ARC-AGI-2 Public Eval. Наш средний балл с частичными решениями — 67,778%.
Задачи и правильные решения подготовлены авторами ARC-AGI-2. Мы публикуем ответы модели, включая ошибки, параметры запуска и методику подсчёта.
В каждой задаче нужно найти правило по примерам и собрать картинку из цветных клеток. Выберите миниатюру ниже: справа откроются задание и ответ модели.
Загружаем задачи из опубликованного прогона…
Проверьте со своего компьютера
CLI сделает 10 запросов через CheapGPT и измерит время до первого токена. Вы выберете модель и увидите результат своего подключения.
75 задач решены полностью, 13 частично, 32 не решены. Средняя оценка с учётом частичных решений: 67,778%. Это результаты прогона GPT-5.6 Sol от 4 сентября 2026 года.