Новая модель Anthropic достигла успеха на бенчмарке ARC-AGI-2

Модель от Anthropic продемонстрировала впечатляющий результат на тесте ARC-AGI-2, показав 68,8% в тесте абстрактного мышления. Примечательно, что год назад все ИИ-модели на этом тесте получили нулевые значения, тогда как живые участники продемонстрировали средний результат 60%. Стоимость одной задачи составила $3,64, а результаты были проверены командой ARC Prize на ограниченном наборе задач. Тест ARC-AGI-2, разработанный Франсуа Шолле, создателем Keras, запущен в марте 2025 года, и его цель — оценка способности обобщения моделей через визуальные головоломки.