Обновление GLM-5.1 от Z.ai: новый лидер на SWE-Bench Pro

Китайская компания Z.ai анонсировала обновление своей флагманской AI-модели GLM-5.1, которая заняла первое место на бенчмарке SWE-Bench Pro с результатом 58,4 балла, обойдя такие модели, как GPT-5.4 (57,7), Claude Opus 4.6 (57,3) и Gemini 3.1 Pro (54,2). Веса модели опубликованы на HuggingFace под лицензией MIT.

Ключевым аспектом новинки является концепция, позволяющая GLM-5.1 сохранять эффективность на длительном этапе. В отличие от предыдущих моделей, она способна разбивать задачи на подзадачи, проводить эксперименты и пересматривать свою стратегию.

В ходе тестирования модель прошла три сценария с различными уровнями обратной связи. В первом случае GLM-5.1 успешно создала веб-приложение, имитирующее десктоп Linux, за восемь часов. Во втором тесте, связанном с оптимизацией поиска по вектору, модель достигла 21,5 тысячи запросов в секунду, что в шесть раз превышает предыдущий рекорд. Третий сценарий показал ускорение в 3,6 раза при оптимизации GPU-ядер.

GLM-5.1 уже доступна для подписчиков GLM Coding Plan и совместима с Claude Code, OpenCode и другими платформами, хотя разработчики отмечают необходимость дальнейшей оптимизации.