Китайская компания Z.ai анонсировала GLM-5.1 — обновление своей флагманской модели, которое заняло первое место на SWE-Bench Pro с результатом 58,4 балла, обойдя GPT-5.4, Claude Opus 4.6 и Gemini 3.1 Pro. Важнее всего не только цифры, но и концепция: Z.ai создала модель, способную долго оставаться эффективной, анализируя и улучшая свои результаты на протяжении множества итераций.
В ходе тестирования GLM-5.1 справилась с задачами, которые обычно вызывали трудности у предыдущих моделей. Например, в одном из сценариев ей удалось создать полноценное веб-приложение, имитирующее Linux, за восемь часов. В другом эксперименте GLM-5.1 достигла рекорда в 21,5 тысячи запросов в секунду, обновив предыдущий рекорд почти в шесть раз. В тесте на оптимизацию GPU-ядер модель показала ускорение в 3,6 раза, но пока уступает Claude Opus 4.6.
GLM-5.1 доступна для подписчиков GLM Coding Plan и совместима с несколькими платформами, но требует оптимизации для долгосрочных задач. Основная цель Z.ai — создать модель, способную к постоянному улучшению.