
Z.aiZ.ai выпустила GLM-5.3, и модель получила большой апгрейд именно в агентной работе и кодинге
Во внутреннем тесте Z.ai на реальных задачах программирования результат вырос примерно на 50% относительно GLM-5.2.
В тесте на работу ИИ прямо внутри терминала результат вырос с 4.6 до 28.3. В задачах, где модель должна самостоятельно находить и исправлять ошибки в коде, показатель поднялся с 46.2 до 66.9.
В тестах на полноценную работу с большими репозиториями и реальными программными проектами GLM-5.3 тоже заметно прибавила. Один из результатов вырос с 67.5 до 78.1, другой с 19.4 до 42.5.
Отдельно сильно выросли способности в кибербезопасности. В тестах на поиск и эксплуатацию уязвимостей результат поднялся с 24.4% до 54.4%, а в другом наборе задач с 77.2% до 84.5%.
Причем эти способности появились как побочный эффект обучения модели кодингу и работе с инструментами. Из-за этого Z.ai пока не публикует открытые веса и проводит дополнительную проверку безопасности.
Сейчас GLM-5.3 уже доступна через API и Coding Plan. Открытые веса обещают выпустить через две недели после релиза.
Причем эти способности появились как побочный эффект обучения модели кодингу и работе с инструментами. Из-за этого Z.ai пока не публикует открытые веса и проводит дополнительную проверку безопасности.
Сейчас GLM-5.3 уже доступна через API и Coding Plan. Открытые веса обещают выпустить через две недели после релиза.
Ежедневные подборки промптов, свежие новости и материалы об ИИ — там, где удобно. Без спама, только редакционный отбор.