
Grok 4.6 вышел и сравнялся с GPT-5.6 Sol по общему индексу Artificial Analysis
Главный фокус обновления в долгих агентных задачах. Модель лучше удерживает работу на десятках шагов, исследует информацию, работает с большими кодовыми базами, собирает приложения и сама проверяет результат.
По цифрам прирост относительно Grok 4.5 заметный. AA Intelligence вырос с 56 до 61 балла, CursorBench с 66.7% до 69.9%, DeepSWE с 54% до 65.9%, Terminal-Bench с 15.7% до 26%.
На FrontierCode модель набрала 61.3% против 60.6% у GPT-5.6 Sol. На APEX-Agents результат 57.5% против 56.7%. При этом на DeepSWE GPT-5.6 Sol остается впереди с 73%.
Отдельно прокачали создание интерфейсов и приложений. Grok 4.6 может получить общую идею продукта, изучить незнакомую область, собрать рабочую первую версию, а затем самостоятельно тестировать и улучшать ее по ходу работы.
Модель уже доступна в Grok Build, Cursor, API, OpenRouter, Vercel и Cloudflare. Цена начинается с $2 за миллион входных токенов и $6 за миллион выходных. Быстрая версия стоит в два раза дороже.
Ежедневные подборки промптов, свежие новости и материалы об ИИ — там, где удобно. Без спама, только редакционный отбор.