SpaceXAI выпустила Grok 4.6 для программирования, исследований и задач, которые требуют много последовательных действий. Модель сможет учитывать до 500 тыс. токенов в контексте одного запроса.
Предыдущую Grok 4.5 компания уже ориентировала на долгую работу с кодом и документами. Но в таких задачах модели нужно не только дать ответ, а удерживать цель на протяжении многих шагов, обращаться к инструментам и проверять промежуточный результат. Поэтому в новой версии SpaceXAI сосредоточилась на создании рабочих прототипов, анализе больших объемов информации и самопроверке.
В сводном индексе Artificial Analysis, который объединяет девять тестов, Grok 4.6 получила 61 балл против 56 у Grok 4.5. Модель сравнялась с GPT-5.6 Sol, но уступила один балл Fable 5 Max. В тесте работы с кодом CursorBench новая Grok набрала 69,9% против 67,2% у GPT-5.6 Sol, однако в DeepSWE результат оказался ниже: 65,9% против 73%. SpaceXAI использовала данные разработчиков моделей и публичных рейтингов, поэтому эти цифры не гарантируют такое же соотношение на каждой реальной задаче.

По заявлению компании, Grok 4.6 сможет изучить незнакомую тему, продумать структуру приложения, собрать основные функции и доработать результат после обратной связи. Во время длинных заданий модель сможет чаще проверять собственную работу перед следующим шагом.
Grok 4.6 уже появилась в Cursor, Grok Build, программном интерфейсе SpaceXAI, OpenRouter, Vercel и Cloudflare.
Источник: SpaceXAI