SpaceXAI выпустила Grok 4.6 для программирования, исследований и задач, которые требуют много последовательных действий. Модель сможет учитывать до 500 тыс. токенов в контексте одного запроса.

Предыдущую Grok 4.5 компания уже ориентировала на долгую работу с кодом и документами. Но в таких задачах модели нужно не только дать ответ, а удерживать цель на протяжении многих шагов, обращаться к инструментам и проверять промежуточный результат. Поэтому в новой версии SpaceXAI сосредоточилась на создании рабочих прототипов, анализе больших объемов информации и самопроверке.

В сводном индексе Artificial Analysis, который объединяет девять тестов, Grok 4.6 получила 61 балл против 56 у Grok 4.5. Модель сравнялась с GPT-5.6 Sol, но уступила один балл Fable 5 Max. В тесте работы с кодом CursorBench новая Grok набрала 69,9% против 67,2% у GPT-5.6 Sol, однако в DeepSWE результат оказался ниже: 65,9% против 73%. SpaceXAI использовала данные разработчиков моделей и публичных рейтингов, поэтому эти цифры не гарантируют такое же соотношение на каждой реальной задаче.

grok 4.6

По заявлению компании, Grok 4.6 сможет изучить незнакомую тему, продумать структуру приложения, собрать основные функции и доработать результат после обратной связи. Во время длинных заданий модель сможет чаще проверять собственную работу перед следующим шагом.

Grok 4.6 уже появилась в Cursor, Grok Build, программном интерфейсе SpaceXAI, OpenRouter, Vercel и Cloudflare.

Источник: SpaceXAI

guest
0 Комментарий
Популярные
Новые Старые
Межтекстовые Отзывы
Посмотреть все комментарии
Поделиться ВКонтакте Telegram