xAI выпустила Grok 4.7 — новую модель, предназначенную для программирования, агентских сценариев и профессиональной работы.
По сравнению с Grok 4.6 в новой версии увеличили базовую модель и заметно продлили RL-посттрейн: в обучение добавили больше задач, рассчитанных на многочасовое выполнение, а модель отдельно учили проверять собственную работу и дольше удерживать контекст.
Приведены результаты на двух бенчмарках: Harvey Legal Agent Benchmark — 19,6% против 15,8%, HealthBench Professional — 56,7% против 48,5%.
Число параметров Grok 4.7 компания не раскрыла. Ещё в июле Илон Маск говорил, что следующая версия должна получить 2,1 трлн параметров, однако переносить эту цифру в спецификацию Grok 4.7 с полной уверенностью нельзя.
Из подтверждённого известно, что у модели новый, более крупный базовый backbone относительно Grok 4.6, более длительное RL-обучение и отдельный акцент на задачах, требующих часов работы. Контекстное окно составляет 500 тыс. токенов, доступны уровни reasoning от low до xhigh.
Цена осталась на уровне Grok 4.6: $2 за 1 млн входных токенов и $6 за 1 млн выходных. В API уже доступен grok-4.7; модель также появилась в Cursor, Grok Build и сторонних роутерах.
Отдельно xAI обновила систему safeguards. Компания называет её полностью новой и утверждает, что Grok 4.7 показал лучшие среди протестированных ею моделей результаты по отказам от опасных запросов и устойчивости к jailbreak. На HackerBench v0.3 модель пропустила 3,3% опасных dual-use запросов, на LatchBio получила 62,4%.