Grok 4.7 обставила GPT-5.6 Sol в тестах по программированию
SpaceXAI выпустила Grok 4.7, и новичок сразу ввязалась в сравнение с топовыми системами для кода. На CursorBench 4.0 она выбила на 4,6 процентного пункта больше, чем GPT-5.6 Sol от OpenAI, хотя до Fable 5.1 от Anthropic не дотянула — отставание 5,5 п.п.
Секрет, по данным SpaceXAI, в новом подходе к обучению. Grok 4.7 учили на более крупной базовой модели и задачах, которые у человека отнимали бы часы. Вдобавок система лучше держит длинный контекст и чаще перепроверяет свои ответы.
Есть и ещё одна приметная черта — переработанная защита. По данным SpaceXAI, в тестах Grok 4.7 пропустила лишь 3,3% опасных запросов и при этом почти не мешала обычным задачам в кибербезопасности.
В рабочих сценариях вышло неоднозначно. Там, где нужно готовить документы, презентации и прочую офисную рутину, Grok 4.7 обошла GPT-6 Astra, но проиграла Fable 5.1. Зато SpaceXAI утверждает, что по соотношению цены и результата в программировании новая модель тоже переиграла систему OpenAI.
Проверить Grok 4.7 уже можно в Cursor и внутри Grok Build. Какое-то время доступ в Grok Bot будет бесплатным, но срок SpaceXAI не назвала. В API модель стоит $2 за миллион входных токенов и $6 за миллион выходных при контексте до 500 тыс. токенов; за более длинный контекст придётся отдать $4 и $12.
Выход Grok 4.7 показывает: гонка ИИ всё заметнее уходит от общих обещаний к конкретным задачам и цене их решения. Разработчикам это даёт больше вариантов, а рынку — ещё более ожесточённую борьбу моделей за реальные рабочие процессы.
—
Телеграм про право в IT и AI. IT юристы — PravoWeb.com