Подразделение SpaceXAI Илона Маска анонсировало Grok 4. 7 — новую флагманскую модель искусственного интеллекта, предназначенную в первую очередь для программирования и научных исследований. По заявлению разработчика, модель сочетает высокую скорость работы с конкурентоспособной ценой.
Результаты тестирования
В бенчмарке CursorBench 4. 0, оценивающем длительные задачи по написанию кода, Grok 4. 7 набрала 46, 3%, превзойдя Grok 4. 6 (40, 4%) и GPT-5. 6 Sol (41, 7%). В тесте DeepSWE v1. 1 модель показала 71%, немного уступив GPT-5. 6 Sol (72, 7%), но обойдя Fable 5. 1 (70%). В Terminal-Bench 4. 0 результат вырос с 20, 3% до 38%.
Модель прошла более длительное обучение с подкреплением на сложных многочасовых задачах, что позволило ей лучше проверять собственные результаты и управлять длинным контекстом. Обновлённый набор средств безопасности обеспечил лучшие в семействе показатели устойчивости ко взлому. В HackerBench v0. 3 модель пропустила лишь 3, 3% рискованных запросов двойного назначения, редко блокируя легитимные задачи по кибербезопасности. В LatchBio она заняла первое место с результатом 62, 4%.
Grok 4. 7 уже доступна в Cursor, Grok Build, через API, в сторонних кодинг-агентах и на облачных платформах. Цена составляет от $2 за 1 млн входных и $6 за 1 млн выходных токенов. Fast-версия вдвое быстрее, но и вдвое дороже. Изначально релиз планировался на конец августа, затем на 11 сентября, но в итоге состоялся 21 сентября. Настоящий скачок Маск обещает в Grok 4. 8 и 4. 9.

Комментарии
Оставляйте комментарии, отвечайте другим пользователям, ставьте плюсы и минусы и добавляйте быстрые реакции.
Войдите в аккаунт, чтобы оставлять комментарии, отвечать другим пользователям и ставить реакции.