Skip to content
ai tools

Grok 4.7 от xAI — обманчивое обновление

Новейшая модель xAI кажется незначительным обновлением, разочаровавшим фанатов, ожидавших революции. Однако под поверхностью скрываются специализированные достижения, которые обходятся в неожиданно высокую цену.

Nora Vance
Grok 4.7 от xAI — обманчивое обновление

Двигатель мощнее, а скорость та же?

Grok 4.7 появился на рынке с невыразительным звуком, а не с грохотом. Несмотря на значительный предрелизный хайп со стороны Илона Маска, сообщество в основном восприняло новейшую модель xAI как незначительное улучшение по сравнению с Grok 4.6, не сумевшее обеспечить значительный скачок в общих способностях к рассуждению. Многие пользователи сочли модель «разочаровывающей», ссылаясь на такие неприятные моменты, как «неприемлемо плохие» возможности фронтенда, отсутствие 3D-возможностей и «застревание в случайных циклах в стиле Gemini». Она просто не ощущается как передовая модель на фоне конкурентов, таких как GPT-5.6 Sol (max) или Claude Claude Opus.

Однако «под капотом» Grok 4.7 представляет собой существенный архитектурный скачок. Модель может похвастаться новой базовой моделью с 2,1 триллиона параметров, что на 40% больше, чем 1,5 триллиона параметров у Grok 4.6. Этот более крупный фундамент прошел более длительный и сложный цикл обучения с подкреплением, специально нацеленный на многочасовые задачи и улучшенную самопроверку. Она также интегрирует совершенно новый, более мощный стек защиты и расширяет возможности для «Grok Bot harness».

Этот явный разрыв между впечатляющими базовыми характеристиками и воспринимаемой производительностью подчеркивает критическую тенденцию: неравномерный интеллект. Хотя Grok 4.7 действительно демонстрирует значительные успехи в определенных областях, таких как производительность агентов кодирования (оценка 56 по индексу Artificial Analysis Coding Agent Index против 47 у Grok 4.6) и агентская интеллектуальная работа на длинных дистанциях, эти улучшения не превращаются в универсально более умный и стабильно работоспособный пользовательский опыт. Более того, некоторые тесты показывают, что Grok 4.7 рассуждает меньше, чем Grok 4.6 в определенных областях. Кроме того, его достижения обходятся дороже: для некоторых задач он использует более чем вдвое больше выходных токенов по сравнению со своим предшественником.

Новое секретное оружие кодера

Grok 4.7 может разочаровать обычных пользователей, но кодерам стоит обратить на него внимание. Несмотря на прохладные первые впечатления, новейшая модель xAI превосходна в агентской интеллектуальной работе и задачах кодирования, требующих длительной связности. Она резко поднялась в индексе Artificial Analysis Coding Agent Index, с 47 до 56, что является значительным скачком по сравнению с производительностью предшественника.

Данные бенчмарков подтверждают эти целевые победы, демонстрируя, где Grok 4.7 действительно блистает. Он добился значительных успехов в Terminal-Bench 4.0, набрав 38,0% по сравнению с 20,3% у Grok 4.6. Кроме того, он обошел таких грозных конкурентов, как Claude Fable 5.1 Max, в сложном бенчмарке DeepSWE v1.1, показав 71,0% против 65,2%. Это не незначительные улучшения.

Стратегия xAI ясна: позиционировать Grok 4.7 как специализированную рабочую лошадку для разработчиков. Они внедряют глубокие и оперативные интеграции в инструменты, где кодеры смогут по достоинству оценить его специализированные навыки и заметить целевые улучшения. Вы можете найти Grok 4.7 в:

  • Cursor
  • Grok Build
  • GitHub Copilot

Эта прямая интеграция нацелена на пользователей, которые будут использовать его новые сильные стороны, что делает его ценным, пусть и нишевым, обновлением для профессиональных сред разработки.

Скрытая цена мощи Grok

На бумаге Grok 4.7 поначалу выглядит как конкурентоспособное по цене решение. xAI сохранила стандартные цены на API на уровне своего предшественника, Grok 4.6: $2 за миллион входных токенов и $6 за миллион выходных токенов. Это соответствует ценам на такие модели, как Claude Claude Opus, и, по-видимому, предлагает возможности передового уровня без премиальной наценки.

Вот в чем подвох, и он серьезно ударит по вашему кошельку: прирост производительности Grok 4.7 достигается за счет высокой стоимости потребления токенов. Его настройка «xhigh», которая открывает доступ к ранее упомянутой превосходной производительности, расходует более чем в два раза больше токенов, чем Grok 4.6, при выполнении идентичных задач. В частности, Grok 4.7 (xhigh) потребляет около 81 000 выходных токенов на одну задачу Intelligence Index, в то время как Grok 4.6 (xhigh) использовал всего 38 000.

Такой огромный аппетит к токенам означает, что Grok 4.7 на самом деле не является лидером по экономичности. В реальных условиях эксплуатации его операционные расходы часто превышают даже показатели GPT-6 Astra, что делает его значительно дороже предшественника. Более подробную информацию о технических характеристиках и обработке токенов можно найти в Grok 4.7 | SpaceXAI Docs.

Таким образом, Grok 4.7 позиционирует себя не как повседневное бюджетное решение, а как инструмент премиум-класса для специфических, требовательных рабочих процессов. Если вам необходимы его исключительные возможности в агентной интеллектуальной работе и программировании, особенно в сложных долгосрочных задачах, то более высокие затраты могут быть оправданы. В противном случае вы просто переплачиваете за незначительные общие улучшения.

Нравится статья? Получайте такие каждое утро на почту.

одно письмо в день · отписка в два клика · без сторонних трекеров

Место Grok в «гонке вооружений» ИИ

Grok 4.7 явно отстает от современных передовых моделей ИИ. GPT-6 Astra и Claude Fable 5.1 удерживают лидерство в тестах на общий интеллект, набирая 53 и 51 балл соответственно в Artificial Analysis Intelligence Index. Grok 4.7, напротив, набирает лишь 46 баллов, что подчеркивает его текущее положение вне группы ведущих универсальных моделей.

Недавнее заявление Илона Маска о том, что Grok 4.7 примерно равен по уровню более старой модели Anthropic Claude Claude Opus 5.0, сигнализирует о значительном стратегическом сдвиге для xAI. Эта более консервативная позиция отходит от предыдущих гиперболизированных заявлений. Она отражает реалистичную стратегию последовательного, целенаправленного улучшения, ориентированного на агентную интеллектуальную работу и программирование.

В конечном счете, Grok 4.7 — это не та революция, которую многие ожидали, и он не бросает вызов общему интеллекту своих топовых конкурентов. Это стратегически важное обновление, укрепляющее позиции xAI как мощного нишевого игрока в сфере разработки и программирования. Существенный рост показателей в Artificial Analysis Coding Agent Index, поднявшихся с 47 до 56, доказывает его ценность для целевых приложений, даже если он не вошел в высшую лигу универсальных моделей.

Часто задаваемые вопросы

Намного ли Grok 4.7 лучше, чем Grok 4.6?

Grok 4.7 предлагает точечные улучшения, особенно в задачах программирования и агентных задачах, но это не революционный скачок в общих рассуждениях. Для многих пользователей прирост производительности может показаться незначительным, несмотря на более крупную базовую модель.

Как Grok 4.7 соотносится с GPT-6 Astra и Claude Fable 5.1?

Grok 4.7 уступает как GPT-6 Astra, так и Claude Fable 5.1 в тестах на общий интеллект и логические рассуждения. Однако он может превосходить их в специфических тестах по программированию, что позиционирует его как специализированный инструмент, а не как универсальную модель высшего уровня.

Является ли Grok 4.7 более экономичным, чем его конкуренты?

Хотя цена за токен является конкурентоспособной, Grok 4.7 использует значительно больше токенов на задачу, чем его предшественник и конкуренты, такие как GPT-6 Astra. Это может привести к более высоким реальным затратам, сводя на нет кажущуюся выгоду.

Каковы основные сильные стороны Grok 4.7?

Его главные преимущества заключаются в производительности агентного программирования, что подтверждается заметным ростом в таких тестах, как Artificial Analysis Coding Agent Index и DeepSWE. Он также сразу интегрирован в инструменты для разработчиков, такие как Cursor и GitHub Copilot.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Для билдеров

Эта страница работает на чужой инструмент.

Её читают AI-агенты. На неё приходят покупатели. Она отвечает на восьми языках и через MCP. У вашего инструмента может быть такая же — в эфире за 24 часа.