Skip to content
ai tools

O Grok 4.7 da xAI é uma atualização enganosa

O modelo mais recente da xAI parece uma pequena atualização, decepcionando os fãs que esperavam uma revolução. Mas, escondidos sob a superfície, existem ganhos especializados que vêm a um custo alto e inesperado.

Nora Vance
O Grok 4.7 da xAI é uma atualização enganosa

Motor maior, mesma velocidade?

O Grok 4.7 chegou com um impacto decepcionante, sem alarde. Apesar do hype significativo pré-lançamento de Elon Musk, a comunidade descartou amplamente o modelo mais recente da xAI como uma melhoria marginal em relação ao Grok 4.6, falhando em entregar um salto significativo nas capacidades gerais de raciocínio. Muitos usuários acharam o modelo "decepcionante", citando experiências frustrantes como capacidades de frontend "inaceitavelmente ruins", capacidades 3D inexistentes e ficar "preso em loops aleatórios ao estilo Gemini". Simplesmente não parecia um modelo de fronteira comparado a concorrentes como GPT-5.6 Sol (max) ou Claude Claude Opus.

Sob o capô, no entanto, o Grok 4.7 representa um salto arquitetônico substancial. Ele ostenta um novo modelo base de 2,1 trilhões de parâmetros, um aumento massivo de 40% em relação aos 1,5 trilhão de parâmetros do Grok 4.6. Esta base maior passou por um ciclo de treinamento de aprendizado por reforço mais longo e difícil, visando especificamente tarefas de várias horas e autoverificação aprimorada. Ele também integra uma pilha de salvaguardas totalmente nova e mais forte e aprimora as capacidades para o "Grok Bot harness."

Essa desconexão gritante entre especificações subjacentes impressionantes e o desempenho percebido destaca uma tendência crítica: inteligência irregular. Embora o Grok 4.7 mostre ganhos significativos em áreas específicas, como desempenho de agente de codificação (pontuando 56 no Artificial Analysis Coding Agent Index, acima dos 47 do Grok 4.6) e trabalho de conhecimento agente de longo prazo, essas melhorias não se traduzem em uma experiência de usuário universalmente mais inteligente e consistentemente capaz. De fato, alguns testes indicam que o Grok 4.7 raciocina menos que o Grok 4.6 em certas áreas. Além disso, seus ganhos vêm a um custo mais alto, usando mais que o dobro de tokens de saída para algumas tarefas em comparação com seu antecessor.

A nova arma secreta do programador

O Grok 4.7 pode decepcionar usuários comuns, mas os programadores devem prestar atenção. Apesar das primeiras impressões mornas, o modelo mais recente da xAI se destaca no trabalho de conhecimento agente e em tarefas de codificação que exigem coerência sustentada. Ele disparou no Artificial Analysis Coding Agent Index, subindo de 47 para 56, um salto significativo em relação ao desempenho de seu antecessor.

Dados de benchmark confirmam essas vitórias direcionadas, mostrando onde o Grok 4.7 realmente brilha. Ele alcançou grandes ganhos no Terminal-Bench 4.0, pontuando 38,0% em comparação com os 20,3% do Grok 4.6. Além disso, superou concorrentes formidáveis como o Claude Fable 5.1 Max no complexo benchmark DeepSWE v1.1, entregando 71,0% contra 65,2%. Estes não são aumentos marginais.

A estratégia da xAI é clara: posicionar o Grok 4.7 como um cavalo de batalha para desenvolvedores especializado. Eles estão impulsionando integrações profundas e imediatas nas ferramentas onde os programadores mais apreciarão suas habilidades especializadas e notarão suas melhorias direcionadas. Você pode encontrar o Grok 4.7 sendo lançado em:

Essa integração direta visa usuários que aproveitarão seus novos pontos fortes, tornando-o uma atualização valiosa, embora de nicho, para ambientes de desenvolvimento profissional.

O custo oculto do poder do Grok

No papel, o Grok 4.7 parece inicialmente uma opção de valor competitivo. A xAI manteve o preço padrão da API idêntico ao de seu antecessor, o Grok 4.6: US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. Isso corresponde ao preço de modelos como o Claude Claude Opus, parecendo oferecer capacidades de nível de fronteira sem um custo premium.

Aqui está o problema, e é um grande problema para o seu bolso: os ganhos do Grok 4.7 vêm a um preço alto em consumo de tokens. Sua configuração 'xhigh', que desbloqueia o desempenho superior discutido anteriormente, queima mais que o dobro de tokens do Grok 4.6 para tarefas idênticas. Especificamente, o Grok 4.7 (xhigh) consome aproximadamente 81.000 tokens de saída por tarefa do Intelligence Index, enquanto o Grok 4.6 (xhigh) usava apenas 38.000.

Esse enorme apetite por tokens significa que o Grok 4.7 não é, na verdade, um líder em custo. No uso real, sua despesa operacional muitas vezes supera até mesmo o GPT-6 Astra, tornando-o significativamente mais caro que seu antecessor. Para mais detalhes sobre suas especificações técnicas e manuseio de tokens, consulte o Grok 4.7 | SpaceXAI Docs.

Portanto, o Grok 4.7 se posiciona não como uma pechincha para o dia a dia, mas como uma ferramenta premium para fluxos de trabalho específicos e exigentes. Se você precisa de seu excepcional trabalho de conhecimento agentico e proeza em codificação, particularmente em tarefas complexas e de longo prazo, a despesa mais alta pode ser justificável. Caso contrário, você está pagando muito mais por melhorias gerais marginais.

Gostando do artigo? Receba um assim na sua caixa de entrada toda manhã.

um e-mail por dia · cancele em dois cliques · sem rastreadores de terceiros

O lugar do Grok na corrida armamentista da IA

O Grok 4.7 claramente fica atrás dos modelos de fronteira de IA atuais. GPT-6 Astra e Claude Fable 5.1 mantêm lideranças dominantes em benchmarks de inteligência geral, pontuando 53 e 51, respectivamente, no Artificial Analysis Intelligence Index. O Grok 4.7, por outro lado, alcança apenas 46, ressaltando sua posição atual fora do grupo líder de generalistas.

A recente caracterização de Elon Musk do Grok 4.7 como aproximadamente equivalente ao antigo Claude Claude Opus 5.0 da Anthropic sinaliza uma mudança estratégica significativa para a xAI. Essa postura mais conservadora se afasta de alegações hiperbólicas anteriores. Ela adota uma estratégia realista de melhoria constante e focada, visando especificamente o trabalho de conhecimento agentico e codificação.

Em última análise, o Grok 4.7 não é a revolução que muitos previam, nem desafia a inteligência geral de seus concorrentes de alto nível. Ele representa uma atualização estrategicamente crucial, consolidando a posição da xAI como um poderoso player de nicho no espaço de desenvolvedores e codificação. Seus ganhos substanciais no Artificial Analysis Coding Agent Index, saltando de 47 para 56, provam seu valor para aplicações direcionadas, mesmo que não tenha entrado no primeiro escalão dos modelos generalistas.

Perguntas Frequentes

O Grok 4.7 é significativamente melhor que o Grok 4.6?

O Grok 4.7 oferece melhorias direcionadas, especialmente para codificação e tarefas agenticas, mas não é um salto revolucionário no raciocínio geral. Para muitos usuários, o salto de desempenho pode parecer incremental, apesar de seu modelo base maior.

Como o Grok 4.7 se compara ao GPT-6 Astra e ao Claude Fable 5.1?

O Grok 4.7 fica atrás tanto do GPT-6 Astra quanto do Claude Fable 5.1 em benchmarks amplos de inteligência e raciocínio. No entanto, ele pode superá-los em benchmarks específicos de codificação, posicionando-o como uma ferramenta especializada em vez de um generalista de alto nível.

O Grok 4.7 é mais econômico do que seus concorrentes?

Embora seu preço por token seja competitivo, o Grok 4.7 usa significativamente mais tokens por tarefa do que seu antecessor e concorrentes como o GPT-6 Astra. Isso pode levar a custos reais mais altos, anulando o valor aparente.

Quais são os principais pontos fortes do Grok 4.7?

Seus principais pontos fortes estão no desempenho de codificação agentica, mostrando ganhos notáveis em benchmarks como o Artificial Analysis Coding Agent Index e DeepSWE. Ele também é integrado imediatamente a ferramentas de desenvolvedor como Cursor e GitHub Copilot.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Para builders

Esta página está trabalhando para a ferramenta de outra pessoa.

Agentes de IA leem. Compradores chegam nela. Ela responde em oito idiomas e via MCP. Sua ferramenta pode ter uma assim — no ar em 24 horas.