Skip to content
ai tools

Grok 4.7 de xAI es una actualización engañosa

El último modelo de xAI parece una mejora menor, decepcionando a los fans que esperaban una revolución. Pero ocultas bajo la superficie hay ganancias especializadas que conllevan un costo alto e inesperado.

Nora Vance
Grok 4.7 de xAI es una actualización engañosa

¿Motor más grande, misma velocidad?

Grok 4.7 aterrizó con un golpe decepcionante, no con una explosión. A pesar del importante entusiasmo previo al lanzamiento por parte de Elon Musk, la comunidad descartó en gran medida el último modelo de xAI como una mejora marginal sobre Grok 4.6, al no lograr un salto significativo en las capacidades generales de razonamiento. Muchos usuarios encontraron el modelo "decepcionante", citando experiencias frustrantes como capacidades de interfaz "inaceptablemente malas", capacidades 3D inexistentes y quedarse "atrapado en bucles aleatorios al estilo Gemini". Simplemente no se sintió como un modelo de frontera frente a competidores como GPT-5.6 Sol (max) o Claude Claude Opus.

Bajo el capó, sin embargo, Grok 4.7 representa un salto arquitectónico sustancial. Cuenta con un nuevo modelo base de 2.1 billones de parámetros, un aumento masivo del 40% respecto a los 1.5 billones de parámetros de Grok 4.6. Esta base más grande se sometió a una ejecución de entrenamiento de aprendizaje por refuerzo más larga y difícil, dirigida específicamente a tareas de varias horas y una mejor autoverificación. También integra una pila de salvaguardas completamente nueva y más fuerte y mejora las capacidades para el "Grok Bot harness".

Esta evidente desconexión entre las impresionantes especificaciones subyacentes y el rendimiento percibido resalta una tendencia crítica: inteligencia irregular. Si bien Grok 4.7 muestra ganancias significativas en áreas específicas, como el rendimiento del agente de codificación (obteniendo 56 en el Artificial Analysis Coding Agent Index, frente a 47 de Grok 4.6) y el trabajo de conocimiento agente de largo alcance, estas mejoras no se traducen en una experiencia de usuario universalmente más inteligente y consistentemente capaz. De hecho, algunas pruebas indican que Grok 4.7 razona menos que Grok 4.6 en ciertas áreas. Además, sus ganancias tienen un costo mayor, utilizando más del doble de tokens de salida para algunas tareas en comparación con su predecesor.

La nueva arma secreta del programador

Grok 4.7 puede decepcionar a los usuarios generales, pero los programadores deberían prestar atención. A pesar de las impresiones iniciales tibias, el último modelo de xAI sobresale en trabajo de conocimiento agente y tareas de codificación que exigen una coherencia sostenida. Aumentó en el Artificial Analysis Coding Agent Index, subiendo de 47 a 56, un salto significativo respecto al rendimiento de su predecesor.

Los datos de referencia confirman estas victorias específicas, mostrando dónde brilla realmente Grok 4.7. Logró grandes ganancias en Terminal-Bench 4.0, obteniendo un 38.0% en comparación con el 20.3% de Grok 4.6. Además, superó a competidores formidables como Claude Fable 5.1 Max en el complejo benchmark DeepSWE v1.1, entregando un 71.0% frente al 65.2%. Estos no son aumentos marginales.

La estrategia de xAI es clara: posicionar a Grok 4.7 como un caballo de batalla para desarrolladores especializado. Están impulsando integraciones profundas e inmediatas en las herramientas donde los programadores apreciarán más sus habilidades especializadas y notarán sus mejoras específicas. Puedes encontrar a Grok 4.7 desplegándose en:

  • Cursor
  • Grok Build
  • GitHub Copilot

Esta integración directa se dirige a los usuarios que aprovecharán sus nuevas fortalezas, convirtiéndolo en una actualización valiosa, aunque de nicho, para entornos de desarrollo profesional.

El costo oculto del poder de Grok

Sobre el papel, Grok 4.7 parece inicialmente una opción de valor competitiva. xAI mantuvo el precio estándar de la API idéntico al de su predecesor, Grok 4.6: $2 por millón de tokens de entrada y $6 por millón de tokens de salida. Esto coincide con los precios de modelos como Claude Claude Opus, pareciendo ofrecer capacidades de nivel de frontera sin un costo premium.

Aquí está el truco, y es uno importante para tu bolsillo: las mejoras de Grok 4.7 tienen un precio elevado en consumo de tokens. Su configuración 'xhigh', que desbloquea el rendimiento superior discutido anteriormente, consume más del doble de tokens que Grok 4.6 para tareas idénticas. Específicamente, Grok 4.7 (xhigh) consume aproximadamente 81,000 tokens de salida por tarea del Artificial Analysis Intelligence Index, mientras que Grok 4.6 (xhigh) solo utilizaba 38,000.

Este enorme apetito por los tokens significa que Grok 4.7 no es realmente un líder en costos. En el uso real, su gasto operativo a menudo supera incluso a GPT-6 Astra, lo que lo hace significativamente más caro que su predecesor. Para obtener más detalles sobre sus especificaciones técnicas y manejo de tokens, consulta la Grok 4.7 | SpaceXAI Docs.

Por lo tanto, Grok 4.7 se posiciona no como una ganga para el día a día, sino como una herramienta premium para flujos de trabajo específicos y exigentes. Si necesitas su excepcional capacidad de trabajo de conocimiento agéntico y destreza en programación, particularmente en tareas complejas y de largo plazo, el mayor gasto podría estar justificado. De lo contrario, estarás pagando mucho más por mejoras generales marginales.

¿Te está gustando? Recibe uno así en tu bandeja cada mañana.

un correo al día · date de baja en dos clics · sin rastreadores de terceros

El lugar de Grok en la carrera armamentista de la IA

Grok 4.7 claramente se queda atrás de los modelos de frontera de IA actuales. GPT-6 Astra y Claude Fable 5.1 mantienen ventajas dominantes en los benchmarks de inteligencia general, obteniendo 53 y 51 respectivamente en el Artificial Analysis Intelligence Index. Grok 4.7, por el contrario, solo logra un 46, lo que subraya su posición actual fuera del grupo líder de modelos generalistas.

La reciente descripción de Elon Musk de Grok 4.7 como aproximadamente a la par con el antiguo Claude Claude Opus 5.0 de Anthropic señala un cambio estratégico significativo para xAI. Esta postura más conservadora se aleja de las afirmaciones hiperbólicas anteriores. Adopta una estrategia realista de mejora constante y enfocada, dirigida específicamente al trabajo de conocimiento agéntico y la programación.

En última instancia, Grok 4.7 no es la revolución que muchos anticipaban, ni desafía la inteligencia general de sus competidores de primer nivel. Representa una actualización estratégicamente crucial, consolidando la posición de xAI como un poderoso jugador de nicho en el espacio de desarrolladores y programación. Sus ganancias sustanciales en el Artificial Analysis Coding Agent Index, saltando de 47 a 56, prueban su valor para aplicaciones específicas, incluso si no ha entrado en el nivel superior de los modelos generalistas.

Preguntas frecuentes

¿Es Grok 4.7 significativamente mejor que Grok 4.6?

Grok 4.7 ofrece mejoras específicas, especialmente para tareas de programación y agénticas, pero no es un salto revolucionario en el razonamiento general. Para muchos usuarios, el salto en el rendimiento puede sentirse incremental a pesar de su modelo base más grande.

¿Cómo se compara Grok 4.7 con GPT-6 Astra y Claude Fable 5.1?

Grok 4.7 está por detrás tanto de GPT-6 Astra como de Claude Fable 5.1 en benchmarks amplios de inteligencia y razonamiento. Sin embargo, puede superarlos en benchmarks de programación específicos, posicionándolo como una herramienta especializada en lugar de un generalista de primer nivel.

¿Es Grok 4.7 más rentable que sus competidores?

Si bien su precio por token es competitivo, Grok 4.7 utiliza significativamente más tokens por tarea que su predecesor y competidores como GPT-6 Astra. Esto puede generar costos reales más altos, anulando el valor aparente.

¿Cuáles son las principales fortalezas de Grok 4.7?

Sus principales fortalezas residen en el rendimiento de programación agéntica, mostrando ganancias notables en benchmarks como el Artificial Analysis Coding Agent Index y DeepSWE. También está integrado inmediatamente en herramientas de desarrollo como Cursor y GitHub Copilot.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Para builders

Esta página está trabajando para la herramienta de otro.

La leen los agentes de IA. Aterrizan compradores. Responde en ocho idiomas y vía MCP. Tu herramienta puede tener una igual — publicada en 24 horas.