CourionAI
ES
Boletín
← Todas las noticias
models 3 min de lectura

Grok 4.7 piensa más por el mismo dinero y obtiene un punto de referencia extraño

xAI envió Grok 4.7 el lunes a precios sin cambios de 2 dólares de entrada y 6 dólares de salida por millón de tokens. Obtiene un 71 por ciento en DeepSWE y una puntuación inusualmente alta en un punto de referencia legal donde los rivales colapsan.

Una balanza mantenida nivelada, una pequeña pila de monedas en un plato y una torre de engranajes en el otro.

xAI lanzó Grok 4.7 el lunes, y el titular es lo que no cambió: cuesta lo mismo que Grok 4.6, a 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida, con una variante más rápida al doble de precio por el doble de velocidad. Un token equivale aproximadamente a tres cuartos de una palabra, por lo que un millón de ellos es una larga tarde de trabajo para un asistente de codificación. Debajo del capó hay un modelo base más grande entrenado con una ejecución de aprendizaje por refuerzo más larga, orientada a problemas que toman horas en lugar de minutos.

La tabla de referencia es una imagen mixta, que es más útil que hacer un barrido limpio. En DeepSWE v1.1, una prueba de ingeniería de software, Grok 4.7 obtiene un 71,0 por ciento con alto esfuerzo, frente al 65,2 de su predecesor y justo por delante de Claude Fable 5.1 Max con 70,0, mientras que GPT-5.6 Sol Max lidera con 72,7. En Terminal-Bench 4.0, que mide el trabajo de línea de comandos de varias horas, Grok 4.7 casi duplica la puntuación de su predecesor al 38,0 por ciento, pero Fable 5.1 Max está muy por delante con 57,9. El número más impar es el Harvey Legal Agent Benchmark, donde Grok 4.7 registra un 19,6 por ciento frente al 2,5 de GPT-5.6 Sol y el 6,7 de Fable 5.1 Max. En el razonamiento clínico está a la zaga de ambos. xAI también dice que este es su modelo más sólido hasta el momento para rechazar solicitudes genuinamente peligrosas y al mismo tiempo ayudar con el trabajo de seguridad legítimo, permitiendo pasar el 3,3 por ciento de las solicitudes riesgosas en su propia prueba HackerBench.

¿Qué hay detrás de esto?

Vale la pena destacar dos cosas. En primer lugar, los precios no están cayendo tanto sino que la capacidad está aumentando por debajo de un precio fijo, que es el patrón en toda la industria este año y la razón por la que un modelo de hace seis meses empieza a parecer caro en lugar de abaratarse. En segundo lugar, la distribución entre esos puntos de referencia nos dice algo real: ya no existe un “mejor modelo” único, sino que hay modelos que se adaptan a trabajos particulares. Una puntuación del 19,6 por ciento todavía significa que cuatro de cada cinco tareas legales fracasaron, por lo que la lectura correcta es que estos agentes son tempranos en el trabajo profesional, no que Grok haya resuelto el derecho. El proveedor también realiza pruebas comparativas, a menos que se indique lo contrario, y cada laboratorio elige las pruebas que parecen buenas.

Qué significa esto para ti: Para el uso diario del chat, esto cambia muy poco. Si escribe código o paga por IA por token, vale la pena probarlo, particularmente porque se encuentra dentro de herramientas que quizás ya use, como Cursor y la API de Grok, y porque nada en su factura cambia cuando cambia. La lección más general: cuando un modelo mejora al mismo precio, tu presupuesto actual compra silenciosamente más, pero sólo si realmente te mudas. Compruebe cada pocos meses qué modelo utilizan de forma predeterminada sus herramientas.

Fuentes

Fuentes: https://x.ai/news/grok-4-7

Siguiente artículo

Cuando los agentes se pusieron conversadores, los márgenes de esta startup bajaron a menos 50 por ciento

Bloomberg informa que la firma legal de inteligencia artificial Harvey observó cómo los márgenes brutos caían de alrededor del 50 por ciento a menos 50 en junio a medida que el uso de tokens se multiplicaba por veinte. Se recuperó construyendo un modelo interno en el Kimi K3 abierto de Moonshot.

Una cinta de papel doblada con forma de línea de gráfico que se hunde y luego se dobla hacia arriba sobre una cuadrícula