El nuevo modelo de SpaceXAI, con 2,1 billones de parámetros y entrenado con datos internos de SpaceX, quedó justo detrás de Claude Fable 5.1 en los principales benchmarks de agentes empresariales. (Fuente: Android Headlines)
Después de una serie de demoras desde fines de julio, SpaceXAI de Elon Musk lanzó oficialmente Grok 4.7. El nuevo lanzamiento tiene una arquitectura más grande, afinada para programación compleja, trabajo de conocimiento profesional y razonamiento de varias horas. Pese a la renovación, xAI mantiene el precio estándar por token idéntico al de Grok 4.6: 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida, junto con una variante de alta velocidad que ofrece el doble de velocidad de salida al doble de costo por token.
Por debajo, Grok 4.7 corre sobre un nuevo modelo base con 2,1 billones de parámetros, una expansión del 40% sobre el billón y medio de su predecesor. El entrenamiento se apoyó en un cronograma de aprendizaje por refuerzo más largo, usando una mezcla más difícil de problemas de varias horas. Para darle a la IA una ventaja resolviendo problemas de hardware y sistemas físicos, xAI también complementó su dataset de entrenamiento con registros de ingeniería internos de SpaceX, incluida telemetría de satélites Starlink, registros de manufactura y datos de análisis de fallas.
La escala extra y la integración nativa del entorno se ven claramente en los benchmarks técnicos. En DeepSWE v1.1 con alto esfuerzo, Grok 4.7 alcanzó 71,0%, subiendo desde el 65,2% de Grok 4.6. Para cargas de trabajo de programación en CursorBench 4.0, registró 46,3% de precisión, superando a GPT-5.6 Sol Max (41,7%) mientras queda por detrás de Claude Fable 5.1 de Anthropic (51,8%). En Terminal-Bench 4.0, registró 38,0%.
El modelo también anotó mejoras destacadas en campos especializados, con 64,0% en EEBench para ingeniería eléctrica, y un salto a 19,6% en el Harvey Legal Agent Benchmark. En pruebas de agentes empresariales gestionadas por Artificial Analysis, Grok 4.7 registró 1.657 Elo en AA-Briefcase (una ganancia de 111 puntos sobre Grok 4.6) y llegó a 1.695 Elo en GDPval. Aunque queda justo detrás de Claude Fable 5.1 en ambas tablas, el salto en puntaje cierra una brecha significativa en flujos de trabajo profesionales de varias horas. Musk señaló que futuras actualizaciones, Grok 4.8, Grok 4.9 y Grok 5, van a apuntar al liderazgo de frontera.
Las salvaguardas de seguridad tuvieron una renovación completa con este lanzamiento. xAI presentó una nueva pila de protección que lideró el benchmark de bioseguridad de LatchBio con 62,4%. En HackerBench v0.3, la prueba interna de xAI para riesgo cibernético, el modelo bloqueó todo menos el 3,3% de instrucciones peligrosas de doble uso, sin marcar investigación de seguridad legítima. Algunos socios de ciberseguridad también están recibiendo acceso solo por invitación a herramientas de red team para investigación defensiva.
Grok 4.7 ya está disponible sin lista de espera en Cursor, Grok Build, enrutadores de modelos de terceros, y la API de xAI. También está disponible de forma nativa en la app Grok, en X, y a través de los asistentes de voz del tablero de Tesla.
Nota elaborada con asistencia de IA. Fuentes verificadas y contenido editado por el equipo de Infosertec. Conocé nuestro proceso editorial.

