SpaceXAI lanza Grok 4.7, su modelo orientado a programación y trabajo de conocimiento

El nuevo modelo mantiene el precio y la velocidad de Grok 4.6, mientras la compañía destaca mejoras en programación, trabajo profesional y seguridad.

0
6
Foto IA

SpaceXAI, la compañía de inteligencia artificial que surgió de la fusión entre xAI y SpaceX, anunció el 21 de septiembre el lanzamiento de Grok 4.7, un modelo que la empresa describe como su versión más capaz para tareas de programación y trabajo de conocimiento. Según el comunicado publicado en el sitio oficial de la compañía, el modelo trabaja durante períodos más largos en tareas difíciles, verifica su propio trabajo con mayor detalle y llega acompañado de lo que la empresa denomina sus salvaguardas mejor calibradas hasta la fecha. Grok 4.7 se ofrece al mismo precio y velocidad que su antecesor, Grok 4.6.

De acuerdo con la información técnica compartida por SpaceXAI, Grok 4.7 utiliza un modelo base de mayor tamaño que Grok 4.6 y fue entrenado con una etapa de aprendizaje por refuerzo más extensa, orientada a un conjunto de tareas más exigente y con mayor peso en problemas que toman varias horas en resolverse. La compañía indica también que el modelo mejoró su capacidad para gestionar contextos más extensos y que fue entrenado para operar de forma nativa con Grok Bot, su entorno conversacional. En materia de precios, Grok 4.7 se ofrece desde 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida, con una variante más rápida que duplica la velocidad de salida al doble de ese costo.

En las pruebas de referencia divulgadas por la propia empresa, Grok 4.7 obtuvo 46.3% en CursorBench 4.0, un banco de pruebas centrado en tareas de programación de larga duración, cifra superior al 40.4% registrado por Grok 4.6 y comparable a los resultados de otros modelos de la industria como GPT-5.6 Sol y Fable 5.1, aunque estos últimos se ubican en distintos rangos de precio por token. SpaceXAI también reportó mejoras en benchmarks de trabajo profesional como AA Briefcase y GDPval, en los que se evalúan tareas típicamente realizadas por abogados, personal de enfermería y analistas financieros, con un desempeño que la compañía describe como comparable al de otros modelos de punta.

En el apartado de seguridad, SpaceXAI afirmó haber construido un nuevo sistema de salvaguardas para Grok 4.7 y señaló que el modelo obtuvo 62.4% en el banco de bioseguridad de LatchBio y bloqueó el 97% de las instrucciones de riesgo en su prueba interna para tareas cibernéticas maliciosas, HackerBench v0.3. La empresa indicó, además, que comenzó a otorgar acceso anticipado a un grupo selecto de socios de ciberseguridad para investigación defensiva. Estas cifras provienen directamente del comunicado de la compañía y no fueron verificadas de forma independiente por evaluadores externos al momento de esta publicación.

Grok 4.7 está disponible desde su lanzamiento en Cursor y en Grok Build, así como a través de la API de Grok, entornos de programación de terceros y distintas plataformas de enrutamiento de modelos y proveedores de nube.

El lanzamiento se produce en un contexto de competencia intensa entre laboratorios de inteligencia artificial por el mercado de herramientas de programación asistida, en el que también participan modelos de OpenAI y Anthropic. La propia empresa reconoció, en anuncios previos reportados por medios especializados como TechCrunch, que ha mantenido un ritmo de lanzamientos acelerado desde mediados de 2026, con versiones sucesivas de la familia Grok 4 en un lapso de pocas semanas. SpaceXAI, resultado de la fusión entre SpaceX y xAI formalizada en febrero de 2026 y rebautizada bajo su nombre actual en julio de ese año, opera Grok como parte de un ecosistema que también incluye la plataforma X y los productos Grok Imagine y Grok Bot.

Impacto en el sector IT: el lanzamiento de Grok 4.7 añade una opción adicional para equipos de desarrollo que evalúan modelos de IA para tareas de ingeniería de software de larga duración, en un mercado donde el costo por token y el desempeño en bancos de pruebas especializados se han convertido en criterios centrales de decisión para empresas que integran asistentes de programación en sus flujos de trabajo.

Fuente: SpaceXAI | Editado por CDOL

Custom Text
Artículo anteriorAmazon bloquea al agente Muse de Meta y profundiza la disputa por el comercio agéntico
Artículo siguienteABSIDE impulsa su portafolio de innovación y trabajadores digitales a 15 años de su fundación