[ad_1]
xAI presentó “Asimilar 4.1”, una mejora que integra avances en innovación, percepción emocional y exactitud.
El lanzamiento se llevó a cabo entre el 1 y el 14 de noviembre de 2025 a través de un despliegue gradual en grok.com, X y las aplicaciones móviles. Durante dicho periodo, se realizaron evaluaciones ciegas sobre el tráfico auténtico para analizar el desempeño del modelo.
La empresa sostiene que estos avances provienen de la utilización de la misma infraestructura de aprendizaje por refuerzo que se aplicó en Grok 4, adaptada para ajustar estilo, carácter y alineación.
LEA TAMBIÉN

Despliegue y resultados preliminares
Según la página oficial de Grok, el proceso inició con versiones iniciales dirigidas a una porción creciente del tráfico de producción. La compañía afirma que, tras esas evaluaciones, el nuevo modelo fue preferido el 64,78% de las veces frente a su versión anterior.
Capacidades generales y clasificación
Grok 4.1 logró un desempeño excepcional en evaluaciones de preferencias humanas ciegas. En la Arena de Texto de LMArena, la variante Grok 4.1 Thinking (quasarflux) alcanzó 1483 puntos Elo, colocándose en primera posición, mientras que el modo sin razonamiento (tensor) obtuvo 1465 puntos Elo y se situó en segundo lugar.
De acuerdo con los datos proporcionados, esta última modalidad superó a otros modelos que contaban con razonamiento completo. Además, se destaca que Grok 4.1 superó significativamente los resultados de Grok 4 que ocupaba el puesto 33.
Puede ser utilizado en modo automático o seleccionarlo en el menú bajo la etiqueta «Grok 4.1». Foto:xAI/EFE
LEA TAMBIÉN

Evaluaciones en inteligencia emocional, escritura creativa y disminución de alucinaciones
Evaluación de inteligencia
afectivo
Con el fin de analizar aspectos tales como la empatía, destrezas interpersonales y la consistencia en la personalidad, xAI llevó a cabo una evaluación del modelo en EQ-Bench3, una prueba que consta de 45 situaciones de juegos de roles. Se utilizaron los parámetros estándar, el evaluador “Claude Sonnet 3.7” y el cálculo Elo normalizado para obtener los resultados.
Desempeño en escritura creativa
Grok 4.1 también fue evaluado en la prueba de Escritura Creativa v3, que abarca 32 consigna generadas en tres rondas. La calificación se establece a través de rúbricas y comparaciones por pares, utilizando un sistema de Elo normalizado similar al empleado en las evaluaciones de inteligencia afectiva.
Esta actualización incluye avances en creatividad, entendimiento emocional y exactitud. Imagen:TwitterxAI
LEA TAMBIÉN

Gestión de alucinaciones
En relación a los errores fácticos, la información presentada indica que el entreno posterior se enfoca en reducir alucinaciones ante solicitudes de búsqueda de información, un aspecto crucial en modelos veloces que operan con presupuestos de llamadas a herramientas restringidas.
La compañía señala que se evaluó la tasa de alucinaciones en tráfico real y se utilizó el índice FActScore, compuesto por 500 interrogantes biográficas, para validar las mejoras observadas.
Disponibilidad
Según el texto fuente, Grok 4.1 ya está accesible para todos los usuarios en grok.com, X y las aplicaciones para iOS y Android. Puede ser empleado en modo automático o seleccionarse directamente en el menú bajo la etiqueta «Grok 4.1».
*Este contenido fue elaborado con la ayuda de una inteligencia artificial, basado en información de conocimiento público divulgada a medios de comunicación. Además, estuvo sujeto a la revisión de la periodista y un editor.
Más noticias en EL TIEMPO
[ad_2]
