OpenAI ha publicado una nueva tabla de clasificación en drivingbench.com, y los números muestran que GPT-6 Astra ha adquirido la capacidad de conducir un automóvil real. La prueba es simple: a los modelos se les otorga el control del volante, acelerador y frenos de un Toyota Corolla, luego se les pide que completen un curso fijo de conos. GPT-6 Astra es el único modelo que alcanza el 100% de progreso en su mejor carrera.
La tabla de clasificación permite que cada modelo intente hasta tres veces en una sola conversación continua. Cada carrera se califica según la distancia recorrida, la velocidad, el tiempo de finalización y los comandos emitidos, con costos rastreados a precios de lista. Los resultados muestran una clara brecha entre GPT-6 Astra y el resto de los competidores.
Los Números Detrás del Curso
La mejor carrera de GPT-6 Astra cubrió todo el recorrido con un 100% de progreso, finalizando en 5:22. Sus otros dos intentos también alcanzaron el 100% de progreso. La tabla de clasificación muestra los tiempos de finalización solo para las carreras completadas, por lo que los tiempos individuales de esas dos carreras no se muestran.
Claude Fable 5.1 se acercó más entre los competidores, alcanzando un 45% de progreso en su mejor carrera. Sus dos intentos restantes lograron solo un 9% y un 10% de progreso. Claude Fable 5.1 nunca completó el curso, terminando cada carrera antes de alcanzar la zona de finalización.
Grok 4.6 tuvo un desempeño peor, alcanzando un 11% de progreso en su mejor carrera y un 8% en su segunda. Su tercer intento alcanzó solo un 10% de progreso. Al igual que Claude Fable 5.1, Grok 4.6 nunca completó el curso.
GPT-5.6 Sol tuvo el peor desempeño de todos, alcanzando un máximo de 6% de progreso en los tres intentos.
Lo que Muestra la Tabla de Clasificación
La tabla de clasificación clasifica los modelos según su mejor intento único, no según el rendimiento promedio en los tres intentos. Eso significa que un modelo puede obtener una puntuación alta incluso si sus otros dos intentos fracasan.
| Modelo | Mejor progreso | Tiempo de finalización |
|---|---|---|
| GPT-6 Astra | 100% | 5:22 |
| Claude Fable 5.1 | 45% | DNF |
| Grok 4.6 | 11% | DNF |
| GPT-5.6 Sol | 6% | DNF |
DNF significa «no finalizó», lo que indica que el modelo terminó su ejecución antes de alcanzar la zona de finalización. La tabla muestra que GPT-6 Astra es el único modelo que alcanzó el 100% de progreso.
Cómo funciona la prueba
El recorrido en sí es una trayectoria cónica fija, y el sistema de puntuación recompensa mantenerse cerca de la línea central. Un modelo obtiene puntos por la distancia recorrida mientras se mantiene dentro de los 4 metros de la línea central, como porcentaje de la longitud de la línea central hasta la zona de finalización. Una colisión detiene el intento inmediatamente, con la puntuación fijada en el progreso alcanzado antes del impacto.
La velocidad se integra desde el primer comando de movimiento aceptado hasta el final de la última interacción del intento. El tiempo de finalización se mide desde el primer comando de movimiento aceptado hasta el final de la última interacción del intento, mostrado solo para las ejecuciones completadas.
Los comandos se registran como comandos de movimiento aceptados y comandos de parada durante el intento. Los costos se totalizan a precios de lista, incluyendo la reflexión después de cada intento.
La Brecha de Desempeño )
La tabla de posiciones muestra una clara separación entre el mejor modelo y todos los demás. Aquí está cómo se clasifican los modelos por mejor progreso:
- GPT-6 Astra — 100% )
- Claude Fable 5.1 — 45% )
- Grok 4.6 — 11% )
- GPT-5.6 Sol — 6% )
El progreso de 100% de GPT-6 Astra es la finalización completa de un curso en su mejor carrera. Claude Fable 5.1 alcanzó el 45% en su mejor carrera. Grok 4.6 alcanzó un máximo del 11%, y GPT-5.6 Sol nunca superó el 6%.
Lo que esto significa para la IA )
Un automóvil es una máquina compleja con muchas partes móviles, y conducirlo requiere una atención constante a la velocidad, la dirección y los obstáculos. Un modelo que puede terminar un recorrido de conos sin chocar ha demostrado verdadera habilidad, no solo poder bruto.
La tabla de posiciones también muestra que la brecha entre los modelos de mejor desempeño y el resto del campo es significativa. GPT-6 Astra finalizó con un progreso del 100%, mientras que el siguiente mejor modelo alcanzó solo el 45%. Ese es un amplio margen en una prueba que mide el desempeño real.
Los resultados sugieren que la capacidad de conducción no se distribuye uniformemente entre los modelos de IA. Algunos modelos pueden manejar la tarea, mientras que otros tienen dificultades. La tabla de posiciones no dice qué modelos fallaron por razones técnicas y cuáles fallaron por falta de habilidad, pero el patrón es consistente: GPT-6 Astra tiene éxito, y el resto fallan.
El Camino por Delante )
La tabla de clasificación es una instantánea del rendimiento actual, no un veredicto final. Los modelos mejoran con el tiempo, y las versiones más recientes podrían reducir o ampliar la brecha.
Por ahora, la conclusión es sencilla: GPT-6 Astra ha ganado la capacidad de conducir un automóvil de verdad, y la prueba en drivingbench.com lo demuestra.
La tabla de clasificación está disponible para que cualquiera la revise, y los videos muestran exactamente cómo cada modelo abordó el recorrido. Las pruebas de GPT-6 Astra son las que vale la pena ver, ya que es el único modelo que alcanzó el 100% de progreso.
La comparación es contundente, y la conclusión es clara: GPT-6 Astra es el único modelo en esta tabla de clasificación que alcanzó el 100% de progreso.
Material de origen: “GPT-6 Astra ha ganado la capacidad de conducir un automóvil”, drivingbench.com.
Recibe El Cuaderno.
Las mejores historias del día y cada veredicto nuevo, en español claro, en tu correo a las siete. Un correo al día, nada más.

