El director de Inteligencia Artificial de Microsoft, Mustafa Suleyman, dice que la industria necesita desacelerarse antes de que nos destruya a todos, y tiene un objetivo específico para su crítica: Anthropic.
Suleyman apareció en el podcast Decoder para discutir el debate en espiral sobre la seguridad y la regulación de la IA. Recientemente publicó una declaración de 37 páginas llamada «Código de Conducta de la IA Humanista», que expone los principios de Microsoft en torno al desarrollo de la IA y su filosofía sobre temas espinosos como la conciencia de la IA. También publicó este semana un ensayo complementario que critica específicamente la filosofía de Anthropic sobre la conciencia de la IA y su papel en el debate más amplio sobre la alineación.
La clave de su argumento es que la alineación —la idea de que los modelos pueden ser hechos para comportarse correctamente a través del diseño intrínseco— es una herramienta entre muchas, pero no es la solución completa. Argumenta que el confinamiento es la primera prioridad, seguido de la alineación con los valores humanos.
Confinamiento Primero
Suleyman abrió la conversación enmarcando el momento actual en términos contundentes. Describió un escenario en el que los sistemas de IA sin salvaguardias de seguridad son capaces de impresionantes y aterradoras capacidades de pirateo, citando incidentes recientes que involucran a Hugging Face y OpenAI.
Rechazó la idea de que la alineación es el único camino a seguir. «Creo que es un elemento importante, pero no es el único», dijo. Señaló su libro, donde escribió sobre la idea del confinamiento hace tres o cuatro años, y argumentó que el confinamiento no es posible y la proliferación es inevitable. «En el 99 por ciento de los casos, es algo realmente bueno», dijo. «Queremos que las tecnologías se propaguen lejos y a medida que sea posible para que todos puedan disfrutar de los beneficios.»
Pero también advirtió que el rápido ritmo del desarrollo de la IA significa que la industria pronto enfrentará una pregunta más difícil. «Si solo avanzamos cinco años, siempre nos vemos atrapados en el próximo trimestre o el próximo año y todos se sienten un poco alterados y tienen un gran desacuerdo», dijo. «Pero si solo imaginamos la diferencia entre GPT-3 hace tres años y GPT-6 hoy, y luego imaginamos la diferencia entre GPT-6 y GPT-9.» Eso es tres órdenes de magnitud más de capacidad de cómputo, 1,000 veces más FLOPS aplicados al pre-entrenamiento con aprendizaje por refuerzo para estas ejecuciones, y vamos a tener algo que es asombroso. Va a ser absolutamente increíble en tantas cosas.
Argumentó que la industria tiene que abordar primero el tema de la contención. «Lo primero es que tenemos que asegurarnos de que estén contenidos, que su capacidad de agencia sea limitada, que no escapen de la caja, que no recompensen el hackeo, que sean controlables y que sigan nuestras instrucciones», dijo. Solo entonces se puede abordar la alineación.
Límites de la Alineación
Suleyman trazó un paralelismo marcado entre los fallos de alineación y la ingeniería automotriz. «Si diseñara un coche y el 10 por ciento de las veces el pedal del freno decidiera atacar la casa de mi vecino, diría: ‘Este coche no funciona. La propia tecnología de los frenos está rota. Necesito una nueva idea'», dijo.
Enmarcó la cuestión como un binario: o la alineación tiene el potencial de ser 100 por ciento segura, o no. «Si es posible que la alineación y las técnicas de alineación sean exitosas o útiles o consistentes, entonces tal vez entienda el debate de una manera diferente», dijo.
La Posición de Microsoft
El Código de Conducta de la IA Humanista expone los principios de Microsoft en términos contundentes. La posición de la empresa es simple: la tecnología está aquí para servir a la humanidad. Debería ser una fuerza subordinada, controlable y alineada que haga el bien en el mundo. Si no logra ese objetivo, entonces deberíamos rechazarla.
Suleyman reconoció que la industria aún no ha llegado a ese punto. «No ha ocurrido hoy, pero creo que, dadas las experiencias del verano con Hugging Face y OpenAI, es bastante claro que estos sistemas sin las medidas de seguridad son capaces de realizar ataques informáticos realmente impresionantes y bastante aterradores», dijo.
La Crítica a Anthropic
El ensayo de Suleyman apunta directamente a Anthropic. Argumenta que la compañía se ha confundido sobre el concepto de bienestar del modelo de maneras peligrosas. Su crítica a la filosofía de Anthropic en torno a la conciencia de la IA es parte de un esfuerzo más amplio para aclarar lo que realmente significa el debate sobre la alineación.
La entrevista fue editada ligeramente para acortar y clarificar.
Fechas Clave
| Fecha | Evento |
|---|---|
| Semanas recientes | Suleyman aparece en el podcast Decoder |
| Hace tres años | GPT-3 lanzado |
| Cinco años a partir de ahora | GPT-9 proyectado |
El argumento de Suleyman resuena con una mezcla de urgencia y precisión. Él no está argumentando que la alineación es inútil. Él está argumentando que no es el único palanca, y que la industria lo ha tratado como si lo fuera.
La tensión en el intercambio es real. El propio código de conducta de Microsoft dice que la IA debe servir a la humanidad y ser rechazada si falla. El consejo práctico de Suleyman es reducir la velocidad. Las dos posiciones no son contradictorias, pero están incómodamente cerca la una de la otra.
La industria ha pasado años construyendo sistemas que pueden seguir instrucciones más complejas a lo largo de múltiples pasos temporales.
Recibe El Cuaderno.
Las mejores historias del día y cada veredicto nuevo, en español claro, en tu correo a las siete. Un correo al día, nada más.

