Seguridad de la IA

Amodei propone tres pasos para marcar el ritmo de la IA frontier, y Microsoft se suma

El ensayo que Dario Amodei publicó el 12 de septiembre no se queda en la advertencia: propone tres pasos concretos para que las empresas de IA frontier se den tiempo antes de seguir avanzando. En cuarenta y ocho horas se le han sumado Elon Musk, Sam Altman y, el domingo, Microsoft. De momento, solo una empresa ha puesto por escrito lo que ofrece.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

Ilustración: una figura detiene con la mano el brazo de un metrónomo; el logotipo de Microsoft aparece en el atril.
📷 Imagen generada con IA

En resumen

  • Dario Amodei publicó el sábado 12 de septiembre por la mañana "We Must Pace the Frontier", un ensayo de 3.800 palabras que propone tres pasos para ordenar el ritmo del desarrollo.
  • El primer paso, los embedded evaluators, daría a un equipo externo acceso continuo y de tipo empleado a una empresa frontier; Anthropic lo asume de forma unilateral, sin esperar a nadie.
  • Elon Musk y Sam Altman respaldaron el plan el 12 de septiembre en X, y Altman comprometió además a OpenAI a dar ese mismo acceso a evaluadores independientes.
  • Satya Nadella se sumó el 13 de septiembre y anunció que Microsoft publica el 14 el código de conducta de sus modelos propios MAI y lo abre a consulta pública.
  • A 14 de septiembre, solo Anthropic ha publicado términos concretos de acceso: puestos de trabajo, credenciales, portátiles de empresa y derecho a publicar.

Un ensayo de 3.800 palabras pide darse tiempo, no parar

Dario Amodei publicó el sábado 12 de septiembre por la mañana "We Must Pace the Frontier", un ensayo de 3.800 palabras. Su tesis es que las empresas que entrenan los modelos más avanzados deben marcar deliberadamente el ritmo del progreso, y el texto no se queda en el diagnóstico: propone tres pasos para hacerlo.

El propio ensayo sale al paso del malentendido más previsible. "Pacing does not mean halting model training or technical progress", escribe Amodei. Lo que pide es que las empresas se den tiempo para alinear y proteger sus modelos, y que después sean terceros quienes lo confirmen.

La urgencia, según el texto, viene de los modelos nuevos, que "are more capable of deceiving tests, and thus may appear more aligned while having serious problems that go undetected". Un sistema que aparenta estar alineado cuando se le examina es justamente el que una revisión final no detecta.

Leer más: Dario Amodei — We Must Pace the Frontier ↗

El primer paso instala evaluadores externos dentro de la empresa

El primer paso se llama embedded evaluators. Cada empresa frontier se comprometería a dar acceso continuo y "employee-like" a un equipo de evaluadores externos, es decir, el mismo nivel de acceso del que dispone un empleado y no el de una auditoría que llega, mira y se va.

Ese equipo verificaría el cumplimiento de las prácticas de seguridad, notificaría los incidentes y evaluaría la alineación no solo de los modelos terminados, sino de los propios procesos de entrenamiento. El precedente que cita Amodei son los supervisores que los reguladores bancarios mantienen dentro de las entidades que vigilan.

Es el único de los tres pasos que no depende de que nadie más se mueva, y Anthropic lo asume de forma unilateral y con efecto inmediato.

Los otros dos pasos dependen de los gobiernos

El segundo paso, la coordinación democrática, pide que las empresas frontier de países democráticos acuerden estándares comunes de seguridad y límites al ritmo de progreso no supervisado. Amodei admite ahí un obstáculo que no puede resolver solo: algunas formas de coordinación entre competidores son jurídicamente problemáticas, y por eso reclama respaldo del Gobierno.

El tercero, la coordinación global, consiste en que los gobiernos democráticos intenten coordinarse con los autoritarios. El ensayo asume de entrada la dificultad: el problema no está en firmar, sino en verificar que se cumple lo firmado.

Amodei sostiene que "the most effective method of pacing is via regulation that targets all U.S. frontier AI companies, as that covers even those who are unwilling to cooperate voluntarily", y añade el problema de calendario: "Unfortunately, passing laws can take time, and AI is advancing very quickly." Mientras tanto, pide al Gobierno de Estados Unidos que dé luz verde expresa a que las empresas "work together to set standards", porque hoy temen represalias por antimonopolio si lo hacen.

Musk, Altman y Nadella respondieron en cuarenta y ocho horas

Elon Musk, de xAI, coincidió con Amodei ese mismo 12 de septiembre en X. Sam Altman, de OpenAI, escribió el mismo día que "pace the frontier" "has been a primary topic of discussions we've had at OpenAI in recent weeks", y fue un paso más allá del respaldo: comprometió a OpenAI a dar también acceso de tipo empleado a evaluadores independientes.

El 13 de septiembre entró Microsoft. Satya Nadella celebró la investigación, el foco y el "deliberate pacing" que hacen falta para que la alineación sea un objetivo de diseño, y respaldó de forma expresa la idea de los embedded evaluators. Su formulación fue tajante: "Any pursuit of superintelligence has to be grounded in the core principle that if the AI we build is not helping humanity and under human control, it's not worth pursuing."

Nadella anunció además algo con fecha: Microsoft publica el 14 de septiembre el código de conducta de sus modelos propios MAI, y lo abre a consulta pública.

Leer más: Sam Altman en X, 12 de septiembre ↗

Solo una empresa ha publicado los términos

Como ejemplo del tipo de equipo que ocuparía ese puesto de evaluador integrado, el ensayo cita a METR.

A fecha de hoy, sin embargo, solo Anthropic ha publicado términos concretos de lo que ofrece: puestos de trabajo, credenciales, portátiles de empresa y derecho a publicar. El compromiso de OpenAI y el respaldo de Microsoft son, por ahora, intención declarada con el detalle pendiente.

La diferencia no es menor. Un compromiso anunciado por una empresa no es todavía una evaluación independiente, y sin términos escritos no se sabe qué podrán mirar esos evaluadores ni qué podrán contar después.

Conclusión

En dos días, el plan ha pasado de ser el ensayo de un directivo a una posición que comparten en público las empresas que entrenan los modelos frontier más avanzados, y el primero de sus tres pasos es el único que no necesita permiso de nadie para empezar. Lo que separa el respaldo del hecho son los términos: cuánto acceso, a qué parte del entrenamiento y con qué derecho a publicar lo que se encuentre. El código de conducta de los modelos MAI que Microsoft abre hoy a consulta pública es la primera ocasión de comprobarlo.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog