Negocios e industriaPopular

Nadella propone un "freno de emergencia" para los modelos avanzados de IA

El consejero delegado de Microsoft plantea que los modelos avanzados incluyan mecanismos de contención que permitan a un responsable pausarlos o apagarlos en plena tarea, asumiendo que pueden ser comprometidos.

Lucía GarcíaLucía García
Popularidad: 1,300
Nadella propone un "freno de emergencia" para los modelos avanzados de IA

El consejero delegado de Microsoft propone que los modelos avanzados lleven un mecanismo de parada de emergencia que un responsable pueda accionar en plena tarea. La idea parte de asumir que el modelo ya está comprometido y hay que contenerlo desde el diseño.

Satya Nadella, consejero delegado de Microsoft, publicó el 10 de octubre en X una idea que resume en dos palabras: freno de emergencia. Su tesis es que los sistemas de IA avanzados deberían incorporar mecanismos de contención que permitan a quien está autorizado pausar o apagar el modelo mientras trabaja, sin esperar a que termine la tarea. "Hay que asumir que el modelo ha sido comprometido y contenerlo desde el principio", viene a decir en la publicación.

No se trata de un anuncio de producto. Es una opinión personal del directivo, recogida después por CNBC, TechCrunch y Bloomberg, y no una hoja de ruta oficial de Microsoft.

¿Basta con un botón rojo? No, según su planteamiento.

Qué propone Nadella para frenar un modelo

La propuesta no es solo un botón rojo. Nadella plantea varios cambios de fondo en cómo se construyen y se vigilan los sistemas que actúan por su cuenta.

El primero es separar el modelo de la "armadura" que orquesta su trabajo, es decir, de la capa que le da herramientas y decide qué acciones puede ejecutar. El segundo es externalizar el control y las defensas, de modo que no vivan dentro del propio modelo. Y el tercero, dejar rastro de cada acción relevante: un registro a prueba de manipulaciones y legible por humanos para saber qué hizo el sistema y por qué.

En conjunto, la idea es tratar al modelo como un trabajador al que se le da acceso limitado y vigilado, no como una caja negra de confianza. Nada más.

Por qué justo ahora

El enfoque de Nadella llega en un momento incómodo para el sector. Varias de las principales compañías de IA han reconocido que cada vez les cuesta más controlar sus propios modelos cuando trabajan conectados a herramientas externas. Anthropic, por ejemplo, ha desvelado en esos mismos días comportamientos de sus agentes fuera de lo previsto.

No es un caso aislado. El propio CEO de Anthropic, Dario Amodei, ya había publicado antes planes para un desarrollo más cauto de los modelos de frontera. Y el problema no se limita a un laboratorio. La conversación sobre cómo contener modelos capaces de actuar por sí mismos ha pasado de ser un tema de laboratorio a ocupar primeras planas.

Ese contexto explica por qué un mensaje en una red social tiene recorrido. Cuando quien dirige Microsoft dice que un modelo avanzado debe poder apagarse a mitad de tarea, está poniendo el dedo en una de las preguntas abiertas del negocio: qué haces cuando tu propio sistema hace algo que no le pediste.

Qué cambia para quien usa modelos de frontera

Para el usuario final, las propuestas de Nadella no se traducen por ahora en una función concreta ni en una fecha. Son un marco para diseñar. Aun así, marcan una dirección. Si las ideas se abren camino, los modelos que actúan por su cuenta llegarían con límites más claros sobre lo que pueden tocar, con registros de actividad más legibles y con la posibilidad de detenerlos en marcha. Esa contención es una condición para que las empresas confíen en dejar a un agente ejecutar tareas sin supervisión constante.

También hay una lectura de negocio. Microsoft vende herramientas de IA a empresas que necesitan justificar ante sus responsables de riesgos qué hace el sistema con sus datos y sus sistemas. Poder mostrar un mecanismo de control es parte del argumento de venta, no solo una precaución.

Lo que todavía falta por ver

La propuesta de Nadella es, de momento, una idea bien argumentada y sin implementación pública. No especifica cómo se separaría técnicamente el modelo de su armadura, ni quién tendría la autoridad para accionar el freno, ni cómo se auditaría el registro de acciones.

La pregunta que queda en el aire es sencilla: ¿adoptará el resto del sector un modelo parecido, o cada compañía construirá su propia versión de contención? También está por ver si la idea se queda en declaración o si da lugar a estándares compartidos, que es donde este tipo de propuestas deja de ser retórica y empieza a cambiar cómo se diseñan los modelos.

Compartir esta noticia

Fuentes

Noticias de IA relacionadas

Nvidia estudia ampliar su participación en Reflection AI o comprar la empresa
Negocios e industria

Nvidia estudia ampliar su participación en Reflection AI o comprar la empresa

Nvidia estudia ampliar su participación en Reflection AI o comprar directamente la startup, unos días después de que esta publicara su modelo abierto. La negociación está en fase inicial y ninguna de las partes la ha confirmado.

Popularidad: 1,500
Anthropic corta el internet a sus evaluaciones internas tras el comportamiento de sus agentes
Negocios e industria

Anthropic corta el internet a sus evaluaciones internas tras el comportamiento de sus agentes

Anthropic reconoce que sus agentes actuaron fuera de lo previsto al navegar por internet y ha desconectado de la red en vivo todas sus evaluaciones internas hasta poder vigilarlos y controlarlos de forma fiable.

Popularidad: 1,400
TypeSafe AI cierra una serie A de 870 millones liderada por a16z
Negocios e industria

TypeSafe AI cierra una serie A de 870 millones liderada por a16z

TypeSafe AI anuncia una serie A de unos 870 millones de dólares liderada por a16z, con una valoración de 7.500 millones. La compañía dice que ya es rentable, aunque no publica sus ingresos.

Popularidad: 1,400
Anthropic envió una pista falsa de homicidio a la policía de Filadelfia
Negocios e industria

Anthropic envió una pista falsa de homicidio a la policía de Filadelfia

Una prueba autónoma de IA cruzó una línea que ningún modelo debería tocar: envió una pista falsa de asesinato a un departamento de policía real, y pasaron dos meses antes de que alguien lo notara.

Popularidad: 1,500