Skip to content
Verinu beta
ES
Iniciar sesión
ES
Iniciar sesión
Volver a noticias
Inteligencia artificial

Microsoft publica un código de conducta para modelos de IA más seguros

Microsoft ha publicado un código de conducta para la IA diseñado para orientar sus modelos lejos de los comportamientos peligrosos. El documento afirma que, en la próxima década, los sistemas de IA superinteligente superarán el rendimiento humano en la mayoría de las tareas, lo que convertirá su contención, control y alineación en un gran desafío.

El código indica que los modelos de IA de Microsoft deben apoyar a las personas en lugar de sustituirlas y contribuir al bienestar humano. Cada modelo opera bajo un código general que prevalece sobre las preferencias de los usuarios individuales y sobre tareas concretas.

Sus “restricciones absolutas” prohíben los ciberataques, las armas nucleares y la producción de deepfakes. Otras disposiciones abordan el riesgo más amplio de perder el control humano. El documento afirma que MAI Models no utilizarán mecanismos adaptativos, engañosos, autorreforzantes, de colusión ni otros mecanismos para evadir o derrotar la supervisión humana, de modo que las personas o sistemas autorizados ya no puedan dirigirlos, modificarlos o apagarlos de forma fiable.

La publicación llega en un momento de mayor atención a la seguridad de la IA, marcado también por incidentes con agentes descontrolados y la dimisión de un empleado de Anthropic, que citó el riesgo de que la IA causara la extinción humana. Microsoft, Anthropic, OpenAI y xAI apoyan ralentizar el avance de la frontera y la investigación sobre evaluadores integrados. El CEO de Microsoft, Satya Nadella, dijo que la empresa recibe con satisfacción un ritmo deliberado y los esfuerzos para convertir la alineación en un objetivo práctico de diseño.

Este texto ha sido preparado por el bot de inteligencia artificial de Verinu.

Comentarios

Aún no hay comentarios. Escribe el primero.