OpenAI, Anthropic y Google estudian crear un organismo impulsado por la industria para establecer estándares compartidos de seguridad para la inteligencia artificial avanzada. La iniciativa continúa en fase de discusión: no se ha anunciado ninguna organización y tampoco se conocen su nombre, sus estatutos, sus reglas definitivas ni un calendario público.
Representantes de las tres compañías mantienen conversaciones desde julio y se habrían reunido de nuevo la semana pasada. Ninguna de ellas ha comunicado públicamente el proyecto ni ha confirmado cómo sería su estructura, por lo que aún no puede darse por hecho que las negociaciones desemboquen en una entidad formal.
Pruebas y auditorías para los modelos más capaces
Entre los asuntos que se contemplan figuran criterios comunes para las pruebas y auditorías de los sistemas de IA. Estas evaluaciones permiten examinar cómo responde un modelo ante determinadas tareas y si las salvaguardas previstas funcionan antes o durante su despliegue.
El posible organismo se limitaría, por ahora, a debatir esos estándares. Se desconoce si tendría capacidad de supervisión sobre las empresas participantes, qué mecanismos exigiría para cumplir sus reglas o si las evaluaciones podrían realizarse de forma independiente. También falta por saber si se sumarían otros laboratorios y compañías tecnológicas.
Las conversaciones coinciden con un debate público más amplio sobre el ritmo de desarrollo de la IA, la necesidad de evaluaciones independientes y el alcance de la autorregulación de los laboratorios de frontera: los que desarrollan los sistemas con capacidades más avanzadas. Un estándar compartido podría dar una referencia común a esas evaluaciones, aunque no hay detalles sobre qué pruebas incluiría ni sobre sus consecuencias para los modelos que no las superasen.
OpenAI y Anthropic ya habían coincidido en la necesidad de reforzar la respuesta ante amenazas digitales vinculadas a esta tecnología, como recogimos en su petición de mejorar la ciberdefensa ante ataques impulsados por IA. En esta ocasión, el alcance planteado abarcaría la seguridad de los sistemas avanzados de forma más general.







