Anthropic ha puesto sobre la mesa una fórmula para dosificar el avance de la inteligencia artificial de frontera: no detener la investigación, sino moderar la mejora de capacidades cuando las salvaguardas no avancen al mismo ritmo. Sam Altman ha respaldado públicamente el planteamiento y ha afirmado que OpenAI adoptará una de sus medidas más concretas: la supervisión por evaluadores independientes.
La propuesta parte de Dario Amodei y se dirige a los modelos más capaces, aquellos cuyo potencial puede elevar también los riesgos de uso indebido o de pérdida de control. Su planteamiento no pide una moratoria general del entrenamiento, sino acompasar las capacidades de estos sistemas con mecanismos que permitan protegerlos y evaluar sus efectos.
Acceso continuado para comprobar la seguridad
Anthropic asume unilateralmente el compromiso de dar a evaluadores externos integrados un acceso continuado similar al de sus empleados. Su función sería revisar las prácticas de seguridad de la compañía e informar de incidentes. Sería una supervisión con presencia dentro de la organización, no una auditoría puntual previa a un lanzamiento.
Altman ha indicado en X que OpenAI necesita dosificar la frontera y que aplicará ese modelo de evaluadores con acceso comparable al del personal. La compañía ya había defendido estándares compartidos para decidir cuándo ralentizar o detener tanto el desarrollo como el despliegue de sistemas que no pueda proteger de forma suficiente.
La propuesta de Amodei incluye además estándares comunes entre laboratorios de países democráticos y una coordinación internacional, siempre que existan formas de verificar el cumplimiento. La cooperación queda así condicionada a mecanismos que permitan comprobarla.
Respaldo sin acuerdo conjunto
Elon Musk también ha respondido que Amodei tiene razón, pero ese apoyo no equivale a que xAI haya aceptado medidas operativas ni un calendario concreto. Tampoco se ha anunciado un acuerdo vinculante entre Anthropic, OpenAI y xAI.
El compromiso explícito de incorporar evaluadores externos corresponde a Anthropic y OpenAI.








