Volver a noticias

OpenAI se une al impulso para los evaluadores independientes incorporados después de la llamada de seguridad antropica

Sam Altman se comprometió a OpenAI a dar a los evaluadores externos acceso personal, convirtiendo un aviso de la industria sobre los sistemas fronterizos que se mueven rápidamente en una propuesta concreta de gobierno.

Traducción automática · Original en inglés · Ver original

Una empresa rival adopta la propuesta de evaluación

OpenAI se ha comprometido a dar a los evaluatores independientes acceso personal a sus sistemas, al lado de una propuesta de seguridad avanzada por el CEO de Anthropic Dario Amodei. El movimiento es una nueva acción corporativa después de la amplia llamada de Amodei para retrasar el avance inesperado de la inteligencia artificial fronteriza. Anthropic dijo separadamente que proporcionaría acceso permanente, a nivel de empleado a los evaluadores de terceros. Sky News informó de los compromisos el 13 de septiembre.

La diferencia entre el compromiso y el compromiso es importante. Sam Altman dijo que OpenAI adoptaría la propuesta de acceso de los evaluadores y proporcionaría más detalles más tarde. Elon Musk apoyó la advertencia general y sugirió la revisión de pares entre los competidores, pero Sky informó que se detuvo sin cumplir con el compromiso de Anthropic. No se ha anunciado hasta el momento ningún calendario común, proceso de selección del evaluador o mecanismo de ejecución.

Lo que el acceso integrado podría cambiar

Las evaluaciones externas suelen probar un modelo en un punto determinado, a menudo a través de interfaces restringidas. El acceso personal podría permitir a los especialistas observar sistemas más continuamente, examinar versiones pre-release y comparar las reclamaciones de seguridad con las prácticas internas. En principio, esto podría mejorar la detección de incidentes y hacer que los compromisos voluntarios sean más audibles. Su valor dependerá de si los evaluadores pueden publicar hallazgos adversos, obtener información técnica relevante y operar sin presión comercial de las empresas que evalúan.

La investigación oficial del Reino Unido apoya la necesidad de pruebas rigurosas al tiempo que alerta contra la extrapolacin dramática. El Instituto de Seguridad de la Inteligencia Intelectual apoyado por el gobierno encontró una rápida mejora en varios ensayos de capacidad controlados y vulnerabilidades en cada sistema que examinó. También destacó que los resultados de los laboratorios no son predicciones de daño real. Esa combinación -el crecimiento de capacidad medible, las lacunas de seguridad persistentes y la incertidumbre sustancial- ayuda a explicar la demanda por el acceso continuo en lugar de la certificación unifamiliar.

La coordinación voluntaria tiene límites

La propuesta de Amodei se extiende más allá de los evaluadores incorporados. Exige normas comunes entre empresas en países democráticos y posible coordinación con gobiernos, incluyendo China. Estas son ambiciones diplomáticas y reguladoras, no acuerdos concluidos. Incluso el compromiso corporativo más estrecho deja preguntas no resueltas sobre quién califica como independiente, cómo se tratarán los hallazgos sensibles y si el acceso sobrevive a discrepancias sobre los lanzamientos de productos.

El siguiente desarrollo significativo será la implementación. OpenAI y Anthropic necesitarían identificar a los evaluadores, definir su autoridad, revelar los acuerdos de informes y explicar cómo los hallazgos pueden retrasar o alterar el despliegue. Los reguladores también decidirán si el acceso voluntario es suficiente o debería convertirse en un requisito legal. Hasta que estos detalles aparezcan, los compromisos son un experimento de gobernanza en lugar de la prueba de que la carrera competitiva entre los laboratorios fronterizos se ha retrasado.