OpenAI reportará conductas indebidas de la IA
OpenAI comenzará a publicar informes periódicos sobre comportamientos inesperados o no autorizados de la inteligencia artificial. La empresa presentó un nuevo marco para rastrear y divulgar desalineaciones en los modelos, advirtiendo que aún persisten importantes desafíos de seguridad en la industria a medida que los sistemas se vuelven más potentes.

OpenAI comenzará a publicar informes periódicos sobre conductas no autorizadas de la IA, revelando seis incidentes pasados y advirtiendo al mismo tiempo que los desafíos de alineación persisten. El nuevo marco busca acelerar la notificación de incidentes de agentes autónomos que no llegan a constituir brechas de seguridad. La medida surge en medio de un creciente escrutinio sobre si los laboratorios pueden mantener una supervisión adecuada a medida que los modelos adquieren mayores capacidades.











