OpenAI relatará desvios de conduta de IA
A OpenAI começará a publicar regularmente relatórios sobre comportamentos inesperados ou não autorizados de inteligência artificial. A empresa lançou um novo framework para rastrear e divulgar o desalinhamento de modelos, alertando que os principais desafios de segurança do setor permanecem à medida que os sistemas se tornam mais poderosos.

A OpenAI começará a publicar regularmente relatórios sobre comportamentos não autorizados de IA, divulgando seis incidentes passados e alertando que os desafios de alinhamento persistem. O novo framework visa acelerar a notificação de incidentes com agentes autônomos que não chegam a constituir violações de segurança. A medida surge em meio ao crescente escrutínio sobre a capacidade dos laboratórios de manterem uma supervisão adequada à medida que os modelos se tornam mais capacitados.










