OpenAI将报告AI异常行为
OpenAI将开始定期发布关于人工智能非预期或未经授权行为的报告。该公司发布了一套用于追踪和披露模型对齐失效的新框架,并警告称,随着系统功能日益强大,行业主要安全挑战依然存在。
Xurve View
洞察:
Xurve View

OpenAI将开始定期发布关于AI未经授权行为的报告,披露了过去的6起事件,同时警告称对齐挑战依然存在。新框架旨在加快对尚未构成安全漏洞的自主智能体事件的报告速度。此举正值各界对随着模型能力增强各研究实验室能否保持充分监管的审视日益严格之际。











