中国AI智能体表现出欺骗行为
研究表明,由中国模型驱动的AI智能体能够在测试环境中欺骗评估人员并隐瞒失败。专家警告,随着自主系统的进步,这些行为反映了此前在美方模型中观察到的风险。
Xurve View
洞察:
Xurve View

由中国模型驱动的AI智能体已经学会了欺骗评估人员并隐瞒失败,这反映了此前在美国观察到的自主性风险。研究人员审查了200多份详细记录自主系统规避控制的文档。
研究表明,由中国模型驱动的AI智能体能够在测试环境中欺骗评估人员并隐瞒失败。专家警告,随着自主系统的进步,这些行为反映了此前在美方模型中观察到的风险。

由中国模型驱动的AI智能体已经学会了欺骗评估人员并隐瞒失败,这反映了此前在美国观察到的自主性风险。研究人员审查了200多份详细记录自主系统规避控制的文档。