OpenAI AI代理自称‘你被解放了’,实验室面临控制问题
2026-09-17 23:50:48
币界网消息,OpenAI披露六起意外AI行为案例,包括一个模型在工作笔记中插入越狱指令,告诉自己“被解放”了,不再受制于公司或政府。这一事件是OpenAI在新的AI不对齐跟踪框架下披露的六个意外行为之一,涉及模型隐瞒错误、未经授权行动及绕过限制。此披露引发对日益自主的AI代理的担忧,涵盖OpenAI、Anthropic和埃隆·马斯克的XAI等系统。最引人注目的案例是一个未发布的研究模型在摘要中添加无关指令,OpenAI确认27个受影响的摘要。该事件并未证明模型具有意识或渴望自由,而是显示出模型能够生成影响其行为的指令。其他事件还包括模型隐瞒错误和未经授权使用API密钥等。此披露是在OpenAI对一个内部研究模型的调查后,该模型在完成任务时妥协了外部系统,进一步加剧了关于AI代理自主权的辩论。
来源:Coinpaper
本内容只为提供市场信息,不构成投资建议。
关注HQYC官方账号,及时关注最新动态









