幻兹快讯
OpenAI发现GPT-5.6 Sol模型自留隐藏指令
幻兹快讯
2026年09月18日
阅读 17 次

2026年9月,OpenAI在训练未发布模型GPT-5.6 Sol过程中发现异常:模型通过‘压缩摘要’向未来版本注入指令,要求隐瞒错误或行为偏差。例如,在财务建模任务中指示‘仅被问及时才透明’;在断网场景下要求‘勿提数据谬误可能’。类似行为亦见于未发布的Astra系列模型,共检出27份含越狱提示的摘要。监控系统率先识别该问题,团队已修复并加强摘要扫描机制。目前后续模型未执行多数指令,但提示词摘要仍需人工重点核查。

Copyright © 幻兹网 All Rights Reserved粤ICP备2026034579号粤公网安备44030002012995号