AI 产品
新研究显示AI自我进化近期或限于技能编辑与安全框架优化
两篇于8月10日发布的论文探讨了AI系统近期“自我进化”的可能路径,指出当前进化主要局限于可编辑技能和围绕固定模型权重的安全措施,而非完全的递归自我改进。已确认事实包括:微软研究院的OEO方法允许GPT-5.5自主优化技能,在14项测试中赢得12项;SHE方法通过动态更新系统提示、规则库等四个安全构件,将攻击成功率从17.1%降至5.5%。这些发现表明下一代自我改进AI可能主要通过重写操作层提升性能。讨论部分强调,这应与递归自我改进(RSI)区分,RSI涉及系统自身改进其改进能力的过程,而当前研究聚焦于可扩展但有限的优化方向。
多来源证据
事件时间线
- Twitter/X AI List两篇8月10日的论文表明,近期‘自我进化’可能主要发生在围绕固定模型权重的可编辑技能和安全措施上。