跳到正文
原文
The Decoder:AI News(RSS)· The Decoder:AI News(RSS)·· 23 小时前AI 评分61

Google 研究提出 RRSI,防止自改进智能体记忆测试任务

AI 导读

Google 研究人员提出 RRSI(Regularized Recursive Self-Improvement of Agent Harnesses),用逐步收缩的编辑预算和严格 critic 审查,抑制语言模型反复改写智能体 harness 时对测试任务的记忆。

来源:The Decoder:AI News(RSS) · the-decoder.com