微资讯 · 来源报道 Agent 安全也能自进化?SafeEvolve 让 Harness 与 Policy 从安全经验中共同进化 BestBlogs 中文 AI 2026-09-09 返回首页 阅读原文 SafeEvolve 通过轨迹驱动的 Harness 演化与两阶段 SFT-RL 训练,让 Agent 的安全机制与模型 Policy 从真实执行经验中协同进化,在 AgentDojo 和 AgentHarm 上显著降低攻击成功率并提升任务效用。 回首页继续看 →