RedAct:删除智能体能力追踪记录以保护程序化技能
用户依赖执行追踪记录来观察智能体行为、诊断故障和确保问责,但这些记录会暴露关键公式、阈值和策略等私人程序化技能。为量化风险并评估保护,研究者构建了包含75个专业长时任务和154个跨七领域技能的基准CapTraceBench,并推出RedA工具。
查看原文解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。
用户依赖执行追踪记录来观察智能体行为、诊断故障和确保问责,但这些记录会暴露关键公式、阈值和策略等私人程序化技能。为量化风险并评估保护,研究者构建了包含75个专业长时任务和154个跨七领域技能的基准CapTraceBench,并推出RedA工具。
查看原文