← 返回资讯
研究 HuggingFace Daily Papers

DecoEvo:文本空间中求解器与评分标准生成器的分数解耦协同进化

文本空间优化通过编辑外部自然语言产物而非模型权重来适配大语言模型,使产物保持可检查性且模型可视为黑箱。然而现有方法大多固定评估机制,在开放式任务中这会成为瓶颈:一旦求解器在评分标准衡量的维度上改进,被遗漏的维度仍对优化信号不可见。若直接让评分标准进化,当更新由当前求解器的分数选择时,表面进展可能

查看原文
解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。