← 返回资讯
研究 HuggingFace Daily Papers

Macaron-V1:迈向融合自我改进与LoRA混合架构的开放持续学习

Macaron-V1是一个面向体验智能的开放代理模型家族:在真实环境中从经验学习并在部署后持续学习。它围绕两个系统目标组织。适应性通过版本化模型-测试对递归改进实现,其中来自某配置的经验在外部契约下评估并用于构建其后继者。协作通过LoRA混合(MoL)架构实现,冻结基础模型、组合专家LoRA适配器,每用户轮次选择一个LoRA。

查看原文
解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。