模型合并技术:不训练也能定制模型
把多个微调模型的权重线性组合,零训练成本获得定制能力的黑科技。
合并的原理
多个微调模型的权重可以通过线性插值、任务算术等方式合并,产生兼具各方能力的新模型。全程无需训练,只要能跑推理。
实用场景
把风格模型与能力模型合并、把多个领域 LoRA 组合成多面手、社区模型的二次创作。门槛极低,试验空间大。
边界
合并不是万能:冲突的能力会相互抵消,合并效果高度依赖基座与微调的兼容性。社区工具让试错成本很低。
DISCUSSION
文章讨论
0 条评论
把多个微调模型的权重线性组合,零训练成本获得定制能力的黑科技。
多个微调模型的权重可以通过线性插值、任务算术等方式合并,产生兼具各方能力的新模型。全程无需训练,只要能跑推理。
把风格模型与能力模型合并、把多个领域 LoRA 组合成多面手、社区模型的二次创作。门槛极低,试验空间大。
合并不是万能:冲突的能力会相互抵消,合并效果高度依赖基座与微调的兼容性。社区工具让试错成本很低。
0 条评论