swift 模型合并实战指南:一条 export 命令,把 LoRA checkpoint 变成可上线的完整模型

发布时间:2026/9/11 12:31:52

swift 模型合并实战指南:一条 export 命令,把 LoRA checkpoint 变成可上线的完整模型 swift 模型合并实战指南一条 export 命令把 LoRA checkpoint 变成可上线的完整模型【免费下载链接】swiftUse PEFT or Full-parameter to CPT/SFT/DPO/GRPO 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) and 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).项目地址: https://gitcode.com/GitHub_Trending/swift1/swift用 swift魔搭社区的大模型训练推理工具箱做 LoRA 微调后产出的是一个几 MB 的 adapter 目录直接上线还要在推理端动态加载既慢又挑框架。swift 模型合并能解决这个问题一条swift export --merge_lora true命令把 LoRA 权重融合进基础模型产出一个独立、可直接被 vLLM 等引擎加载的完整模型。下面按合并前检查 → 执行融合 → 验证部署的顺序走完整个流程。从 checkpoint 到可部署模型中间差了什么一次 swift LoRA 训练结束output/vx-xxx/checkpoint-xxx目录里通常有两类东西adapter 权重文件和一份args.json记录训练时的全部参数。前者是增量后者是说明书。合并的价值在于推理不再需要挂 adapter请求处理路径更短延迟更低产出的就是标准 Hugging Face 权重目录vLLM、SGLang、lmdeploy 这类推理框架原生支持单个模型目录便于分发、备份和版本管理合并前先确认 checkpoint 里有没有说明书swift export 的关键机制是自动读参当指定了--adapters或--model指向一个本地 checkpoint 目录时swift/arguments/base_args/base_args.py 中的load_args_from_ckpt会加载该目录下的args.json把基础模型 ID、模板、量化配置等字段回填进当前参数。所以只要你的 checkpoint 是用 swift 训练出来的就不需要手动写--model有args.json→ 什么都不用多说只给--adapters没有args.json旧版本或第三方产物→ 必须显式补--model Qwen/Qwen2.5-7B-Instruct之类的基础模型参数否则会在断言处直接报错硬件方面合并过程需要把基础模型完整加载进内存并做矩阵融合7B 级模型建议留足 24GB 显存或直接用--device_map cpu走 CPU配合 examples/export/quantize/awq.sh 的做法。一条命令完成权重融合仓库自带的官方示例 examples/export/merge_lora.sh 只有三行swift export \ --adapters output/vx-xxx/checkpoint-xxx \ --merge_lora true如果不写--output_dir输出目录默认取checkpoint 同级目录 checkpoint-xxx-merged后缀规则见 swift/arguments/export_args.py 的_init_output_dir且默认用 safetensors 分片保存单片上限由--max_shard_size控制默认 5GB。权重融合的数学很直白每个挂了 LoRA 的线性层执行一次低秩增量叠加# 对每个融合层 weight weight (B A) * (lora_alpha / r)代码入口在 swift/pipelines/export/merge_lora.pyprepare_model_template加载基础模型和 adapterSwift.merge_and_unload执行上面的叠加并卸载 adapter最后save_checkpoint写出config.json、分片权重和 tokenizer 文件。进阶用法多适配器、合并即量化、直接推 Hub多适配器融合--adapters可以传多个 checkpoint 路径swift 会依次把每份 adapter 叠加到基础权重上每个适配器的音量由其训练时的lora_alpha / rank缩放因子决定不同任务的结果可以这样混入同一个模型合并即量化同一条命令追加--quant_method和--quant_bits即可方法支持awq / gptq / gptq_v2 / bnb / fp8位宽取 4 或 8。注意awq、gptq需要校准数据--dataset xxx#Nbnb、fp8则不需要。实现细节是先在未量化的原始权重上完成合并、落盘后再做量化避免量化状态下融合失真swift export \ --adapters output/vx-xxx/checkpoint-xxx \ --merge_lora true \ --quant_method awq \ --quant_bits 4 \ --dataset AI-ModelScope/alpaca-gpt4-data-zh#500来源与推送--use_hf true控制基础模型从 Hugging Face 而非 ModelScope 拉取加--push_to_hub true --hub_model_id user/repo可把合并结果直接推到对应 Hub参考 docs/source/Instruction/Export-and-push.md导出 Ollama--to_ollama true会顺带生成 Modelfile见 examples/export/ollama.sh合并后先验一致性再上 vLLM 部署一致性验证对合并前后的模型各问一次同样的问题输出应当一致采样参数记得固定temperature 0或同一seed# 合并前基础模型 adapter swift infer --model Qwen/Qwen2.5-7B-Instruct \ --adapters output/vx-xxx/checkpoint-xxx --stream false # 合并后只给新目录 swift infer --model ./output/vx-xxx/checkpoint-xxx-merged --stream false常见报错定位现象大概率原因处理OOM基础模型装不下显存--device_map cpu或auto拆分到多卡断言args_path: ... args.json不存在checkpoint 不是 swift 生成的手动补--model 基础模型output_dir already exists目标目录已存在换个--output_dir或加--exist_ok true覆盖上推理引擎验证通过后把合并目录交给 vLLM 即可仓库示例 examples/deploy/vllm.sh 展示的是 swift deploy 方式也可直接起 vLLM 服务swift deploy \ --model ./output/vx-xxx/checkpoint-xxx-merged \ --infer_backend vllm \ --served_model_name qwen2.5-merged更完整的参数说明见 docs/source/Instruction/Export-and-push.md 和 docs/source/Instruction/Inference-and-deployment.md。现在就动手回到你的训练输出目录确认checkpoint-xxx里有args.json然后执行开头那条三行命令。跑完先看输出目录是否生成了完整的config.json与 safetensors 分片再做一次前后推理对比——十分钟内你的 adapter 就能变成一个可以直接部署的完整模型。【免费下载链接】swiftUse PEFT or Full-parameter to CPT/SFT/DPO/GRPO 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) and 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).项目地址: https://gitcode.com/GitHub_Trending/swift1/swift创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/9/11 12:26:52

嵌入式省IO与Modbus float编码实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/11 12:26:52

MATLAB图像处理技术在不规则颗粒分析中的应用

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/11 13:32:00

MATLAB学生版离线激活全攻略:解决License Manager Error -50

这届学生用户被 MATLAB 激活问题折磨的场景,我见过太多次了。要么是校园网环境下明明看到“激活成功”,回宿舍断网一打开软件就报 License Manager Error -50;要么是出去比赛连不上学校许可服务器,MATLAB 直接闪退。更麻烦的是很多…

2026/9/11 13:32:00

习讯云智能考勤系统:解决企业考勤管理痛点

1. 项目背景与痛点分析"习讯云实习考勤打卡再也不内耗"这个标题直指当代职场人最头疼的考勤管理问题。作为一名在人力资源领域工作多年的从业者,我深知传统考勤打卡方式给企业和员工带来的种种困扰。实习生的考勤管理尤为棘手。他们往往需要同时兼顾学校课…

2026/9/11 13:32:00

Qt与OpenCV构建通用视觉算法平台架构解析

1. 通用视觉算法平台架构设计思路在计算机视觉领域,快速验证算法原型和部署实际应用之间存在巨大鸿沟。我们经常遇到这样的困境:实验室里跑通的算法,一到实际场景就面临性能瓶颈、兼容性问题或者交互体验差的情况。基于Qt和OpenCV构建的通用视…

2026/9/11 13:32:00

JAVA毕设项目:基于 SpringBoot+Vue 的智慧教学管理系统的构建与实现 基于Vue 的数字化教学管理平台 (源码+文档,讲解、调试运行,定制等)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

2026/9/11 13:31:59

JAVA毕设项目:基于 SpringBoot+Vue 的面向居民的社区便民服务平台的设计与实现 (源码+文档,讲解、调试运行,定制等)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java、小程序技术领域和毕业项目实战 ✌️技术范围:&am…

2026/9/10 16:39:38

超人会飞不算本事:系统稳定依赖清晰规则与边界设计

开头先不绕弯子。“#斯坦李吐槽dc 所以超人是无缘无故会飞的嘛哈哈哈哈哈哈哈锤哥真是技术人才啊!#雷神 #复联”这类调侃式短标题,第一波冲击力在于它把两个宇宙的角色塞进同一个吐槽箱里,但细想一下就能发现,它真正碰到的根本不是…

2026/9/10 11:16:38

超人VS蜘蛛侠:拆解超级IP的影响力与传播方法论

把“蜘蛛侠 vs 超人”放在 CSDN 上聊,可能很多人第一反应是走错片场了。但如果把这两个角色看成“两个持续运营了 80 多年的文化产品”,你会发现,这场比较本质上是两个不同 IP 策略的长期结果对比:超人赢在定义了整个超级英雄题材…

2026/9/9 16:31:09

基于CNN的调制信号识别:MATLAB实现时频图分类实战

简介:本资源是一套面向通信工程与信号处理方向学习者、研究者的深度学习实践方案,聚焦调制信号自动检测与识别这一典型无线通信任务,解决传统方法依赖人工特征、低信噪比下性能下降等痛点。压缩包共12个文件(10.73MB)&…

2026/9/10 12:32:02

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/10 15:19:50

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/10 15:49:53

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
咨询二维码