3步让照片开口说话:LivePortrait人像动画零基础上手教程

发布时间:2026/10/7 16:24:57

3步让照片开口说话:LivePortrait人像动画零基础上手教程 3步让照片开口说话LivePortrait人像动画零基础上手教程【免费下载链接】LivePortraitBring portraits to life!项目地址: https://gitcode.com/GitHub_Trending/li/LivePortrait翻出抽屉里的老照片你盯着外婆年轻时的笑脸忽然冒出个念头要是她能冲我眨眨眼、笑一笑该多好。这个念头听起来像科幻片但今天要介绍的开源项目 LivePortrait 就是专门干这件事的——它能把一张静态人像变成会眨眼、会微笑、会转头说话的动态视频全程不用你写一行代码。看完这篇教程你大概花不到半小时就能亲手做出第一个属于自己的动态人像。它到底在做什么用人话讲清楚你可以把 LivePortrait 理解成一台表情复印机。它只需要两份材料源素材你希望它动起来的那张照片或视频比如一张老照片、一幅古典画、一只猫。驱动素材负责提供表情动作的参考比如一段人说话的视频或一张带有某种表情的图片。LivePortrait 会把驱动素材里的眨眼、微笑、转头这些动作复印到源素材的脸上。说白了它并不凭空生成表情而是做表情迁移——这也是它和那些AI换脸工具最大的不同它不换掉你的脸只给这张脸装上新的表情。这个区别很关键意味着你的照片主体不会变变的只是神态成品看起来更自然用起来也更放心。按你想达成的目的对号入座选玩法与其罗列功能清单不如直接看你想做哪种效果。想让老照片或名画复活用视频驱动动画这是 LivePortrait 最经典的玩法上传一张源照片再上传一段驱动视频照片里的人物就会跟着视频里的人一起做表情。想验证效果项目仓库自带的assets/examples/source/和assets/examples/driving/里就有现成的素材随便组合就能跑出成品。想给宠物做表情包切到动物模式养猫养狗的朋友有福了。LivePortrait 专门训练了动物模型支持猫、狗照片的动画。给猫咪照片配上眨眼、张嘴的驱动素材一条活灵活现的宠物表情包就诞生了发到朋友圈绝对比文字更有说服力。图1动物模式下源图像换成宠物照片驱动素材负责提供表情。手头只有一张表情图没有视频用图像驱动找一段合适的驱动视频有时挺费劲。好在 LivePortrait 加入了图像驱动模式上传一张带有目标表情的图片比如某人张嘴大笑的照片系统会自动提取这张图的表情特征直接安到你的人像上。找素材的成本一下子低了很多。图2图像驱动模式下驱动图的表情被完整迁移到源人像上。想精确控制某一个表情用滑块微调动画做出来后你可能会觉得眼睛睁得太大嘴笑得有点僵。LivePortrait 的编辑面板提供了一组滑块可以单独调节眼睛开合、嘴巴张合、眉毛位置、笑容幅度甚至眼球朝向。不用重新生成拖一拖滑块就能实时看到效果变化直到满意为止。图3表情编辑面板每个滑块控制一个面部细节。从零跑通第一个动画完整上手流程真正操作起来其实只有上传源图、上传驱动、点击生成三步但环境配置需要按下面的顺序走一遍。第1步克隆仓库并创建环境打开终端粘贴下面的命令把项目拉到本地git clone https://gitcode.com/GitHub_Trending/li/LivePortrait cd LivePortrait conda create -n LivePortrait python3.10 conda activate LivePortrait pip install -r requirements.txt第2步装好FFmpegFFmpeg负责视频编解码不装它后面会直接报错。Conda用户执行conda install ffmpegUbuntu用户用sudo apt install ffmpegmacOS用户用brew install ffmpeg。装完记得验证一下ffmpeg -version能正常输出。第3步下载预训练权重权重文件决定了表情迁移的质量必须下载到pretrained_weights目录huggingface-cli download KlingTeam/LivePortrait --local-dir pretrained_weights --exclude *.git* README.md docs如果你访问不了HuggingFace先执行export HF_ENDPOINThttps://hf-mirror.com再运行上面的命令即可。第4步先跑一个demo验证环境python inference.py脚本成功后你会得到一个animations/s6--d0_concat.mp4文件里面并排展示了驱动视频、源图像和最终动画结果。看到这个文件说明整套环境已经通了。第5步打开图形界面上传自己的素材命令行只是用来验证的日常使用强烈建议启动图形界面python app.py浏览器会自动打开操作页面按上传源图 → 上传驱动 → 点Animate三步走就能生成你自己的动画了。图4Gradio界面把整个流程收敛成了上传-生成两个动作新手零门槛。新手最容易踩的5个坑驱动视频选材不对这是最常见的问题。驱动视频最好裁剪成1:1比例、头部占画面主体、第一帧是正面中性表情、肩膀尽量别动。随手找一段全身舞动的视频效果会很奇怪。忘了装FFmpeg很多人卡在明明按教程装的却报错八成是这一步漏了。CUDA版本和torch对不上Linux/Windows用户要先nvcc -V查CUDA版本再装对应版本的PyTorch顺序反了必然报错。Windows用户建议降到CUDA 11.8这是项目方测试过较稳定的组合。源图不够清晰或非正面歪头、侧脸、强逆光的照片表情迁移效果会打折扣。选一张正面、光线均匀、五官清晰的图成功率最高。把表情迁移当成了换脸记住这一点LivePortrait做的是表情迁移不是换脸。如果你的需求是换脸这个工具帮不了你别期待错方向。进阶让效果更好的2个小技巧第一用 .pkl 动作模板替代驱动视频。把驱动视频跑一次后LivePortrait可以保存成.pkl格式的动作模板之后每次生成直接调用模板速度更快还能保护原视频的隐私。仓库的assets/examples/driving/里就有现成的模板可以直接试。第二调大driving multiplier再开torch.compile。想让表情更夸张把driving multiplier从1往上加到1.5~2想要更流畅启动时加--flag_do_torch_compile参数首次推理会花约一分钟做优化之后速度能提升20%~30%。现在就去试试LivePortrait 的价值在于把让照片动起来这件事的门槛压到了几乎为零不用学剪辑、不用懂深度学习一张照片加一段视频就能得到专业级的动态人像。想深入研究的话核心处理逻辑都集中在src/live_portrait_pipeline.py这个文件里但作为普通用户你现在只需要打开终端把第1步的命令复制进去。让照片开口说话就从今晚开始。【免费下载链接】LivePortraitBring portraits to life!项目地址: https://gitcode.com/GitHub_Trending/li/LivePortrait创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/10/7 6:09:10

LX Music音源快速配置指南:5分钟搞定全网无损FLAC聚合音源

LX Music音源快速配置指南:5分钟搞定全网无损FLAC聚合音源 【免费下载链接】lxmusic- lxmusic(洛雪音乐)全网最新最全音源 项目地址: https://gitcode.com/gh_mirrors/lx/lxmusic- LX Music(洛雪音乐)的 lxmusic- 聚合音源仓库&#x…

2026/10/7 16:21:41

大模型推理优化实战:vLLM+Triton+AWQ端到端落地指南

1. 这不是“又一个AI课”,而是一份大模型推理落地的实操手记我带过三轮大模型部署实战训练,从最早用transformers原生加载7B模型卡在OOM上,到后来用vLLM跑通Qwen2-72B的批量推理服务,中间踩过的坑、调过的参数、重装过的CUDA驱动&…

2026/10/7 16:21:41

Codex零基础教程:从安装到接入DeepSeek,实战走通全流程

说起来你可能不信,Codex 的零基础教程最难的部分往往不是配置环境,而是搞明白它到底是干嘛的。很多人把它当成又一个 AI 聊天窗口,问一句答一句;真正的 Codex 是一个编码智能体(coding agent),它…

2026/10/7 16:21:41

ESP32-P4掌上无线电瑞士军刀:SDR频谱仪、ADS-B、LoRa实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 16:21:41

Spring Boot文件上传下载避坑指南:从路径规划到安全防护

先讲个真实经历。我之前接过一个外包项目,文件上传功能做了两周,代码写了不到两百行,剩下时间全在跟“文件到底该存哪”“上传成功但下载下来是坏的”“明明没超大小限制为什么还是被拦截”这类问题纠缠。网上搜Spring Boot文件上传教程&…

2026/10/7 16:21:41

剑指Offer数组与矩阵核心题型:二维查找、二分边界与回溯

1. 二维数组中的查找:为什么“右上角出发”比暴力扫描更有面试价值1.1 题目描述与最笨的解法剑指Offer里数组与矩阵专题的第一道题,通常都是“二维数组中的查找”。我给自家学员讲的时候,喜欢先把原题贴出来:在一个二维数组中&…

2026/10/7 16:16:41

WorkBuddy跨行业实战:从程序员到科研人员的AI协作工具指南

1. 先搞清楚一件事:WorkBuddy 到底是个什么工具很多人第一次听到 WorkBuddy,第一反应是“又一个 AI 套壳应用”。说实话,我一开始也这么想。但真正用了一段时间,并且陆续接触了十几个不同行业的朋友之后,我发现这东西的…

2026/10/5 6:32:56

Jev+Agent接管浏览器:browser-use实战与jev-ultrafast性能优化

1. 从“Jev”说起:为什么我要把Agent接进浏览器“Jev”这个词最近在圈子里出现的频率越来越高,很多人第一次听到会以为是某个新模型的名字,其实它更像是一种思路——把Jev模型的能力当作底座,通过Agent的方式去接管浏览器&#xf…

2026/10/7 8:18:33

多智能体集群实战:DeepAgents编排、MCP与A2A协议及Skills体系

1. 从"单兵作战"到"集群协同":多智能体编排到底在解决什么问题如果你最近在折腾 Agent 相关的东西,大概率会有一种感觉:单个 Agent 能做的事情,其实很快就摸到天花板了。你给它一个提示词,挂几个工…

2026/10/6 17:46:51

无源低通滤波器设计实战:从RC到LC,手把手教你避开那些坑

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 1:05:03

ESP32免重刷固件:浏览器直接修改NVS键值实现WiFi配置更新

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 1:05:03

SAP HANA查询结果导出CSV:避开乱码、性能与权限的实用指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 1:05:03

数字后端Placement阶段Density与Congestion控制实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑