Pixelle-Video:输入一句话主题,自动配图文和配音的AI短视频成片自己跑出来

发布时间:2026/10/7 2:40:09

Pixelle-Video:输入一句话主题,自动配图文和配音的AI短视频成片自己跑出来 Pixelle-Video输入一句话主题自动配图文和配音的AI短视频成片自己跑出来【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video在「内容输入」框敲下「为什么要养成阅读习惯」点「生成视频」转身去倒杯咖啡。回来时文案、配图、解说、合成四段进度条已依次走完output/目录里躺着一支竖屏成片水墨山峦做画面沉稳的嗓音在念稿底下压着一段轻 BGM。这就是Pixelle-Video一个 AI 全自动短视频生成引擎的日常使用画面。先把最劝退的环境问题交代清楚。没装过开发环境三行命令跑起AI短视频引擎Windows 用户最省事下载官方整合包解压后双击start.bat浏览器会自动打开http://localhost:8501Python、uv、ffmpeg全都打包在里面不用手动装任何依赖。macOS 或 Linux 用户先装好uv和ffmpeg然后在终端执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video uv sync uv run streamlit run web/app.py首次运行时展开「⚙️ 系统配置」面板你只需要填一个 LLM 密钥——通义千问、GPT、DeepSeek、Ollama 都认选预设会自动填好模型地址。图像生成用默认的 RunningHub 云端即可不需要本地显卡。你只负责「填密钥」和「敲主题」两件事剩下它自己跑。从一句话到分镜AI自动生成短视频脚本主题交出去之后大模型产出的不只是一段解说词它顺手把分镜切好了——每个分镜对应一段画面后面的配图和配音都由这份脚本驱动。做知识科普类内容这里藏了个小技巧把 LLM 的temperature调低一些输出会更克制、更有条理适合需要严谨结构的选题。已经有成稿的话直接走「固定文案」模式整段贴进去分割方式支持按段落、按行、按句子三种选按句子切每一句配一张图画面切换更密集短视频的节奏感一下就上来了。 固定文案模式下一句话就是一张图。想让解说不断句就把句子写短一点。画面交给模板从静态配图到动态短片系统会给每个分镜自动生成一张 AI 插画风格完全跟着你选的模板走。templates/目录按分辨率分了三档竖屏 1080x1920、横屏 1920x1080、方形 1080x1080Web 界面里有模板预览先看效果再决定不用凭文件名盲猜。image_book.html的书卷气质压得住知识科普image_film.html的黑底横版则更像正片。说白了模板就是一套 HTML 布局文件文字位置、背景、排版都由它决定想调整风格改改样式就行。如果静态图还不够带感把图像生成切换到 WAN 2.1 这类视频模型每个分镜的画面就真正动起来图文视频升级成动态短片。配音与BGM一次配齐还能克隆你自己的声音TTS 环节内置了 Edge-TTS、Index-TTS 等主流方案下拉选一个旁白就自动配好了点「预览语音」还能先试听。想要更有辨识度上传一段10-30 秒的清晰人声做参考音频选支持克隆的工作流如 Index-TTSEdge-TTS 不支持系统就能克隆这个音色——做系列内容时每条视频都带着同一个个人声音。BGM 同样不操心内置音乐直接选也可以把自己的音频文件放进bgm/文件夹界面上就会出现可选项点「试听 BGM」确认一下再开始生成。一晚跑完十条批量模式的点菜清单批量模式是这台引擎真正的效率放大器。勾选「批量生成模式」每行写一个主题最多 100 个所有视频共用同一套配置开跑前页面会先给出预估总耗时。照着抄就能跑的一份清单模式AI 生成内容 批量模式主题10 行每行一个比如「居家训练」系列十条LLM通义千问图像RunningHub 云端按量付费TTSEdge-TTS模板竖屏image_modern.html1080x1920适配抖音和视频号BGM内置音乐算笔账十条视频手动拍摄剪辑工作量通常是几天起批量模式下一个晚上排完队就能收工。成本上云端图像按张计费加上每条视频几次 LLM 调用总花费远低于一天的人工。批量生成期间保持页面打开跑完的成片会统一进「 历史记录」页方形模板image_minimal_framed.html这类 1080x1080 规格也适合需要多平台铺开的场景。没有独立显卡挑一条适合自己的路两条路径按机器选。只有一台普通笔记本文案走 API图像走 RunningHub 云端按调用付费配音用 Edge-TTS——全程不占本地显卡照样出片。数据默认存在本地output/目录只有调用云端 API 时才发送必要内容。手里有 NVIDIA 显卡LLM 切到本地 Ollama图像生成指向本地 ComfyUI默认http://127.0.0.1:8188语音用 Edge-TTS。整套流程 API 费用为零数据全部留在本机连数据出境的顾虑都省了。几个大家都会犹豫的问题完全没剪辑经验能上手吗能。整个流程被抽象成「输主题—选模板—点生成」全部操作在浏览器里完成不接触任何剪辑软件和代码。生成一支视频要等多久常见耗时几分钟主要取决于 LLM 响应速度、图像生成的排队情况和网络状况批量任务会依次排队开跑前还会显示预估总耗时。数据会被上传到第三方吗数据默认保存在本地output/目录只有调用云端 API 时才会发送必要数据走本地 Ollama ComfyUI 路线可以做到数据完全不出本机。能商用吗项目采用 Apache License 2.0 协议可以自由使用与二次开发个人创作者和中小团队都能直接搬进自己的内容生产线。视频制作里最硬的那块环节被拆掉了剩下选题、表达和对画面的判断这些是你的主场。你第一个要生成的主题想好了吗【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/10/7 2:35:09

第13章 前端Web实战(Tlias案例)

一、开发模式 主流:前后端分离 1、什么是前后端分离开发模式? 前后端开发人员独立开发,独立部署 2、需求的开发流程? 需求分析->接口定义->前后端并行开发->测试->前后端联调测试 二、整体布局 1、准备工作 在vite.confi…

2026/10/7 2:35:09

第14章 项目部署(Linux)

一、课程概述二、Linux概述1、系统安装(1)介绍Linux系统分为内核版和发行版内核版由Linux核心团队开发、维护免费、开源负责控制硬件发行版基于Linux内核版进行扩展由各个Linux厂商开发、维护有收费版本和免费版本Linux系统发行版:Ubuntu&…

2026/10/7 3:40:12

基于DBSCAN密度聚类的风电-负荷联合场景削减MATLAB实现

做随机优化的人应该都有过这种体验:风电场景刚生成了一大堆,两阶段规划还没来得及跑,内存先撑不住了。我手头有个含风电接入的机组组合算例,初始场景数4000,每场景24个时段,叠加负荷不确定性后,…

2026/10/7 3:40:12

2026 Java基础面试高频考点全解析:集合、JVM、并发与备考路线

2026年了,Java技术栈堆得越来越高:微服务、云原生、AI应用,随便一个岗位描述都能列出一长串框架要求。但我在一面后台看候选人时发现一个规律始终没变——真正决定去留的,往往还是Java基础。这篇汇总把Java基础面试高频考点拆成六…

2026/10/7 3:40:12

PHP对接硬件实战:从扫码枪到打印机,打通仓库系统链路

搞了快十年PHP,大部分时间都在写Web接口和后台管理系统,直到有个做仓储的朋友丢过来一个活:让我给他仓库做个出入库系统,扫码枪扫完条码要把数据送进PHP后台,货单还要用打印机打出来。说实话,刚接到这个需求…

2026/10/7 3:40:12

AI绘画工作流实战:从文生图到智能扩图的完整指南

说句实在话,现在玩AI绘画,最让人上火的不是画不出来,而是画出来的和你脑子里想的完全是两回事。我见过太多人憋了一晚上,最后只等来一张构图歪、手指崩、风格跑偏的图,然后骂一句“AI就这水平”就关掉了页面。其实问题…

2026/10/7 3:35:11

Allegro 17.4差分走线与间距规则深度解析

1. 项目概述:为什么差分走线与间距规则是Allegro 17.4里最常被低估的“系统级开关”在Cadence Allegro 17.4的PCB Editor中,很多人把差分走线当成“画两根挨得近的线”,把间距规则当成“设置几个数字填进对话框”。我带过十几支硬件设计团队&…

2026/10/5 6:32:56

Jev+Agent接管浏览器:browser-use实战与jev-ultrafast性能优化

1. 从“Jev”说起:为什么我要把Agent接进浏览器“Jev”这个词最近在圈子里出现的频率越来越高,很多人第一次听到会以为是某个新模型的名字,其实它更像是一种思路——把Jev模型的能力当作底座,通过Agent的方式去接管浏览器&#xf…

2026/10/6 4:01:51

多智能体集群实战:DeepAgents编排、MCP与A2A协议及Skills体系

1. 从"单兵作战"到"集群协同":多智能体编排到底在解决什么问题如果你最近在折腾 Agent 相关的东西,大概率会有一种感觉:单个 Agent 能做的事情,其实很快就摸到天花板了。你给它一个提示词,挂几个工…

2026/10/6 17:46:51

无源低通滤波器设计实战:从RC到LC,手把手教你避开那些坑

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 1:05:03

ESP32免重刷固件:浏览器直接修改NVS键值实现WiFi配置更新

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 1:05:03

SAP HANA查询结果导出CSV:避开乱码、性能与权限的实用指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/7 1:05:03

数字后端Placement阶段Density与Congestion控制实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑