从一句话到一支成片,我只用了四分钟——这款开源AI短视频引擎把剪辑流水线搬进了浏览器

📅 2026/8/20 21:54:15
从一句话到一支成片,我只用了四分钟——这款开源AI短视频引擎把剪辑流水线搬进了浏览器
从一句话到一支成片我只用了四分钟——这款开源AI短视频引擎把剪辑流水线搬进了浏览器【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video上个月我答应给朋友的读书账号做一支讲阅读习惯的竖屏短视频。本想着两个晚上搞定结果光是找素材、掐字幕、卡节奏就耗掉一整个周末最后成品还被自己嫌弃是会动的PPT。就在我准备彻底放弃短视频这件事时朋友丢来一个开源项目 Pixelle-Video——一款 AI 全自动短视频引擎你只需要输入一句主题文案撰写、AI配图、语音解说、背景音乐和最终合成全自动完成全程不用碰任何剪辑软件。我的实验环境没有Windows整合包两行命令照样开跑我手上是一台 macOS 笔记本没有显卡也等不及下载整合包。好在项目文档写得很直白先装好uv和ffmpeg然后把仓库拉下来、同步依赖、启动 Web 界面一共三行命令git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video uv sync uv run streamlit run web/app.py浏览器自动弹出http://localhost:8501左侧是「 内容输入」面板右侧是成品预览区。配置比我想象中简单文案模型我选了通义千问图像生成接入 RunningHub 的云端服务本地没有显卡也能跑按量付费配音用默认的 Edge-TTS。全程大概花了几分钟填密钥没有任何本地环境要折腾。第一次生成我踩了个视觉品味的坑我输入为什么要养成阅读习惯这个主题随手勾了一个霓虹风格模板就点了「 生成视频」。界面立刻进入四阶段进度文案生成、AI配图、语音合成、视频合成进度条一个接一个地亮起来比我手动剪片子省心太多。4分多钟后一支 5 个分镜的竖屏视频出现在预览区MP4 文件躺在output/目录里。但问题也来了——把阅读习惯这种温吞的知识内容配上一身赛博朋克霓虹光效怎么看怎么违和。我这才意识到模板选型才是这支视频的灵魂。好在 Web 界面自带模板画廊可以先把效果图看个遍再决定不用凭文件名盲猜。我换成templates/1080x1920/image_book.html的书籍风格黑白水墨搭配书籍排版和阅读主题严丝合缝情感类选题则更适合image_healing.html的治愈风书法笔触配水墨留白节奏一下子就柔软下来让画面真正动起来的几个开关第二次生成时我开始认真研究那些藏在界面里的选项才发现第一批视频只用到了皮毛。先说画面。每个分镜默认配一张 AI 插画但如果想让画面真的动起来可以把图像模型切成 WAN 2.1 这类视频模型静态插画就变成了动态镜头。横屏场景也有对应模板templates/1920x1080/目录下的image_film.html走的是黑白电影海报质感适合做影评、科普这类需要高级感的内容再说文案。如果你手里已经有写好的稿子可以选择固定文案内容模式并按句子而不是段落分割——每一句话配一张图画面切换更密集节奏也更抓人。我在第三次实验里把语速调到 1.1 倍讲解的力度感立刻不一样了。风格这块也值得多说两句。同样一个主题换一个模板就是完全不同的气质image_modern.html的紫调几何风格适合科技、数码类账号image_neon.html的霓虹光效则适合游戏、潮流内容。把两种风格并排放在一起看差异非常直观中途翻车排队等待和一把跑偏的调参实验进行到第四支视频时我在「⚙️ 系统配置」里把文案模型的temperature从默认值调到了 0.9想看看会不会更有创意。结果解说词飘得离谱满嘴比喻知识点的严谨性全丢了。翻回config.example.yaml一看文档里建议调到 0.5 左右——克制、有条理才是知识类内容的正确姿势。调回去重跑立刻正常。另一个反复出现的小插曲是排队。云端图像生成是按量付费的高峰期经常要等上一两分钟进度条亮着但画面不动第一次遇到时我差点以为卡死了。其实耐心等就行batch 模式下次还会排队依次处理。一次批量实验一晚上产出十条视频第五步我试了批量模式勾选批量输入框里每行一个主题系统逐个生成独立视频。我拿健身内容练手一口气丢进去十条居家训练选题第二天早上起来十支成片整整齐齐排在output/目录里。单条成本几乎可以忽略——云端图像按张计费通义千问的文案调用费不到 GPT-4 的十分之一。如果想让系列视频有统一的个人标识TTS 设置里可以上传一段 10 秒以上的清晰人声系统会克隆这个音色之后所有视频都用你的声音解说。我给读书账号的三支视频做了音色克隆朋友反馈一听就是你。什么人适合用它什么人先别急把话也说回来这款工具不是万能药。如果你运营的是知识科普、情感语录、书籍摘录这类文字驱动的内容账号它几乎能包办一切你只需要提供选题如果你要的是复杂的运镜、多机位转场、电影级分镜设计它目前还做不到得靠传统剪辑兜底。另外云端按量付费意味着高频使用时会有持续的 API 开销纯免费用户可以把 LLM 切到本地 Ollama、图像指向本地 ComfyUI做到零费用、数据不出本机但要自己折腾一番。我的建议很直接别管什么技巧清单了先跑通一支视频再说。找到仓库把命令粘贴进终端在「 内容输入」里敲下你脑子里那个酝酿已久的选题——四分钟后一支有旁白、有配图、有 BGM 的成片就会出现在预览区。那种我只给了一句话它却还了我一支视频的感觉读十遍介绍都体会不到亲手上一次就知道了。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考