资讯详情

Pixelle-Video Web UI 界面化操作指南:三栏工作台与全自动短视频生成实战

📅 2026/9/10 14:38:48 | 华诺云谱 👁 阅读
Pixelle-Video Web UI 界面化操作指南:三栏工作台与全自动短视频生成实战
Pixelle-Video Web UI 界面化操作指南三栏工作台与全自动短视频生成实战【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 的 Web 界面基于 Streamlit 构建将内容输入 → 语音与视觉风格配置 → 视频生成与预览整条 AI 全自动短视频链路封装为可视化操作台。本篇指南以官方 Web UI 文档为主体结合仓库源码深入讲解界面布局、系统配置、内容输入、TTS 语音设置、模板画廊与视频生成流程读者完成后可独立完成从主题输入到成片下载的完整操作并理解每一步背后的模块调用关系。界面总览三栏工作台与侧边栏Pixelle-Video 的 Web 界面采用经典的三栏工作台布局web/pipelines/standard.py 中以st.columns([1, 1, 1])实现区域位置承载功能左栏Left Panel内容输入与音频BGM设置中栏Middle Panel语音TTS与视觉风格设置右栏Right Panel视频生成与预览输出侧边栏Sidebar系统配置与 FAQ 快捷查阅从入口实现看整个 Web 应用是一个 Streamlit 多页应用web/app.py通过st.navigation注册了Home首页与History历史两个页面默认进入 Home 首页。首页在初始化会话状态与国际化i18n后依次渲染页头、侧边栏 FAQ、系统配置区域并以 Tab 形式列出所有已注册的 Pipeline UIweb/pages/1__Home.py包括快速创作、素材创作等流程经典三栏布局即快速创作Standard PipelineTab 的默认形态。界面背后的源码支撑左栏组件位于 web/components/content_input.py内容输入 BGM、中栏组件位于 web/components/style_config.pyTTS 模板 媒体生成、右栏组件位于 web/components/output_preview.py生成按钮、进度、预览、下载。首次使用系统配置首次使用前必须完成 LLM 与图像/视频生成服务的配置否则系统会提示未配置。详细配置项可参考 Configuration Guide。在首页的系统配置Settings折叠区未配置时自动展开已配置时自动收起可以看到两列配置界面实现见 web/components/settings.py1. LLM 设置快速预设Quick Preset下拉选择预置的 LLM 服务如 Ollama 等选择后自动填充 base_url 与 model也可选择 Custom 手动填写。API Key必填密码输入框切换预设时会保留已保存的 Key 或清空。Base URL必填服务地址例如 Ollama 本地地址。模型选择内置自定义模型选项 已加载模型列表。可点击 Load Models调用fetch_available_models从服务端拉取可用模型列表或点击 Test Connection调用test_llm_connection验证连通性这两个函数位于 pixelle_video/utils/llm_util.py。三个字段API Key、Base URL、Model缺一不可保存时会先校验完整性再写入配置。2. ComfyUI / RunningHub 设置媒体生成既可以走本地自托管 ComfyUI也可以走 RunningHub 云端本地 ComfyUI填写comfyui_url默认http://127.0.0.1:8188与可选comfyui_api_key可点击 Test Connection 请求/system_stats接口验证。RunningHub 云端填写runninghub_api_key可配置并发上限runninghub_concurrent_limit范围 1–10默认 1与实例类型24G / 48G 显存48G 对应配置值plus用于启用更大显存能力的工作流。3. API 媒体模型直连提供商该区域用于直接调用云端图像/视频模型不影响上方 LLM 与 ComfyUI/RunningHub 配置支持四类提供商OpenAI / GPT ImageAPI Key、Base URL默认https://api.openai.com/v1、可选代理开关。DashScope / Wan通义万相API Key、Base URL默认https://dashscope.aliyuncs.com/api/v1。Volcengine ARK / Seedream / SeedanceAPI Key、Base URL默认https://ark.cn-beijing.volces.com/api/v3。Kling AI可灵Base URL、Access Key、Secret Key。此外还有一个打印模型请求参数调试开关print_model_input与可选本地代理local_proxy仅部分提供商如图像模型使用。点击保存配置后LLM、ComfyUI、API 提供商三部分会统一写入config.yaml并刷新界面点击重置配置则恢复默认配置。内容输入左栏左栏第一部分是内容输入区web/components/content_input.py同时支持单任务与批量两种模式。生成模式Generation ModeAI Generate ContentAI 生成内容只需输入一个主题Topic系统调用 LLM 自动生成完整视频脚本此时可额外设置标题Title可选作为视频标题分镜数量Number of Scenes滑块范围 3–30默认 5即 AI 将脚本划分为多少个场景文本输入框高度为 120px占位提示引导输入主题。Fixed Script Content固定脚本内容直接输入完整脚本系统不再调用 LLM 生成内容文本输入框高度提升到 200px 以便容纳较长文本同时显示提示分镜数量由脚本内容决定场景数滑块不生效n_scenes被忽略。固定脚本分割模式Fixed Script Split Mode使用固定脚本模式时必须选择如何把文本切分为分镜场景。分割选项定义于 web/i18n/locales/en_US.json默认按段落分割分割模式规则说明By Paragraph按段落按空行\n\n切分每个段落成为一个场景默认选项适合段落结构清晰的脚本By Line按行按换行符\n切分每一行成为一个场景适合每行一句的排版By Sentence按句子智能句边界检测句号、感叹号、问号等每个句子成为一个场景适合自然语言长段落背景音乐BGM左栏下部为 BGM 设置区render_bgm_section内置音乐自动扫描仓库 bgm/ 与data/bgm/目录下的音频文件支持.mp3、.wav、.flac、.m4a、.aac、.ogg通过下拉框选择若存在default.mp3则默认选中。自定义音乐将音频文件放入上述目录后刷新即可出现在列表中。音量控制滑块范围 0.0–0.5默认 0.2仅在选中 BGM 时显示。试听提供 BGM 预览按钮选中后可直接在页面内播放试听。批量模式Batch Mode勾选批量模式后可在文本框内按行输入多个主题每行一个系统会自动过滤空行最多支持 100 个主题可设置统一标题前缀与分镜数量3–30默认 5然后以共享配置批量生成多支视频进度与结果统计总数/成功/失败在右栏展示并引导跳转到 History 页面查看批量执行逻辑见 web/utils/batch_manager.py。语音设置中栏中栏的 TTS 区域实现于 web/components/style_config.py负责语音合成支持两种推理模式。TTS 工作流选择Local 本地模式默认直接使用 Edge-TTS 服务无需额外工作流。可配置音色Voice从预置音色库中选择。预置音色定义于 pixelle_video/tts_voices.py覆盖中英文例如zh-CN-XiaoxiaoNeural女、zh-CN-YunjianNeural男默认、zh-CN-YunxiNeural男、en-US-AriaNeural女等语速Speed滑块范围 0.5x–2.0x步长 0.1默认 1.2x。ComfyUI 模式选择 TTS 工作流如 RunningHub 的tts_index2.json、自托管的tts_edge.json等工作流文件位于 workflows/并可上传参考音频用于音色克隆。参考音频Reference Audio上传参考音频后系统先提供在线试听再保存到temp/目录并作为ref_audio参数传给 TTS 服务。支持格式MP3 / WAV / FLAC源码中同时兼容 M4A、AAC、OGG。语音试听TTS Preview两种模式下均可在折叠区输入试听文本默认大家好这是一段测试语音。点击预览按钮后调用pixelle_video.tts(...)生成音频并直接播放同时显示音频文件路径方便在正式生成前确认音色与语速效果。视觉设置中栏图像 / 视频生成当所选模板需要 AI 生成媒体素材image_*.html需要图像、video_*.html需要视频时中栏会显示媒体生成配置区生成来源Generation Source三种来源可选RunningHub云端工作流如runninghub/image_flux.json、runninghub/video_wan2.2.jsonSelfhost本地自托管工作流如selfhost/image_flux.json、selfhost/video_wan2.1_fusionx.jsonAPI直连云端模型提供商DashScope、ARK、Kling 等其中文生视频 API 模型需要已配置且通过验证才会出现在列表。媒体尺寸自动继承所选模板的解析尺寸宽 × 高以只读信息展示。Prompt 前缀Prompt Prefix文本输入框用于统一控制生成风格实际调用时通过build_image_promptpixelle_video/utils/prompt_helper.py将测试提示词与前缀拼接为最终 prompt。媒体预览可输入测试提示词图像默认a dog视频默认a peaceful lake, gentle camera movement试生成一张图或一段视频实时验证工作流与风格视频预览支持设置默认画幅依据模板自动推断 9:16 / 16:9 / 1:1。若模板为静态模板static_*.html无需 AI 媒体则该区域仅显示提示信息不展示工作流选择。视频模板Video Template模板选择区是视觉设置的核心采用类型 尺寸 画廊三级组织模板预览画廊Template Preview Gallery以网格形式5 列直观展示所有可用模板的预览图预览图自动从 docs/images/ 按语言加载中文界面使用中文版预览图其他语言使用_en后缀版本无预览图的模板显示占位卡片点击选择按钮即可选中。支持尺寸竖版 1080×1920、横版 1920×1080、方形 1080×1080按尺寸自动分组为 Tab标签形如Portrait 1080×1920。模板类型通过static_/image_/video_前缀自动识别逻辑见 pixelle_video/utils/template_util.py类型命名规则说明静态模板static_*.html纯 HTML/CSS 排版无需 AI 生成媒体图像模板image_*.html需要 AI 生成图像素材视频模板video_*.html需要 AI 生成视频素材实际模板文件存放于 templates/1080x1920、templates/1920x1080、templates/1080x1080。模板自定义参数选择模板后系统通过HTMLFrameGenerator.parse_template_parameters()解析模板中声明的自定义参数pixelle_video/services/frame_html.py按text/number/color/bool类型自动渲染为文本输入、数字输入、颜色选择器或复选框用户可实时调整文字、颜色等细节。模板预览可在折叠区填写标题、图片路径、正文文本点击预览调用HTMLFrameGenerator.generate_frame实时渲染出单帧画面确认排版效果后再进入生成。生成视频右栏右栏web/components/output_preview.py负责触发生成并展示结果。单任务生成流程点击Generate Video后系统按以下阶段依次执行对应 Pipeline 的完整调用链生成视频脚本根据生成模式AI 生成或固定脚本与分割模式产出分镜Storyboard脚本为每个分镜生成图像/视频按模板类型调用所选工作流RunningHub / Selfhost / API逐镜生成媒体素材合成语音旁白按 TTS 模式Local 或 ComfyUI为每个分镜合成配音支持参考音频克隆合成最终视频将分镜画面、配音、BGM 按模板与音量合成输出。生成过程中右栏会实时显示进度条与状态文本——进度信息来自ProgressEvent事件pixelle_video/models/progress.py可细粒度展示分镜 x/y - 步骤 z生成插图等阶段信息进度百分比在完成前封顶 99%。完成后自动预览并展示以下元信息生成耗时秒文件大小MB分镜数量视频分辨率由模板自动解析同时提供内嵌播放器与Download Video 下载按钮一键保存 MP4 成片。批量生成批量模式下右栏展示批次信息与预估时间点击批量生成按钮后由SimpleBatchManager串行执行多个任务提供总体进度 当前任务进度双进度显示结束后以指标卡展示总数/成功/失败统计、失败任务详情含错误与堆栈并提供跳转 History 页面的入口。生成前置校验点击生成时系统会依次校验系统配置是否完整未配置时提示并中止、输入文本是否为空、以及视频模板是否已选择视频生成工作流若video_*.html模板未选工作流则中止并提示。FAQ 侧边栏侧边栏内置了 FAQ 快捷查阅面板实现见 web/components/faq.py自动加载对应语言文档中文界面加载 docs/FAQ_CN.md其他语言加载 docs/FAQ.md分类折叠展示按###标题自动解析为问题—答案对每个问题一个可展开折叠项覆盖常见配置问题、生成失败解决方案、性能优化技巧等深度求助入口面板底部提供 GitHub Issues 链接方便提交问题。启动 Web 界面Web 界面随项目一起安装后即可启动具体安装步骤见 Installation GuideLinux/macOS运行仓库根目录的 start_web.shWindows运行 start_web.batWindows 打包模板见 packaging/windows/templates/start.bat启动后浏览器打开 Streamlit 默认地址即可进入 Home 首页。小结Pixelle-Video 的 Web UI 将复杂的 AI 视频生成链路收敛为一个三栏可视化工作台左栏输入内容与 BGM中栏配置语音、模板与媒体工作流右栏生成、预览并下载成片侧边栏随取随用的 FAQ 降低了排查成本。配合系统的批量模式与模板自定义参数能力无需编写代码即可完成从主题到成片的全自动短视频生产若需深入理解每个参数背后的实现可直接阅读 web/components/ 与 pixelle_video/service.py 中的对应模块。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。