资讯详情

lanshu-create-ai-presenter-video完整介绍:一个脚本加一张照片,如何做出可验证发布的AI数字人讲解视频

📅 2026/10/8 14:49:48 | 华诺云谱 👁 阅读
lanshu-create-ai-presenter-video完整介绍:一个脚本加一张照片,如何做出可验证发布的AI数字人讲解视频
lanshu-create-ai-presenter-video完整介绍一个脚本加一张照片如何做出可验证发布的AI数字人讲解视频【免费下载链接】lanshu-create-ai-presenter-videoProvider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.项目地址: https://gitcode.com/gh_mirrors/la/lanshu-create-ai-presenter-videolanshu-create-ai-presenter-video是一个 AI 数字人讲解视频制作工具Agent Skill只需提供一个主题或一段文案再加一张已授权的人物照片就能让 AI agent 自动完成配音、数字人出镜、口型同步、字幕、剪辑、渲染和质量验收产出一条可直接发布的讲解视频也可以不出现真人改用九种视觉风格把内容演出来。 一句话说明它是什么这是一个provider 中立的制作流程你不绑定某个特定平台而是把视频生产的完整工作流交给手里正在用的 AI agentClaude Code、Codex、Cursor、Gemini CLI 等都支持。它负责三件难事全流程自动化从文案 → 配音 → 数字人生成 → 剪辑 → 渲染 → 交付每个阶段都有脚本和检查点可验证交付成片必须通过完整解码和响度检查状态由磁盘上的产物计算得出不能口头宣称完成成本护栏先做低成本试片、付费前明确报价、任务中断凭 ID 恢复避免重复扣费 两条路线数字人出镜或九种风格演绎路线成片效果你需要提供付费项画幅数字人讲解AI 数字人出镜口播字幕关键词动效辅助主题/文案 授权人物照片配音 数字人视频任意默认 9:16 竖屏风格化讲解不用真人每句讲解都用画面演出来主题/文案也可自带配音仅配音自带配音则免费16:9 横屏风格化路线内置九种视觉风格下图是仓库自带的 KV cache 讲解片在九种风格中的同一时刻一眼就能看懂每种味道九种风格一览详见 explainer/STYLES.mdV1 留白暖白纸墨色一抹朱红克制高级适合商业、产品V2 信号暗色仪表盘荧光绿数据流适合 AI、系统、网络类V3 手帐方格纸上真笔现写适合一步步推导、学习笔记V4 立体书牛皮纸立体书、纸片折起温暖适合讲故事V5 波普漫画网点漫画爆炸字节奏快适合观点、辟谣V6 一镜到底3D 影棚电影感适合重磅概念、发布内容V7 图纸与注脚黑色工程图纸引线注脚硬核技术深挖V8 黑板报粉笔现写结尾脑图课堂感适合入门V9 黏土小城萌系黏土小镇用比喻讲概念适合小白拿不准选哪种可以九种风格各出一版草稿配音锁定后不额外花钱用九宫格对比图再挑。⚙️ 核心机制证据驱动的八阶段流水线这是该项目与普通AI 视频生成器最大的区别——它把视频生产当成一个有验收标准的项目来管理intake → content_locked → audio_locked → visual_plan_locked → presenter_generated → composition_checked → rendered → verified每个阶段都必须有对应证据通过的预检报告、可解码的配音、时间轴与分镜、交付报告等才能进入下一阶段状态由 scripts/check_state.py 根据任务目录里的产物计算得出不允许手工声明声明超出证据时会直接报错配音是主时钟数字人动作、字幕、剪辑点和成片时长全部对齐锁定后的配音保证口型与段落边界不漂移交付环节由 scripts/finalize_delivery.sh 把关两遍响度归一化默认 −16 LUFS、母版/分享版完整解码、黑帧与冻帧检测全部通过才连同九宫格接触表和交付报告一起发布。 快速开始安装与第一条视频环境要求Python 3.9、FFmpeg、Bash、jq风格化路线另需 Node.js 和 rsync。第一步克隆到 Skills 目录以 Claude Code 为例目录名需保持与 Skill 名称一致git clone https://gitcode.com/gh_mirrors/la/lanshu-create-ai-presenter-video.git \ ~/.claude/skills/lanshu-create-ai-presenter-video第二步用自然语言下达需求。多数 harness 会根据 SKILL.md 中的描述自动选中该 Skill直接说把这份文案和人物照片做成一条 30 秒、16:9、带实时字幕的数字人讲解视频。或者做风格化讲解不要真人做一个 40 秒讲 RAG 的讲解视频有哪些风格可以选Agent 会自动调用内置脚本完成建任务、预检、配音、生成、渲染。如果你想手动控制入口脚本包括 scripts/init_job.py创建自包含任务目录、scripts/preflight.py素材与授权预检、scripts/plan_segments.py服务商有时长上限时按真实停顿分段风格化路线工具在 explainer/tools/ 下story.py 讲稿配音、new_film.sh 生成初稿、qa.py 质检、render.sh 渲染交付。一个关键体验整个过程中agent 会在首次付费调用前主动告诉你——要上传什么、请求多少秒、已知价格、试片规模、重试上限确认后才开始花钱。️ 安全与成本控制细节上传图片前必须确认使用权和人物成年克隆声音需明确授权绝不从照片推断声音连续三个付费候选被否决即停止并给出问题总结和剩余选项远程任务中断后先凭已保存的任务 ID 查询再考虑重新提交避免重复扣费仓库不含任何 API 密钥、令牌或用户素材报告只记录相对路径想零成本试玩tests/smoke.sh 冒烟测试用合成素材把任务从intake推到verified全程不调用任何远程服务 关键路径速查技能入口与工作流SKILL.md风格选择指南与按风格写稿表格explainer/STYLES.md风格包接口与工具说明explainer/KITS.md各阶段参考文档按需加载references/generation.md、references/editing.md、references/qa-recovery.md、references/styled-explainer.md九种风格的完整示例工程explainer/examples/kv-cache/中文文档README.zh-CN.md✅ 适合谁用想批量产出数字人口播视频默认 9:16 竖屏1080×1920的创作者和团队需要可验收、可复现视频生产流程的开发者每个任务的产物、服务商选择、任务 ID 都留痕在任务目录里想探索 AI 视频但不想被单一服务商锁死的用户配音、数字人、口型同步都按能力运行时选型每个任务记录实际使用的服务商与参数总结lanshu-create-ai-presenter-video的价值不在于多一种生成工具而在于把一段文案 一张照片到可验证发布的成片之间的每一道关都变成了有证据、有闸门、有成本的自动化流水线。【免费下载链接】lanshu-create-ai-presenter-videoProvider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.项目地址: https://gitcode.com/gh_mirrors/la/lanshu-create-ai-presenter-video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。

↑