用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/LYL1015/JarvisHub --skill flova-digital-human-product-spokesperson命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
Use when the user asks JarvisHub AI Chat or a `webHero` workflow to generate a website, landing page, homepage, brand-style web design, preview-first webpage workflow, or wants section screenshots, webpage assets, and final HTML to be produced as one staged flow.
把 assets/demo 提炼成运行时可用的视觉连续性方法论:先锁资产/角色/场景/镜头语义,再做扩镜与视频。(素材生成场景:角色一致性、视觉锚点锁定、单素材生成前的锚点规范与一次只改一个变量。)
基于用户提供的设计稿图片还原真实网页。该 skill 可用于任意前端项目,但强依赖本地已启动且已授权的 JarvisHub vision 工作流;视觉模型由服务端默认配置决定,支持外部传入 vision prompt,且不可静默降级。
基于 SOC 职业分类
正在显示 SKILL.md
| name | flova-digital-human-product-spokesperson |
| description | Use when 用户要基于产品图、商品卖点、数字人形象或口播脚本生成数字人商品口播、带货解说、产品介绍短视频、头像口型同步视频或单场景商品讲解。 |
用于数字人商品口播:锁定产品、数字人、单一场景、口播脚本和关键帧,再按 JarvisHub canvas harness 的实际工具列表生成可验证的图片、视频或待合成资产;音频只在本轮工具明确支持时生成真实 URL。
运行边界:主 Agent 负责编排、读画布、写文本节点、资产账本和阶段决策;媒体生成、等待和拼接必须交给 media sub-agent;真实评审必须交给 critic sub-agent。若当前工具集中没有音频驱动口型同步视频能力,不得声称已完成精准 lip sync,只能交付关键帧、旁白音频、视频 prompt、普通图生视频 clip 或待后期合成资产。
imageUrl / videoUrl,不能把提交态当完成态。critic sub-agent:只读取真实媒体并评审,不生成、不补素材。blocked 项,除非本轮工具列表明确暴露对应能力。explore:读取用户产品图、肖像/数字人参考、脚本、已有画布资产和真实 URL。plan:产出规格、口播脚本、镜头/音频分段、关键帧要求和能力缺口。media:生成数字人图、产品图、合成关键帧和视频 clip,并等待真实 URL;旁白/BGM 只在本轮工具明确提供音频生成时执行,否则保留为音轨计划。critic:检查人物一致性、产品可读性、口播节奏、音画对应和能力声明是否真实。若用户要求多个场景、多段剧情或完整长片,先加载 canvas-long-video-production。此流程只处理“数字人 + 产品 + 单一口播场景”的高一致性短视频。
先确认:
9:16;可选 16:9。必要证据:
缺产品图时,不能承诺真实商品一致性。缺音频驱动视频工具时,不能承诺 lip sync。
数字人口播不是多机位广告片。默认规则:
如果用户要求多机位、剧情切换或复杂产品展示,转交 creative-video-production 或 canvas-long-video-production。
先把产品卖点写成口播脚本:
若用户已有脚本,只做长度、句读和卖点顺序优化,不改事实。
生成或绑定:
Digital_Avatar:数字人头像/半身参考,面部清晰、肤色自然、无重度美颜。Product_Asset:产品包装/单品/SKU,logo、形状、颜色和关键文字可读。Scene_Base:固定口播场景,如居家、办公室、书店、健身房或品牌纯色背景。用户提供的肖像或产品图必须作为最高优先级参考;生成图只能补足构图和光线,不得改掉可识别特征。
创建一张合成关键帧:
关键帧通过 critic 后再进入视频阶段。缺真实关键帧 URL 时不要生成视频。
当前已知 canvas 工具集不含通用音频生成。只有本轮工具列表额外提供音频能力时,才可生成:
Narration_Audio:按脚本分段,声音性别/年龄/语气按用户要求。BGM:轻量背景音乐,低存在感,不抢人声。旁白脚本或用户上传音频是音频事实来源。若没有真实 audio URL 或后续视频工具不能直接使用音频驱动,只能把旁白作为后期合成计划,不能声称完成音频驱动口播。
根据当前工具能力选择路径:
| 能力 | 可交付 |
|---|---|
| 本轮工具支持音频驱动视频 | 关键帧 + 真实 audio URL 生成口播视频,等待真实 videoUrl |
| 只支持图生视频 | 生成普通口播感 clip,但必须说明不是精确 lip sync |
| 只支持图片/文本计划 | 交付关键帧、旁白脚本、视频 prompt 和后期合成计划 |
视频 prompt 必须描述:
图像 prompt 写可见事实,不写角色内心:
视频 prompt 写动态变化,不重复大段静态描述:
若用户中文输入,prompt 主体用中文;旁白文本严格使用用户指定语言。
critic 必须检查:
P0 问题只重试对应阶段:产品不清楚先重做关键帧;人物漂移先重做数字人锚点;口型不同步则回到音频驱动路径,不靠 prompt 硬修。
根据阶段输出其一:
spec:比例、时长、语言、数字人来源、产品来源、脚本来源。scriptTimeline:分句口播文本、时长估计、音频分段。elementResults:数字人、产品、场景真实 imageUrl。keyframeResult:合成关键帧真实 imageUrl。audioResults:仅在本轮有音频工具时记录旁白/BGM 真实 URL;否则记录音轨计划和不可用说明。videoResults:真实 videoUrl,并标明是否为音频驱动口型同步。blocked:缺少的真实输入或本轮工具列表不支持的能力。不得把普通图生视频包装成精准口型同步结果。不得把 queued/running、只有 taskId、只有节点存在说成已完成。