用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/anbeime/skill --skill infinitetalk命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
小跃虚拟伴侣 - 使用智谱 AI 提供温暖的对话陪伴和静态图片分享
面向电商设计师、海报美工、品牌视觉、UI设计师、信息图编辑、商业摄影师、内容创作者等需要高质量可控出图的角色,在需要用 GPT-Image-2 生成电商主图、电影海报、信息图、品牌视觉、UI截图、古籍国风、角色IP等场景时,通过「Prompt as Code」原子化Schema+20+工业JSON模板+四步工作流,产出结构化、可复用、可批量的生图提示词,再调用 image_generation 出图。不适用于随意生图或简单风景照。
影片与视频编辑、内容创作者在制作视频配音或有声书时,当需要克隆音色、生成情感化配音或流式实时语音合成请用此技能。支持1.7B高质量与0.6B快速双模型,一键实现多语言方言配音,让语音创作更高效更自然。
正在显示 SKILL.md
| name | infinitetalk |
| description | 自媒体创作者与内容创作者在制作数字人播报或视频配音时,只需输入单张人像与音频,即可自动生成唇形、表情、动作完美同步的无限时长说话视频。一键打造高质量虚拟主播内容,告别繁琐拍摄,让音视频创作更高效! |
| dependency | {"python":"opencv-python>=4.9.0.80\ndiffusers>=0.31.0\ntransformers>=4.49.0\ntokenizers>=0.20.3\naccelerate>=1.1.1\ntqdm\nimageio\neasydict\nftfy\ndashscope\nimageio-ffmpeg\nscikit-image\nloguru\ngradio>=5.0.0\nnumpy>=1.23.5,<2\nxfuser>=0.4.1\npyloudnorm\noptimum-quanto==0.2.6\nscenedetect\nmoviepy==1.0.3\ndecord\ntorch>=2.0.0\ntorchvision\ntorchaudio\neinops\nsoundfile\n","system":"# 创建模型权重目录\nmkdir -p weights/Wan2.1-I2V-14B-480P\nmkdir -p weights/chinese-wav2vec2-base\nmkdir -p weights/InfiniteTalk/single\nmkdir -p weights/Kokoro-82M\n"} |
准备输入
执行生成
scripts/infer_infinitetalk.py 进行推理input_path: 输入图片路径audio_path: 驱动音频路径(或提供 text 使用 TTS)output_path: 输出视频路径mode: clip(单段)或 streaming(长视频)size: infinitetalk-480(480P)或 infinitetalk-720(720P)sample_steps: 采样步数(默认 40)sample_audio_guide_scale: 音频引导强度(默认 4.0)验证输出
sample_audio_guide_scale 参数准备输入
执行生成
input_path 指向视频文件处理长视频
streaming 模式生成无限时长视频motion_frame 参数控制驱动帧长度(默认 9)文本转语音
生成视频
(s1) 和 (s2) 区分说话人)size=infinitetalk-480)--quant int8 参数)--offload_model true)python scripts/infer_infinitetalk.py \
--input_path ./input.jpg \
--audio_path ./audio.wav \
--output_path ./output.mp4 \
--size infinitetalk-480 \
--mode clip
python scripts/infer_infinitetalk.py \
--input_path ./input.jpg \
--audio_path ./long_audio.wav \
--output_path ./long_output.mp4 \
--size infinitetalk-480 \
--mode streaming
python scripts/infer_infinitetalk.py \
--input_path ./input.jpg \
--text "你好,今天天气真不错" \
--output_path ./tts_output.mp4 \
--size infinitetalk-480