con un clic
polaris
把文案、课件、口播稿一键做成 16:9 网页演示视频并输出 MP4。完整链路:文案→口播稿→网页开发→MiniMax 配音→逐帧对齐录屏→MP4。
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Menú
把文案、课件、口播稿一键做成 16:9 网页演示视频并输出 MP4。完整链路:文案→口播稿→网页开发→MiniMax 配音→逐帧对齐录屏→MP4。
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Basado en la clasificación ocupacional SOC
把文案或文档做成有设计感的幻灯片。一套引擎两种交付:自包含可翻页的网页 deck(.html),或像素级还原主题的 .pptx。内置 17 套主题(借力 open-design),键盘翻页/演讲者备注/打印 PDF。
壹伴式排版 + 两段直送公众号草稿。和「壹伴」插件同思路——你只产出干净的语义正文 HTML(h1/h2/p/blockquote/ul/strong…,零内联样式),样式交给随包的壹伴脚本在 CloakBrowser 里按「约定的风格」一键套上。v5 两段解耦:第一段先把纯文字走「粘贴通道」稳稳送进草稿并保存确认(ProseMirror 事务认账,根治"看着传了却存不进"),第二段再套主题样式;样式失败文字也已落地,随时可用 restyle 模式对已存草稿原地换主题/换背景。填标题、保存草稿,绝不自动发布。当用户要把公众号稿子排版、一键排版、把内容传进公众号后台、或想给已传草稿换风格时触发。
把文案/主题做成「带 AI 高清插画」的故事短视频并输出 MP4。完整链路:文案→分镜脚本→角色设定→MiniMax 生图(人物+环境,跨镜一致)→MiniMax 配音→ffmpeg 运镜/字幕/BGM 合成。竖屏 9:16 / 横屏 16:9 / 方图 1:1。
把需求或文案做成一个有设计感、响应式的网站 HTML(自包含单文件)。借力 open-design 风格:玻璃导航 + 渐变大标题 + bento 功能区 + 数据 + 价格卡 + CTA + 页脚,17 套主题,滚动揭示动效。
| id | polaris-video-studio |
| name | Polaris 视频工坊(课件/口播/演示一键成片) |
| description | 把文案、课件、口播稿一键做成 16:9 网页演示视频并输出 MP4。完整链路:文案→口播稿→网页开发→MiniMax 配音→逐帧对齐录屏→MP4。 |
| source | official |
| author | Polaris |
| created_at | 0 |
把一段文案、课件或口播稿,一键做成带配音的 16:9 网页演示视频,输出 MP4。
核心差异:传统 web-video-presentation 需要用户手动录屏;本工作流在 Phase 4 用 Playwright 无头截图 + ffmpeg 逐帧对齐拼接,零手动操作,直接出片。
| 工具 | 用途 | 检查命令 | 安装方式 |
|---|---|---|---|
| Node.js ≥ 18 | 脚手架 + 音频合成 + 录屏 | node --version | 已装(Polaris 内置 Node 环境) |
| npm ≥ 9 | 包管理 | npm --version | 随 Node 自带 |
| ffmpeg | 音频时长探测 + 视频合成 | ffmpeg -version | 自动检测,未装则引导下载 |
| Playwright | 无头截图 + 视频录制 | npx playwright --version | npm install -g playwright |
| MiniMax API Key | T2A 配音 | 环境变量 MINIMAX_API_KEY | Polaris 供应商坞自动提供 |
一键安装依赖:
node ~/Polaris/skills/polaris-video-studio/scripts/install-deps.mjs
此脚本会自动检测上述工具,缺什么就引导你装什么(Windows/macOS/Linux 均支持)。
┌─────────────┐ ┌─────────────┐ ┌─────────────┐ ┌─────────────┐
│ 用户文案 │────▶│ 口播稿 + │────▶│ Vite+React │────▶│ MiniMax │
│ (课件/文章) │ │ outline │ │ 网页演示 │ │ T2A 配音 │
└─────────────┘ └─────────────┘ └─────────────┘ └─────────────┘
│ │ │ │
│ Phase 1 │ Phase 2 │ Phase 3 │
│ │ │ │
▼ ▼ ▼ ▼
粘贴/上传 AI 改写口播稿 脚手架 + 逐章开发 npm run synthesize
(1 秒) (AI 执行) (AI 执行) (自动,~2min)
│
▼
┌─────────────┐
│ 13 段 mp3 │
│ 逐帧对齐 │
└─────────────┘
│
▼
┌─────────────┐
│ Playwright │
│ 无头截图 │
│ 1920×1080 │
└─────────────┘
│
▼
┌─────────────┐
│ ffmpeg │
│ 拼接合成 │
│ MP4 输出 │
└─────────────┘
│
▼
┌─────────────┐
│ output.mp4 │
│ 1920×1080 │
│ 音画同步 │
└─────────────┘
│
▼
用户收片
链路特点:
node ~/Polaris/skills/polaris-video-studio/scripts/run.mjs \
--input="文案文件路径或纯文本" \
--theme=midnight-press \
--output="~/Desktop/output.mp4"
参数说明:
--input: 文案文件(.md/.txt)或直接写文本--theme: 视觉主题(默认 midnight-press,共 23 套可选)--output: 输出 MP4 路径(默认 ~/Desktop/output.mp4)--skip-scaffold: 如果项目已存在,跳过脚手架把用户文案转成口播稿(script.md)+ 开发计划(outline.md)。
执行方式:
输出:work/script.md + work/outline.md
脚手架 + 逐章开发网页演示。
执行方式:
node scaffold.mjs ./work/presentation --theme=<主题>Chapter.tsx + Chapter.css + narrations.tschapters.tsnpx tsc --noEmit 类型检查npm run build 构建输出:work/presentation/(完整可运行的 Vite+React 项目)
cd work/presentation
npm run extract-narrations # 扫 narrations.ts → audio-segments.json
npm run synthesize-audio # MiniMax T2A 逐段合成 mp3
输出:work/presentation/public/audio/*/*.mp3
多语言配音:narrations.ts 里的台词用目标语言书写(英语视频就写英语口播稿、粤语就写粤语…),
并启用 MiniMax language_boost 提升该语言的发音准确度。两种设法:
MINIMAX_LANGUAGE_BOOST="English"(Windows: $env:MINIMAX_LANGUAGE_BOOST="English")。audio-segments.json 每段加 "language_boost": "Chinese,Yue"(按段覆盖全局)。常用 language_boost 取值:Chinese、Chinese,Yue(粤语)、English、Japanese、Korean、
Spanish、French、German、Russian、Portuguese、Italian、Arabic、Hindi、Thai、
Vietnamese、Indonesian、auto。
node ~/Polaris/skills/polaris-video-studio/scripts/pipeline/03-record.mjs \
--project=<presentation 目录的绝对路径> \
--output=~/Desktop/output.mp4 \
--subtitles=zh-Hans,en --burn=zh-Hans,en # 可选:多语言字幕
多语言字幕(可选):
extract-narrations 之后,给 audio-segments.json 每一段补 subtitles 字段,
把该段台词译成各目标语言:
{ "chapter": "intro", "step": 1, "text": "……", "audio": "intro/1.mp3",
"subtitles": { "zh-Hans": "简体文本", "zh-Hant": "繁體文本", "en": "English text" } }
缺某语言时该段会回退用 text。03-record.mjs 传 --subtitles=<逗号分隔语言>:
.srt,并作为可切换软字幕轨嵌入 MP4;--burn=<语言> 把其中 1–2 种叠成(双语)硬字幕烧进画面(任何播放器都能看到);
不传 --burn 默认烧前 2 种,--no-burn 则一种都不烧。字幕语言代码:zh-Hans(简) zh-Hant(繁) en yue(粤) ja ko es fr de ru pt
it ar hi th vi id。
⚠️
--project必须指向 Phase 2 脚手架生成的 presentation 项目目录(含package.json), 不是 skill 自己的目录。脚本会从该目录读audio-segments.json自动发现章节/步骤结构, 不再写死任何章节数 —— 任意结构的 PPT 都能录。
执行流程(全自动,无需手动改脚本):
--strictPort 锁端口,默认 5174,可加 --port= 改)http://localhost:<port>/audio-segments.json 的有序段落逐步截图(每步一张 1920×1080 PNG)前置条件:跑此脚本前,presentation 目录必须已完成 Phase 3 配音 (即已有
audio-segments.json与public/audio/<章节>/<步>.mp3)。
输出:~/Desktop/output.mp4(1920×1080,H.264 + AAC,音画同步)
本 skill 复用 web-video-presentation 的 23 套主题。推荐搭配:
| 内容类型 | 推荐主题 | 理由 |
|---|---|---|
| 课件/教学 | chalk-garden、paper-press | 清晰易读,教育感 |
| 数据/报告 | midnight-press、swiss-ikb | 暗底突出数字,专业感 |
| 产品发布 | bold-signal、bauhaus-bold | 强视觉冲击,宣言感 |
| 品牌故事 | dark-botanical、vintage-editorial | 高级质感,有温度 |
| 现象 | 原因 | 解决 |
|---|---|---|
| 视频没声音 | Playwright recordVideo 不录音频 | 本 skill 的 Phase 4 已改用 ffmpeg 拼接方案,不依赖 Playwright 录屏 |
| 音频合成失败 | MiniMax key 无效或额度用完 | 检查 MINIMAX_API_KEY 环境变量,或去 Polaris 供应商坞启用 MiniMax |
| 构建报错 | TypeScript 类型错误 | 检查各章节 narrations.ts 长度是否与 .tsx 中的 step 数匹配 |
| 录屏超时 | dev server 端口被占用 / 上次留下孤儿进程 | 脚本启动前会自动清掉占用端口的进程并杀进程树;如仍超时,看脚本打印的 dev server 日志定位(多半是 npm install 没装全) |
| 找不到 audio-segments.json | 没先跑 Phase 3 配音 | 先在 presentation 目录 npm run extract-narrations && npm run synthesize-audio |
| 画面和音频不同步 | 自动播放模式下 step 切换延迟 | Phase 4 的 ffmpeg 方案按每段音频精确时长拼接,天然同步 |
scripts/install-deps.mjsscripts/run.mjsscripts/pipeline/03-record.mjsreferences/WORKFLOW.md~/Polaris/skills/web-video-presentation/