以 skill 自身的术语
将任意文本——一篇文章、一些笔记、一个主题、一份 brief——转化为带有虚构场景视觉效果(排版、抽象图形、图表、数据可视化)的无露脸解说视频。通过七个编排步骤运作:带 brief 确认的设置、合成采集包(无需网站)、从预置帧模板中选择设计系统并可选进行品牌 token 重混、使用叙事设计重塑输入内容的分镜与脚本、TTS 与 BGM 音频生成、添加带时间码镜头序列与虚构元素的视觉设计、通过子 Agent 并行构建帧,以及最终渲染。
协作模式下在第 0、3 和 6 步设有用户确认关卡。无露脸意味着没有采集步骤,也没有真实素材清单——所有视觉元素都由下游工作单元虚构生成。
它产出什么
- STORYBOARD.md,包含逐帧教学计划、带时间码的镜头序列,以及自行设计的焦点/角色
- compositions/frames/NN-*.html — 由子 Agent 构建的每帧一个 HTML 合成文件
- renders/video.mp4 — 最终渲染的视频,横向 1920x1080、竖向 1080x1920 或方形 1080x1080
工作方式
- 01确认 Brief 并初始化项目
BRIEF.md 存在并决定模式——阅读它,不要提问。如果缺失且项目是全新的,运行意图层来锁定 brief。
- 02创建合成采集包
将用户的完整输入原样保存为 capture/extracted/visible-text.txt(信息来源)。
- 03选择帧预设并构建 frame.md
从 hyperframes-creative/frame-presets/ 中挑选一个符合主题和语气的已发布预设。
- 04用叙事设计撰写 Storyboard
使用 story-design.md 的结构,把文本转化为逐帧教学计划。
- 05生成音频并添加视觉设计
在后台运行 audio.mjs,用于 TTS、逐词时间对齐,以及从 HeyGen 库中取用的 BGM。
- 06构建帧并组装索引
同步时长、构建每帧数据包,并为每一帧并行派发一个子 Agent。每个 worker 写出 compositions/frames/NN-*.html。字幕在后台构建。