
静默揭晓发布片v1.0.0
使用这个 Skill:制作产品讲解短片。
为一项音频能力做一支靠「先不给」来证明它的发布片:前三分之一完全静音,然后声音在镜头前被加进来,同一个画面带着声音原样重播。你会拿到六幕分镜、静默优先的音频 map,以及一支成片 MP4。
最常被这些职业选择
更新于 2026年8月30日
效果预览
运行于
生成模型
使用工具
相似 Skill
查看全部 Skills你将获得
- 一支 1920x1080 成片 MP4,第一幕的静默是可验证的,后半段有配乐——这个对比本身就是产品演示,而且已经烤进文件里。
- 可编辑的工程:沉默画面只做一次、挂载三次,每幕一个 composition,一份分镜、一份 seam ledger,以及一个装着你配色与字体的样式表。
- 一份写成剧本一部分而非后期步骤的音频 map——每个 cue、每个电平,以及全片第一声落在哪一帧。
适合
- 你要发布的是感官性的东西——音效、音乐、语音、触感——截图根本承载不了。
- 你愿意开场就拿自家产品自嘲一句,因为正是这份自嘲换来了后半段的可信度。
- 你清楚这支片子会在哪儿播,而且确定那里不是静音自动播放。
不适合
- 观众看一张静帧就能判断的能力。直接展示比先藏起来更快。
- 静音自动播放的信息流。在那里,静默开场和一个坏掉的文件没有区别。
- 拿不到也做不出音频的发布。这是唯一一支「配乐不是装饰」的片子。
关于此 Skill

静默揭晓发布片 — 使用指南
你会得到什么
一支用"减法"来论证的发布片。开场是一个明显该发出声音的东西——它一声不响,而且不响得足够久,久到让人不舒服。然后声音在镜头前被加进来,同一个画面原样重播一遍,差别自己完成了推销。
奶油纸底、一个陶土色强调、一扇深色终端窗。每一帧都是代码画的;全片唯一不是代码的东西是音频,而音频是你的。
为什么"先不给"有用
截图承载不了音效,而一支单纯"有好音频"的片子也不会让人注意到音频——观众会像对待呼吸一样把它当成理所当然。让人注意到声音的唯一可靠办法,是先把它拿走。
八秒静默会教会观众去听。等第三幕第一声落下时,他们已经被训练了八秒去注意的正是那一帧。全片其他部分都不用再那么使劲。
你需要提供什么
- 能力本身,以及用户如何把它打开。
- 那个沉默的画面:一个"不响就是不对"的物体。铃、琴键、鼓垫、开关。如果观众还得琢磨"它该不该响",这份缺席就感觉不到。
- 两句 prompt——加音效的那句,和加音乐的那句——用真实用户的口吻,而不是市场部的口吻。
- 音频本体:你已获授权的音效与音乐床,或者产品本身真的能产出的音频。
- 界面:一个你自有的终端界面,或者做一套中性原创的授权。
- 品牌 token:一个奶油纸底、一个暖墨、一个强调色、一块深色终端面。
一次完整流程
- 先过两道关。 沉默画面写成一句话并确认;播放渠道确认不是静音自动播放。两道都会卡住流程。
- 声音先于画面。 音效和音乐床先备齐,音频 map 与分镜同时写进 STORYBOARD——这支片子的 cue sheet 就是剧本。
- 先做静默那一幕,并开着声音看一遍。 如果那份缺席不让人难受,后面什么都救不回来。
- 其余按顺序做,每幕验证通过再往下;两次重播是把第一幕重新挂载,而不是新做的场景。
- 静默段戴耳机过一遍。 音乐床提前淡入这种事在笔记本喇叭上很容易漏掉,而它会毁掉全片唯一的论点。
- Preview,确认后渲染,并在探测结果里确认音频流存在。
六幕结构
| 幕 | 画面 | 声音 |
|---|---|---|
| 1 | 物体被点三下,每下都剧烈反应,一声不响。然后一个词。 | 完全没有 |
| 2 | 终端打开;一句 prompt 要音效;Agent 作答。 | 只有打字声 |
| 3 | 同一个画面再来一次——音效落地。 | 音效 |
| 4 | 终端再开;一句 prompt 要音乐。 | 只有打字声 |
| 5 | 同一个画面第三次——这次有配乐。 | 音效 + 音乐床 |
| 6 | 主张卡,然后品牌锁定。 | 音乐床收束 |
第 1、3、5 幕是同一个 composition 挂载三次。这就是全部的机关。
这支片子守的几条设计规矩
- 第一幕完全没有音轨——不是小声,不是压低,是没有。所有本能都在喊"开场要有能量";顶住这一点,就是这支片子本身。
- 音乐床只进场一次,在第三次重播。 不提前淡入,也不先垫一个低电平。音乐出现的那一刻是一个叙事节拍。
- 一个强调色,归那个沉默的物体所有。 全片三处用途:物体、光标、一个被高亮的词。
- 永远不用纯白,也不用纯黑。 奶油色才让静默读起来像一个设计决定,而不是素材丢了。
- 衬线体只出现在两次回复上,这正是让它们读起来像"回答"而不是"又一层界面"的原因。
唯一的投放限制
在静音自动播放的渠道上,这支片子和一个坏掉的文件没有区别。流程会在动工之前问清楚它要在哪儿播;如果答案是静音信息流,它会建议换一个结构,而不是渲完再说。这一点会提前讲清楚,而不是渲染之后才发现。
版权与诚实
片中展示的能力必须是产品真的具备的,两句 prompt 也必须是它真的接受的。音频是你的——已获授权,或由产品本身产出——而且片子是按这些真实声音剪的,不是先用占位声剪好再换。
终端要么是你自有的界面,要么是中性原创:通用 chrome、原创图标、不出现任何第三方字标、模型 chip、菜单结构或标志性版式——交付物里会写明是哪一种。复刻别家的 Agent 或 IDE、或使用其录屏,需要该公司的书面授权。
本片的幕结构、"静默—重播"装置与配色结构参考自一支公开发布的 HyperFrames 发布片。主题、文案、配色值和全部素材都为你的产品重新创作,成片中不包含、也不暗示与任何你不拥有的公司存在关联或获得其背书。
环境要求
HyperFrames CLI、Node.js 22 或更新版本、FFmpeg。渲染在你自己的机器上跑。全程不调用任何图像、视频、音频或数字人生成模型,因此没有按次计费的 API 成本——声音由你带来。
值得知道的限制
- 参考版是 32.5 秒。短于约 28 秒,静默就不再让人难受,装置也就失效了;长于约 38 秒,后半段开始自我重复。
- 没有旁白。一个在静默幕上说话的旁白,填掉的正是这支片子必须留空的那块地方。
- 默认 1920x1080。竖版可以做,而且这支片子往往就该在竖版——但前提是那个渠道默认放声音。
开始前需要准备什么
- 你需要提供
- 本次发布的音频能力,以及用户如何把它打开 · 一个「不响就是不对」的画面物体 · 加音效和加音乐的两句 prompt,用真实用户口吻 · 已授权的音效与音乐床,或产品本身产出的音频 · 一个不会静音自动播放的投放渠道
- 依赖项
- HyperFrames CLI — required · Node.js 22 or newer — required · FFmpeg — required
- 最近实测
- v1.0.0 — Claude Code / Claude Desktop / Cowork / Codex / ChatGPT
用户评价
评价加载中…







