为什么我们不用提示词生成你的发布视频
· 阅读约 3 分钟 · LaunchReel AI
一听到“AI 发布视频”,很多人想到的是输入一段提示词,拿到一支成片。我们很早就决定,LaunchReel AI 不走这条路。这篇文章讲讲原因,以及我们的做法。
文生视频模型生成场景的能力很惊人:夜晚的城市、桌上的商品、推门而入的人。软件发布视频要的却是另一回事。它需要你一模一样的界面、一字不差的文案、分毫不差的品牌,还要在发布前一周能轻松修改。这四点,靠提示词生成都很难做到。
问题 1:品牌走样
生成模型不知道你的色值、字体和 Logo 的形状。你可以描述给它听,也许能得到差不多的结果,但问题恰恰出在“差不多”上。配色略有偏差、Logo 几乎对了的发布视频,还不如一张普通截图像你的产品。片段一多,偏差还会叠加,没有两个镜头是真正统一的。
问题 2:界面文字看不清
软件产品是由文字构成的:标签、菜单、数字、代码。生成视频往往把小字渲染成一团形状,远看像字母,凑近一看全是噪点。对发布视频来说,这是致命的。观众想弄明白你的产品是做什么的,而告诉他答案的界面,恰恰最容易变成乱码。
对开发者工具来说,这个问题更要命。一个命令“差不多对”的终端画面,还不如不放。观众照着复制,得到一个报错,对你项目的第一印象就是:它跑不起来。
价格页、带真实数字的仪表盘、设置页,也是同样的问题。如果观众看不清屏幕,这个镜头就只是装饰,而发布视频没有多余的时间留给装饰。
问题 3:没法逐个镜头控制
发布视频是一连串的决定:这个功能放在那个前面,这句字幕配这个界面,这里三秒,那里五秒。用提示词,你描述的是整支视频,拿到的也是整支视频。第四个镜头不对,你没有任何抓手去单独改它,只能重写提示词,然后碰运气。
问题 4:每改一次,全部重新生成
这就是“抽卡”问题。你在提示词里改了一个词,输出却在十个你没要求的地方变了。你喜欢的那个镜头没了,颜色也变了。你只好再抽一次。每次重抽都耗时间、耗积分,下一次也未必更接近你要的。
对一个要发布产品的团队来说,这和发布前一周真正需要的恰好相反:那时价格那句话要改,某个功能要改名。
我们的做法
我们把发布视频当作根据你的真实产品生成的动效设计。输入都是已经存在、而且本来就正确的东西:你的网站、README、截图、配色、字体和 Logo。整个流程有三道关口,前两道没过,什么都不会渲染。
1. 简报
我们读取你给的网址,如果你附上了 GitHub 仓库也一起读,然后把理解到的内容写回给你:谁的产品、给谁用、三到六个卖点、整体语气、用哪些截图。你来确认或修正。大多数错误在这一步修正成本最低,因为它们还只是文档里的几行字。
2. 分镜
每个卖点变成一个镜头,套用我们的某种结构,比如产品发布视频模板或 App 演示视频模板。渲染开始之前,你能看到每个镜头、它的时长和画面文字。
3. 逐个镜头修改
渲染完成后,每个镜头都是独立的单元。改一句字幕,只重新渲染那一个镜头,其余部分保持你确认时的样子。重新生成一个镜头花 1 积分,第一套分镜和预览免费。
坦白说,我们放弃了什么
这种做法做不出“一个人在咖啡馆里用你的 App”那样的电影感场景。没有生成的真人画面,也没有素材库画面。如果你需要的是那种视频,提示词类工具或者一支拍摄团队会更合适。
它能做出的,是一支看起来就是你的产品的视频,因为它本来就是用你的产品做的:
- 界面文字始终清晰,因为它来自你的截图,或者用真实字体排版
- 每个镜头都用你的配色、字体和 Logo
- 渲染之前,先由你确认分镜
- 修改只动一个镜头,不牵动整支视频
- 16:9、1080p,可按需加 9:16 版本,带字幕和可商用授权音乐;也可导出 4K
- 第一份简报、分镜和带水印预览免费,之后按一次性积分包付费,积分永不过期
适合谁
做软件的人:SaaS 产品、GitHub 上的开源项目、Chrome 插件和手机 App。只要你的产品有网址、有值得展示的界面,贴上网址就能得到一支发布视频。价格方案见价格页。