上个月接了个小活,甲方预算低得离谱,硬逼着我把一支三分钟的MV成本控制在一百刀以下。跑完发现完全可行,但坑全在流程。最烧钱的是视频生成那层,大部分平台按秒计费,720p再加一轮返修,预算立马绷紧。
我的做法是分层各用一个工具:文本模型先写概念和分镜脚本,图像视频扩散模型出画面,音乐模型做配乐,最后剪辑软件拼起来。省钱的核心是先把二三十个镜头的分镜写死,出静帧确认了再去动画,放大只留给主镜头,其余全用四秒片段代替八秒,剪辑节奏一点不受影响。
真正卡脖子的不是模型强不强,是你动手生成前那份分镜够不够细,光影情绪写清楚,返工次数直接砍一半。