叙事预览
在正式制作前,用画面与同步声音搭完整场景。
Black Forest Labs 多模态视频
Black Forest Labs 多模态视频模型,可从文本生成同步音频。
在正式制作前,用画面与同步声音搭完整场景。
把已批准的分镜帧串成连贯的视觉序列。
在保持视觉方向的前提下,延续一次成功的生成。
在一条提示词里描述动作、镜头运动、对话、环境声与特效。FLUX 3 在同一次生成中合成动态画面与同步音轨。
“A home video of a futuristic San Francisco with people riding hoverboards.”
在 5 到 20 秒的片段中构建有氛围的场景——镜头运动、主体动作与环境细节都更稳定。
用一张图作开场帧、两张作首尾帧、最多十张作定时分镜,或以 MP4 为起点续拍后续内容。
先写清主体,再补充光影、风格,以及必须保持不变的内容。需要更可控的编辑时,上传参考图。
当音频很重要时,请明确写出对话、房间底噪、音乐与音效。
分镜输入必须指定时长,帧才能可预期地分配。
用 Draft 验证节奏与构图,再以全质量渲染成片。