口播混剪 返回工作台

口播、图片与 AI 视频,放进同一条固定时间线

先确认分镜和提示词,再生成媒体;真人段保留 TTS 与等长黑色占位。

创建项目

AI 分镜 + 逐段 TTS
一次读取全文,只返回每段原文及真人 / 图片 / 视频类型。可用:{{source_text}}、{{talking_head_target}}、{{max_video_seconds}}
每次接收 20 个已锁定分镜,只补图片提示词、视频提示词和转场。可用:{{storyboard_batch_json}}

保存模板时会同时记录分析方式、真人镜头数、语言、声音、语速和素材自动生成设置。

用于第一阶段切分约束和 TTS 后的实际时长检查。
默认每次发送 20 个已切好的分镜。
按时间线计数,包含开启 AI 素材后的口播;超出部分只生成图片。