Podcast AI

工作台

选择要进入的工具。

播客 Studio
从主题生成脚本,审阅后继续合成音频和视频。
进入 Studio
一键播客
输入 YouTube 链接或字幕文本,直接跑完整生成流程。
开始生成
获取资源
下载 URL 音频,并按需要转写为纯文本或 Speaker 文本。
获取资源
OmniVoice 语音
手动输入文本,选择声音、风格属性和非语言标签后直接生成音频。
生成语音
Azure / Edge TTS
使用在线语音生成英语、普通话或香港粤语 MP3,不占用本地显存。
生成在线语音
Kokoro 英语语音
混合多个 Kokoro 英语声音并生成 MP3。
生成英语语音
CosyVoice2 粤语
使用张悦楷固定声线或 voice_refs 粤语参考音生成本地 WAV。
生成粤语语音
IndexTTS2 语音
克隆 voice_refs 或上传的音色,并独立控制文字、向量或参考音频情绪。
生成克隆语音
时间轴配音
上传或输入带开始时间的台词,英文化后按时间线生成完整 WAV。
生成时间轴音频
视频粗剪
输入口播或上传音频,生成分镜、搜索素材、预览并输出粗剪视频。
进入粗剪
故事视频
生成第一人称故事、风景视频、人物图片、字幕和做旧叠层,进入编辑器细调后导出。
创建故事视频
文本 AI 分镜
输入分好行的文案,可上传音频或用 OmniVoice 逐行配音,再生成 Krea 图片、LTX 视频和剪映草稿。
生成 AI 分镜
口播混剪
把逐字稿拆成真人口播、图片和 AI 视频,生成逐段配音、录制清单和固定时间线剪映草稿。
制作口播混剪
自动化工作流
把 YouTube 字幕、AI 改写、OmniVoice 和故事视频串成可审核的模板流程。
管理工作流