基于多模态大模型的全自动影视解说与视频剪辑 Agent,支持一键文案生成、配音配乐与剪映草稿导出。
NarratoAI 是一款基于多模态大模型的全自动影视解说与视频剪辑 Agent,支持一键文案生成、配音配乐与剪映草稿导出。 在核心能力方面,系统能够高效支持结合视觉大模型(Qwen2-VL、Pegasus 等)自动理解视频画面并生成专业解说文案与集成多种本地与在线 TTS 语音克隆引擎(IndexTTS、OmniVoice、VoxCPM)与 AI 自动配乐,并针对持多模型接入与自定义模型路由进行了深度打磨。 在运行环境与生态集成方面,支持短剧混剪、影视解说、字幕对齐与剪映草稿一键导出,提供 Windows/macOS 整合包与 WebUI,同时支持自托管部署与私有化运行,便于融入多样化的工作流。 帮助专业领域团队在复杂业务流中,显著增强信息研判深度与执行落地效率。