融光是什么
说到AI视频创作,一个绕不开的痛点就是流程割裂:写剧本用一个工具,画分镜用另一个,生成视频又得换平台。整个过程费时费力,创意在工具切换中不断损耗。那么,有没有一个方案能把整个链条打通?这就是“融光”(AI Fusion Video)要解决的问题。
简单来说,融光是一个开源的全流程AI视频创作平台。它的核心在于“全流程”和“自动化”。基于Agent(智能体)架构,它能接管从剧本编写、分镜拆解,到画面生成、视频合成的完整工作流。你可以把它想象成一个高度协同的虚拟制作团队,剧本写好了,分镜、画面、视频就能按部就班地自动生成。
技术上,它采用了Ja va 21和Spring Boot 3.5构建后端,用Next.js 16打造前端,并且贴心地支持Docker一键部署。对于创作者而言,这意味着你可以告别繁琐的工具链,在一个平台上高效完成从想法到成片的全部工作。
融光的主要功能
这个平台具体能做什么?我们不妨拆开来看:
- 剧本管理:这不仅是简单的文本编辑。你可以在这里创建项目,以分集、分场景的结构化方式管理剧本,为后续的自动化处理打好基础。
- AI分镜生成:这是融光的智能核心之一。上传剧本后,AI会自动将其拆解成一个个可视化的分镜,不仅包含画面描述,还会建议镜头语言,让文字第一步就迈向视觉。
- AI绘图:分镜有了,需要画面参考?平台集成了多家主流AI绘图引擎,可以一键根据分镜描述生成参考图,快速将脑海中的画面具象化。
- AI视频生成:有了分镜描述和参考图,最后一步就是生成动态视频片段。平台能基于这些信息,调用视频生成模型,产出对应的视频内容。
- 素材管理:所有生成的图片、视频片段,都会在项目内被统一管理,形成清晰的资产库,方便后续的查找与复用。
- 多模型支持:它不绑定任何一家服务商。无论是OpenAI、Claude、Gemini这样的国际巨头,还是通义千问、DeepSeek等国内模型,甚至本地部署的Ollama,都能接入使用,灵活性极高。
如何使用融光
看到这里,你可能已经想动手试试了。别急,它的上手路径非常清晰:
- 环境准备:最推荐的方式是安装Docker,这是最快捷的。当然,如果你偏好源码开发,则需要准备好JDK 21+、Node.js 20+、pnpm 9+,以及MySQL和Redis环境。
- 项目获取:打开终端,执行
git clone https://github.com/Stonewuu/ai-fusion-video.git将仓库克隆到本地。 - 快速启动:Docker用户最简单,直接运行
docker compose up -d命令即可。源码开发者则需要两步:先启动中间件服务docker compose -f docker-compose-middleware.yml up -d,然后分别启动后端./mvnw spring-boot:run和前端pnpm dev。 - 系统配置:启动成功后,在浏览器访问
http://localhost:8080(Docker方式)或http://localhost:3000(开发模式)。首次使用,记得在系统设置页面配置好你准备好的各类AI模型密钥以及存储后端。 - 创作流程:配置完毕,真正的创作之旅就开始了。整个流程是线性的:创建新项目 → 编写或导入剧本 → AI自动生成分镜 → AI绘制分镜参考图 → AI生成视频片段 → 最后整合导出素材。整个过程在平台内一气呵成。
融光的关键信息和使用要求
在深入使用前,有几个关键点需要明确:
- 开源协议:项目采用非常宽松的MIT License。这意味着你可以自由地用于商业用途,也可以进行二次开发,几乎没有限制。
- 硬件要求:你需要一个能运行Docker的环境,或者配置好本地JDK 21+环境。由于需要调用AI模型,建议准备充足的内存。
- 依赖服务:MySQL数据库和Redis缓存是必须的。此外,如果你需要存储生成的图片和视频,建议配置对象存储服务(如MinIO、阿里云OSS等)。
- API密钥:平台本身不提供AI算力。使用绘图、视频生成等核心功能,你需要自行准备并配置相应服务商(如OpenAI、Claude等)的API密钥。
- 部署方式:它提供了两种选择:追求便捷就用Docker Compose一键部署;需要深度定制或开发,则选择源码本地部署模式。
融光的核心优势
市面上AI视频工具不少,融光的差异化优势在哪里?我们可以总结为以下几点:
- 全流程自动化:它真正覆盖了“剧本-分镜-图像-视频”的完整链条,减少了在不同工具间手动搬运、转换内容的人工环节,极大提升了效率。
- 多模型兼容:不把用户锁死在一家模型上。你可以根据成本、效果、速度灵活切换甚至对比不同模型,这在模型技术快速迭代的今天尤为重要。
- 开源可定制:MIT协议赋予了它极大的自由度。企业可以私有化部署保障数据安全,开发者可以深度定制功能,这是闭源SaaS服务无法比拟的。
- 可视化Agent流程:整个创作流程以Pipeline节点的方式可视化呈现,每一步发生了什么,生成了什么,都清晰可见。创作过程不再是“黑盒”,变得透明且可控。
- 分镜驱动生成:它以“分镜”作为剧本和成片之间的关键中间层。这确保了最终生成的视频内容能够最大程度地忠实于最初的剧本意图,避免了AI直接生成时的“跑偏”现象。
融光的项目地址
- GitHub仓库:所有的源代码、详细文档和最新更新,都可以在以下地址找到:https://github.com/Stonewuu/ai-fusion-video。感兴趣的话,现在就可以去点个Star了。
融光的同类竞品对比
为了更清晰地定位融光,我们将其与市场上两款热门产品进行一个快速对比:
| 对比维度 | 融光 (AI Fusion Video) | HeyGen | Runway Gen-3 |
|---|---|---|---|
| 产品定位 | 开源Agent驱动全流程创作平台 | 云端AI数字人视频生成工具 | 专业AI视频编辑与生成平台 |
| 工作流模式 | 剧本→分镜→图像→视频的多阶段Pipeline | 模板选择→数字人驱动→视频合成 | 素材上传→AI生成→多轨道后期编辑 |
| 可控性 | 高(分镜级精细控制,支持迭代调整) | 中(依赖预设模板与数字人形象) | 中高(运动笔刷、绿幕、相机控制等专业工具) |
| 开源程度 | 完全开源(MIT协议,可私有化部署) | 闭源SaaS服务 | 闭源SaaS服务 |
| 模型支持 | 多厂商兼容(OpenAI/Claude/Gemini/国产模型等) | 自研模型为主 | 自研Gen-3系列模型为主 |
| 适用场景 | 专业创作者全流程管理、团队协作 | 营销视频快速生成、数字人播报 | 影视级广告制作、视觉特效、艺术短片 |
可以看出,融光在“开源”、“全流程自动化”和“多模型兼容”上特点鲜明,更适合那些需要深度控制、私有化部署或希望整合自身AI能力的专业创作者和团队。
融光的应用场景
那么,这样一个工具具体能用在哪些地方呢?它的应用场景其实相当广泛:
- 短视频创作:对于自媒体博主或短视频团队,可以将写好的文案脚本快速转化为带画面的短视频,实现批量化、高效率的内容生产。
- 广告营销:广告公司可以根据产品描述,快速生成多个版本的广告分镜和视频素材,极大加速内部创意提案和迭代的速度。
- 教育培训:教师或知识付费创作者,可以将课程大纲或讲义自动拆解成可视化的课程片段,大幅降低高质量教育视频的制作门槛。
- 影视预演:独立制片人或小团队,在正式投入高昂拍摄前,可以利用AI快速生成故事板和动态预演,低成本验证拍摄方案的可行性和视觉效果。
- 动画原型:动画师在构思初期,可以通过AI分镜快速验证不同叙事节奏和视觉风格的搭配效果,为后续正式制作提供可靠参考。
总而言之,融光代表了一种趋势:将AI能力工程化、流程化,赋能给内容创作本身。它或许不是那个直接生成最炫酷视频的单点工具,但绝对是那个能让你的整个视频创作流水线变得更智能、更高效的系统级解决方案。
