OpenAI 的文生视频模型 Sora 在春节期间震撼发布,引发了国内 AI 圈的热议与焦虑。这篇教程将基于已有内容,系统梳理 Sora 对中国 AI 带来的三大变化,帮助你客观看待差距、认清方向,并为迎接国产“类 Sora”做好准备。
一、Sora 是什么?为什么引发焦虑?
Sora 是 OpenAI 使用超大规模视频数据训练出的通用视觉模型,能理解和模拟运动中的物理世界,生成不同时间、纵横比和分辨率的视频。最大版的 Sora 可以生成长达一分钟的高保真视频。此前市面上的视频生成模型大多只能生成 4 秒或固定大小的短视频,而 Sora 的逼真效果和性能提升碾压了所有竞品。
许多网友因此痛心疾首,认为中国又一次错失“元创新”,甚至怀疑中美 AI 差距在拉大。但事实上,经过 ChatGPT 的“练兵”,中国 AI 已有底气——Sora 的发布反而会带来三大积极变化。
变化一:拉近中美 AI 差距
在“ChatGPT 为什么没有诞生在中国?”之后,龙年版本变成了“Sora 为什么没有诞生在中国?”接连错失元创新,让一些人失望。但科技发展没有一步登天,中国 AI 一直在正确道路上加速前进。Sora 的发布,反而会让中美 AI 距离进一步拉近,原因有三:
- 方向一致:OpenAI 的 ChatGPT、Sora 都基于大规模预训练模型的技术路径。中国 AI 一直持续跟进以 Transformer 架构为主的“大模型之路”,基础设施和算法层面都很扎实,没有点错技能树。
- 目标明确:Sora 明确了“视频生成模型是构建物理世界通用模拟器的有效路径”,为中国 AI 探明了方向。有了清晰的追赶目标,中国可以快速整合资源投入研发,中美距离必会缩小。
- 能力具备:无论是基础模型(如文心一言、讯飞星火、BAICHUAN 等)、文生图模型(文心一格、腾讯混元等),还是 AI 算力体系和大模型工具栈,中国都已具备。预计 2024 年就会看到国产 Sora 问世。
