说起最近AI圈最火的话题,OpenAI的Sora绝对算一个。这可不是什么简单的视频生成工具——2024年2月15日(美国当地时间)正式亮相时,OpenAI给它贴的标签是“世界模拟器”。说白了,他们想做的远远不止是让AI学会剪片子。

那么,Sora到底是怎么工作的?它本质上是一种扩散模型:一开始,你看到的是一堆毫无意义的静态噪点,然后模型通过多个步骤逐步去除这些噪声,画面就像从迷雾中逐渐显形一样,最终变成清晰的场景。这个过程听起来玄乎,但关键还在于它能一次生成多帧预测——当画面中的某个主体暂时离开镜头视野,再回来时,形状、颜色、纹理依然保持一致。这一点,才是它被称为“世界模拟器”的真正底气所在。
当然,对于国内用户来说,眼下还有个现实问题:Sora在中国能用吗?答案是,目前还不能。根据公开信息,这个模型仍处于受邀测试阶段,并未向公众开放。换句话说,即便你翻跟斗出去,大概率也只能看到“仅限受邀用户”的门牌。而且,从技术角度看,它在创意表达的丰富性和某些实现细节上,可能还有不少需要打磨的地方——毕竟,这才刚刚起步。
