谷歌在5月20日的I/O开发者大会上正式发布了全新视频模型Gemini Omni,这无疑是本届大会最受瞩目的亮点。该模型支持图片、视频、声音、角色等多模态输入,生成的视频画质惊艳,细节逼真程度令人印象深刻。首发版本Gemini Omni Flash现已正式上线。经过第一时间实测,这篇测评将带您详细了解:它到底怎么用?实际效果怎么样?与当前实力强劲的Seedance 2相比,谁更胜一筹?

一、全文速览图

二、怎么用?
当前体验Gemini Omni,主要有两个入口:
Flow(专业创作工具)
1. 生成视频


多模态输入,支持图片、视频、语音和角色

尺寸、数量、模型、时长的选择
2. 创建角色:

点击第二张banner,进入创建角色界面。

在新角色区域点击“+”号,即可添加角色。

使用时在角色列表中选择即可。

这里提供了角色提示词灵感,如果不知道如何编写,可以随机点一个试试。提示词自动填入后,自行选择香蕉Pro或2,然后点击提交。

人物角色生成完成后,可以设定音色。音色既有系统预设的,也可以自行描述。
Gemini

值得一提的是,Gemini App还有一个Avatar功能,但受地区限制,国内大部分用户在使用Gemini App时,该功能可能会被隐藏,因此很多人根本看不到,也无法正常体验。这个功能本身并不算稀奇。

其产品逻辑与国内豆包、即梦类似:先录制一段视频,根据提示念出文字,即可生成自己的数字分身,效果也没有明显差异。两者效果相当,甚至在某些场景中,Seedance的表现还会更稳定。
三、专业场景实测:物理与生物名词解析动画
基础的“天气变化”“背景替换”这类效果太简单了,不用想也知道它能做得不错。但真正的考验在于:它能否理解复杂专业场景?比如物理运动、生物过程、医学名词、连续动作等。
1. 物理类
牛顿摆:运动轨迹准确,物理还原度高 ✅
球体之间的碰撞、摆动节奏、能量传递关系,都较为符合逻辑。
高空落体(玻璃弹珠、鸡蛋、装水气球):整体表现良好,物理细节基本合理 ✅
大部分效果都还可以,尤其是玻璃弹珠、鸡蛋、装水气球这类材质差异明显的物体,表现相对准确。但乒乓球明显翻车——它落到玻璃面上时,接触面居然向内凹陷,这不太合理。乒乓球应该是轻质弹性球体,与玻璃面碰撞的反馈不应如此。这说明Gemini Omni对物理的理解尚未完全可靠。
小人连续动作打斗:流畅度和连贯性较为出色 ✅
动作衔接、镜头节奏、人物互动都比较自然。
2. 生物 / 医学类
- 人类妊娠过程:画面清晰,专业术语对应的动态演示准确 ✅
- 心动周期:节律感强,生物逻辑无明显错误 ✅
这部分效果比较稳定,它对流程、结构、节奏的理解较为清晰。
如果用于医学科普、生物教学、知识解释类动画,潜力确实非常大。
3. 视觉设计类
文字特效:效果接近专业设计软件的输出水准 ✅
很多视频模型的中文文字是个问题,要么乱码,要么变形,可识别度不高。但Gemini Omni的文字效果明显成熟很多,生成出来的文字更像在专业设计软件中排出来的,字体保持一致。但是!如果参考图片中包含文字,且不写提示词约束时,效果依然很模糊。
风格转绘:轻松驾驭,效果自然 ✅
风格转绘就更不用说了。无论是将画面转为插画风、粘土风、像素风、剪纸风、乐高风格,还是让角色保持一致性去做动作变化,它都能从容应对、游刃有余。
换衣服等基础任务:上传的视频中如果包含单独的人物素材,人物动态或场景完全没有问题,甚至还能在原有画面基础上优化,提升画面质感。不过,人物一致性还无法达到100%。
四、Gemini Omni vs Seedance 2:谁更强?
与当前视频生成领域的强劲对手Seedance 2正面比较后,感受大致如下:
1. 动作 / 打斗 / 人物运动场景
这块Seedance 2依然遥遥领先,差距比较明显。
尤其是人物跑动、打斗、复杂镜头调度、多人互动等高难度内容,Seedance 2的稳定性明显更强,整个运动过程更连贯,抽卡率也更低。
2. 物理 / 生物 / 专业概念动画解析
这类内容反而更看好Gemini Omni。
比如物理原理、生物医学、专业名词解释、结构拆解类动画,Omni的画面更干净,构图也更高级。它不一定追求很炸的运动效果,但在“把复杂概念讲清楚”这件事上,表现确实更舒服。
3. 宣传片 / 公益短片类视频
比如“吸烟有害健康”这类公益短片,从结果来看,更倾向于Omni的叙事逻辑。
它的表达会稍微收敛一些,不那么外放,画面和情绪推进也更克制。Seedance 2的叙事风格更直白、更强刺激,简单粗暴:一个健康的人,下一秒就变成快要“嘎了”的手术脸,主打“就问你怕不怕”。
这并不是说谁绝对更好,而是要考虑客户意见、品牌调性等多方面综合因素。有些项目需要强冲击、强警示,Seedance 2可能更合适;但如果想要更高级、更克制、更像品牌片的表达,从结果来看,会更倾向Gemini Omni。
Seedance 2依然是动态连贯性、人物动作、打斗等场景中的标杆。
但如果项目本身不追求人物大幅运动,而是更重视专业概念的准确表达、画面质感、构图审美和出片效率,那么可能会选择Gemini Omni。它在Flow里出片速度极快,基本秒出。
对实际工作来说,快就是很大的生产力。不是所有视频都需要炸裂效果,有些视频更需要干净、准确、质感好、能快速交付。
五、官方介绍
现阶段很多人都认为,AI视频生成领域里Seedance 2依然是行业天花板之一。尤其是人物运动、打斗场景、复杂镜头调度这类内容,它的稳定性确实已经大幅降低了“抽卡率”。这一点并非吹嘘,基本也是圈内共识。
这次实测下来,Omni在科普视频、物理原理动画、生物医学可视化、人像质感、公益宣传片等场景中表现更为突出。这类内容不需要特别“炸”的动作,更考验模型对信息的理解能力,以及将信息转化为动态画面的视觉表现力和准确性。就这一点而言,从结果来看,会更倾向Gemini Omni,画面更干净,整体质感也略胜一筹,特别适合做偏知识表达、品牌感、公益感、专业感的视频内容。
当然,Omni并非完美答案。人物运动依然不够稳定,物理细节偶尔失真;Avatar数字分身在逻辑上与豆包即梦、早期Sora相差不大;该功能国内用户也无法完整体验。另外补充一点:对比所用的是豆包里的Seedance 2,不同入口和版本的效果可能存在差异,仅供参考。
Seedance 2目前依然是最稳的AI视频生成工具之一,但Gemini Omni让我们看到了另一条路线——它不是单纯把视频做得更“炸”,而是把复杂信息理解得更准、画面表达得更干净。这让AI视频生成的边界,因此又往前推了一点。
