谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程

用户头像
重庆/UI设计师/52天前/2668浏览
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程
Current Time 0:00
/
Duration Time 0:00
Progress: NaN%
Playback Rate
1.00x
完整视频内容点击链接查看: http://xhslink.com/o/9B4uR2CdDJl Copy and open rednote to view the note,也可以小红书搜索:AI设计师lena-查看 :)
谷歌在 5 月 20 日的 I/O 开发者大会上正式发布全新多模态视频大模型
Gemini Omni
,毫无疑问是本届大会最受瞩目的亮点。
支持图片、视频、声音、角色多模态输入,生成视频画质惊艳,首发版本
Gemini Omni Flash
现已正式上线。我第一时间做了实测。
它到底怎么用?实际效果怎么样?和现在很强的 Seedance 2 比,有优势吗?
一、怎么用?
现在体验 Gemini Omni,大致有两个入口:
  • Flow
    (专业创作工具):labs.google/fx/zh/tools/flow
1、生成视频
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQxMDIw) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
首页第一张banner就是Omni的广告,点击那个进入
收藏
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQxMDI0) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
支持多模态输入:图片、视频、语音和角色
收藏
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQxMDI4) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
尺寸、数量、模型、时长的选择
收藏
2创建角色:
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQxMDMy) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
点首页第二张banner 进入创建角色页面
收藏
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQxMDM2) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
没有灵感,可以随机选择一个,会自动生成提示词,也会自动填入到输入框,图像生成模型香蕉2或者pro根据需要自行选择,区别不大,输入图片提交
收藏
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQwODI4) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
生成角色后,可以创建音色,系统有30于种音色可供选择,也可以自行创建
收藏
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzY5NTYw) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
收藏
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQxMDQw) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
使用时候在角色里选择就可以
收藏
  • Gemini
    :gemini.goole.com
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzQwODMy) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
收藏
值得一提的是,Gemini App 还有一个
Avatar 功能
,受地区限制,国内大部分用户在使用 Gemini App 的时候,这个功能可能会被隐藏,所以很多人根本看不到,也没法正常体验。
谷歌 I/O 2026 :Gemini Omni 全面实测 & 保姆教程(图ZNDA3NzY5NjA4) - AI作品 - 站酷设计师AI设计师Lena原创素材 - 站酷ZCOOL
收藏
这个功能本身不算稀奇。产品逻辑跟国内豆包、即梦一样的,先录制一段视频根据提示念文字,就有了自己的分身,效果也没有明显差别。两者效果相当,甚至在一些场景里,Seedance 的效果还会更稳。
二、专业场景实测:物理与生物名词解析动画
基础的“天气变化”“背景替换”这类效果。太简单了,不用想也知道它能做得不错。我想试试ta
能不能理解复杂专业场景?
比如物理运动、生物过程、医学名词、连续动作等。
1、物理类
  • 牛顿摆
    :运动轨迹准确,物理还原度高 ✅
球体之间的碰撞、摆动节奏、能量传递关系,都还比较符合逻辑。
Current Time 0:00
/
Duration Time 0:00
Progress: NaN%
Playback Rate
1.00x
  • 高空落体
    (玻璃弹珠、鸡蛋、装水气球):物理细节基本合理 ✅
大部分效果都还可以,尤其是玻璃弹珠、鸡蛋、装水气球这类材质差异比较明显的物体,表现相对准确。但乒乓球明显翻车。它落到玻璃面上的时候,接触面往里凹了,这个不太合理。乒乓球应该是轻质弹性球体,和玻璃面碰撞时的反馈不应该是这种表现。这说明 Gemini Omni 对物理的理解还不是完全可靠。
Current Time 0:00
/
Duration Time 0:00
Progress: NaN%
Playback Rate
1.00x
  • 小人连续动作打斗
    :流畅度和连贯性比较出色 ✅
动作衔接、镜头节奏、人物互动自然流畅。
2、生物 / 医学类
  • 人类妊娠过程
    :画面清晰,专业术语对应的动态演示准确 ✅ (因放不了太多实测案例,有想看的uu请移步小红书,搜索 AI设计师lena 查看)
  • 心动周期
    :节律感强,生物逻辑无明显错误 ✅
这部分效果比较稳定。它对流程、结构、节奏的理解比较清晰。
如果是用来做医学科普、生物教学、知识解释类动画,个人觉得 Gemini Omni 的潜力非常大。
3、视觉设计类
  • 文字特效
    :效果接近专业设计软件的输出水准 ✅
很多视频模型中文文字是个问题,要么乱码,要么变形,可识别度不高。但 Gemini Omni 的文字效果明显成熟很多。它生成出来的文字更像真的在设计软件里排出来的,字体保持一致,但是!!参考图片里包含文字的,不写提示词约束时,效果出来还是很糊。
  • 风格转绘
    :轻松驾驭,效果自然 ✅
风格转绘就更不用说了。不管是把画面转成某种插画风、粘土风、像素风、剪纸风、乐高风格等,还是让角色保持一致性去做动作变化,它都可以做到从从容容、游刃有余。
  • 换衣服
    等基础任务:上传的视频里含有人物素材单独,人物动态或者场景是完全没有问题,甚至还能在以前的画面基础上优化,让画面质感变得更好,不过人物一致性还达不到100%
三、Gemini Omni vs Seedance 2,谁更强?
和目前视频生成领域的强劲对手
Seedance 2
正面比较下来,我的感受大概是这样:
动作 / 打斗 / 人物运动场景
这块 Seedance 2 依然遥遥领先,差距比较明显。
尤其是人物跑动、打斗、复杂镜头调度、多人互动这些高难度内容,Seedance 2 的稳定性明显更强。整个运动过程更连贯,抽卡率也更低。
物理 / 生物 / 专业概念动画解析
这类内容我反而更看好
Gemini Omni
比如物理原理、生物医学、专业名词解释、结构拆解类动画,Omni 的画面更干净,构图也更高级。它不一定追求很炸的运动效果,但在“把复杂概念讲清楚”这件事上,表现确实更舒服。
宣传片 / 公益短片类视频
比如“吸烟有害健康”这类公益短片,我个人会更喜欢 Omni 的叙事逻辑。
它的表达会稍微收一点,不那么外放,画面和情绪推进也更克制。Seedance 2 的叙事风格更直白、更强刺激,简单粗暴一点:一个健康的人,下一秒就变成快要“嘎了”的js脸,主打一个“就问你怕不怕”。
这不是说谁绝对更好,而是考虑客户老板的意见、品牌调性等多方综合考虑。有些项目就是要强冲击、强警示,那 Seedance 2 可能更合适;但如果想要更高级、更克制、更像品牌片的表达,我会更倾向 Gemini Omni。
Seedance 2 依然是动态连贯性、人物动作、打斗等场景里的标杆。
但如果项目本身不追求人物大幅运动,而是更重视专业概念的准确表达、画面质感、构图审美和出片效率,那我可能会选择
Gemini Omni
它在 Flow 里出片太快了,基本秒出。
对实际工作来说,快就是很大的生产力。不是所有视频都需要炸,有些视频更需要干净、准确、质感好、能快速交付。
完整视频内容点击链接查看: http://xhslink.com/o/9B4uR2CdDJl Copy and open rednote to view the note,也可以小红书搜索:AI设计师Lena-查看 :)
四、官方介绍
https://www.youtube.com/watch?v=uW4B6ziQqvY
现阶段很多人都认为,AI 视频生成里 Seedance 2 依然是行业天花板之一。尤其是人物运动、打斗场景、复杂镜头调度这类内容,它的稳定性确实已经把"抽卡率"大幅压了下来。这一点不是吹,基本也是圈内共识。
这次实测下来,Omni 在科普视频、物理原理动画、生物医学可视化、人像质感、公益宣传片等场景表现更为突出。这类内容不需要特别"炸"的动作,更考验模型对信息的理解能力,以及将信息转化为动态画面的视觉表现力和准确性。就这一点而言,我个人会更倾向 Gemini Omni,画面更干净,整体质感也略胜一筹,特别适合做偏知识表达、品牌感、公益感、专业感的视频内容。
当然,Omni 并非完美答案。人物运动依然不够稳定,物理细节偶尔失真;Avatar 数字分身在逻辑上与豆包即梦、早期 Sora 相差不大;这个功能国内用户也无法完整体验。另外补充一点下:我对比所用的是豆包里的 Seedance 2,不同入口和版本的效果可能存在差异,仅供参考。
Seedance 2 目前依然是最稳的 AI 视频生成工具之一,但 Gemini Omni 让我们看到了另一条路线,它不是单纯把视频做得更"炸",而是把复杂信息理解得更准、画面表达得更干净。这让AI 视频生成的边界,因此又往前推了一点。
87
举报
|
30
分享
相关推荐
评论
用户头像
评论你的想法~
表情
喜欢TA的作品吗?喜欢就快来夸夸TA吧!
推荐素材
【渴症】心安的种子
招聘-AI矢量艺术字
蛇年大吉 | 新年插画文创设计
春分-AI矢量艺术字
中国风山水画水墨风景国画壁画富春山居图画框客厅挂画
洞洞鞋产品场景AI作品
五常大米包装设计
五常大米包装设计
财神到-国潮字体标志组合AI源文件
蛇年旺财 | 新年插画文创设计
招聘艺术字
破影-AI矢量艺术字源文件
穿滑轮鞋的年轻男女|青春活力户外运动人物素材
中国风山水画水墨风景国画壁画富春山居图画框客厅挂画
一帆风顺-国潮字体标志组合AI源文件
少女荧光粉色渐变合集
中国风山水画水墨风景国画壁画富春山居图画框客厅挂画
中国风山水画水墨风景国画壁画富春山居图画框客厅挂画
兔小卷系列1
花开富贵牡丹花白色孔雀中式国画画框装饰素材客厅壁画
追梦-AI矢量艺术字
蛇行大运·蛇年卡通新年吉祥物
新年蛇年卡通形象:蛇年吉祥插画
【矢量/PSD】二次元少女角色立绘
东北大米包装设计
你可能喜欢
相关收藏夹
地产VI
地产VI
地产VI
地产VI
大家都在看
登录注册