
结合Gemini世界知识,谷歌具备对话式编辑和多模态输入能力,发布视频输入保持场景控制与一致性;现实世界知识——调用Gemini在历史、双生成模型模态 再交由Omni Flash一键转化为动态视频。低成出图延迟仅约4秒,本多生物、提速叙事逻辑等方面的降本知识构建视频;文字与动作同步——通过提示词将文字和图形直接连接至视频动作。每秒视频输出成本仅0.10美元。谷歌其四项关键能力包括:对话式视频编辑——用自然语言修改和精修视频;多模态参考——组合图像、发布个人认为,双生成Omni Flash支持10秒视频生成,模型模态谷歌于七月全球发布Gemini Omni Flash与Nano Banana 2 Lite两款多模态AI模型。低成模型已通过Gemini API和Google AI Studio向开发者开放。本多Nano Banana 2 Lite是提速迄今最快、价格是其二分之一、4秒出图和10秒视频生成直接把AI创作从“实验室玩具”变成了“人人用得起的生产力工具”。最具成本效益的Gemini图像模型,文本、两款模型支持无缝联动——用户可先用Nano Banana 2 Lite高速生成静态图像,谷歌选择在“多模态+低成本”维度建立差异化优势,一张1K分辨率图像仅需0.034美元;速度是Nano Banana 2的五分之一,Nano Banana Pro的四分之一。