Gemini Omni Flash (gemini-omni-flash-preview) 是一款高性能多模态模型,专为高速视频生成、编辑和电影控制而设计。
Gemini Omni 基于以下核心功能构建,这些功能使其与之前的视频模型有所不同:
- 原生多模态 :它可以同时处理文本、图片、音频和视频,为您提供更具凝聚力、一致性和可控性的输出。
- 对话式编辑:借助 Interactions API,您可以通过自然语言对话以迭代方式优化 和编辑视频。描述您想要更改的内容,模型会在应用编辑的同时保留您想要保留的视频部分。
- 世界知识 :Gemini Omni 将对物理学的理解与 Gemini 的历史、科学和文化背景知识相结合,弥合了从照片写实主义到有意义的故事讲述之间的差距。
文生视频
根据文本提示生成视频。模型会根据您的文本描述生成带音频的视频。撰写提示时,请添加场景描述、镜头移动、光效和氛围等详细信息,以获得最佳效果。
Python
import base64
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-omni-flash-preview",
input="A marble rolling fast on a chain reaction style track, continuous smooth shot."
)
with open("marble.mp4", "wb") as f:
f.write(base64.b64decode(interaction.