Gemini Omni Flash 预览版

Gemini Omni Flash(预览版)是一个多模态模型,专为视频、图片和文本任务而设计。它针对视频生成进行了优化,可在单个模型中提供视频输出和文本回答。

在 Agent Studio 中试用 在 Model Garden 中查看 部署示例应用 查看价格

注意:“部署示例应用”需要拥有一个启用了结算功能和 Agent Platform API 的 Google Cloud 项目。
模型 ID gemini-omni-flash-preview
模态
Text Input and output
Image Input only
Audio 不支持
Video Input and output
token 数量上限 输入 token 数上限 131,072
输出 token 数上限 57,920
功能
工具
使用选项
技术规范 图片
  • 每个提示的图片数量上限: 10
  • 内嵌数据或通过控制台直接上传的每个文件的文件大小上限: 20 GiB
  • 支持的宽高比: 16:9、9:16
  • 支持的分辨率: 720p
  • 支持的 MIME 类型:
    image/pngimage/jpegimage/webpimage/heicimage/heif
文本
  • 通过 API 或 Cloud Storage 导入时,每个文件的文件大小上限: 50 MB
  • 通过控制台直接上传的每个文件的文件大小上限: 7 MB
  • 支持的 MIME 类型:
    text/plain
视频
  • 视频时长上限(包含音频): 10 秒
  • 视频时长上限(不含音频): 10 秒
  • 每个提示的视频数量上限: 3
  • 支持的 MIME 类型:
    video/x-flvvideo/quicktimevideo/mpegvideo/mpegsvideo/mpgvideo/mp4video/webmvideo/wmvvideo/3gpp
参数默认值
  • 温度:0.0-2.0(默认值为 1.0)
  • topP:0.0-1.0(默认值为 0.95)
  • candidateCount:1
支持的区域

模型可用性

  • 全球: global

标准 PayGo

  • 全球: global
版本
  • gemini-omni-flash-preview
    • 发布阶段:预览版
    • 发布日期:2026 年 6 月 30 日
    • 停用日期:2027 年 6 月 30 日