Google · 多模态模型

Google Gemini 系列

Gemini 3.x 覆盖复杂推理、代码、Agent、实时交互及原生多模态,并延伸至图像、视频、音乐与计算机操作。

查看官方模型文档 官方资料核验于 2026/08/27

资料待复核:以下为 2026/08/27 的研究快照,型号、价格与可用性可能已变化。请通过上方官方文档确认最新信息。

当前主线Gemini 3.7 Flash 与 Gemini 3.x 模型家族
上下文按 Gemini 3.x 的具体稳定版或预览版核对
输入模态文本、图像、音频、视频、实时交互
交付形态Gemini API、Google AI Studio、Vertex AI
Current Models

当前重点型号

Gemini 3.7 FlashGemini 3.6 FlashGemini 3.5 FlashGemini 3.1 Pro PreviewGemini Omni Flash

价格与采购观察

Gemini 按型号、输入模态、上下文长度、缓存与批处理分别计费;稳定版和预览版价格可能不同,应在上线前按模型详情与 Vertex AI 区域复核。

进入全量模型端点与价格目录

当前主线

Google 官方模型目录把 Gemini 3.7 Flash 定位为当前 Flash 主力,Gemini 3.6、3.5 系列提供稳定生产选择,Gemini 3.1 Pro 等预览型号面向更高能力试用。实时翻译、Live、TTS、Omni,以及 Nano Banana、Veo、Lyria 等专项家族共同构成原生多模态能力栈。

官方将模型分为 stable、preview、latest 和 experimental。企业生产应优先固定稳定版本;latest 可能热切换,preview 和 experimental 的生命周期与兼容性风险更高。

Agent 与企业评估

Gemini 适合同时读取文本、图像、音频、视频与界面的工作流。应分别评测多模态输入质量、工具调用、Deep Research、Computer Use、长上下文利用率,以及 Google Cloud 的身份、区域与审计整合。

风险与边界

同一品牌下的输入模态、工具、区域与输出限制差异很大。价格评估必须包含媒体 Token、缓存、Grounding、批处理和 Vertex AI 网络/存储成本,不应只比较文本单价。

Continue Research

继续完成企业模型决策