对于移动应用和 Web 应用,Firebase AI Logic SDK 可让您直接从应用中与受支持的 Gemini 模型互动。
Gemini 模型之所以被视为多模态模型,是因为它们能够处理甚至生成多种模态的内容,包括文本、代码、PDF、图片、视频和音频。
此外,请查看我们的常见问题解答,了解 Firebase AI Logic 支持和不支持的所有模型。
精选模型
Gemini 3.8 Flash
gemini-3.8-flash
以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
一款高吞吐量、成本敏感型实用模型,具有 Gemini 3 系列的性能和质量。
Gemini 3.1 Flash Image (Nano Banana 2)
gemini-3.1-flash-image
功能强大、高效的图片生成和编辑模型,专为极致速度与大规模量产场景而优化。
通用模型
Gemini 3.1 Pro
gemini-3.1-pro-preview
具备高级智能、复杂问题解决能力,以及强大的智能体和氛围编程能力。
Gemini 3.8 Flash
gemini-3.8-flash
以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
一款高吞吐量、成本敏感型实用模型,具有 Gemini 3 系列的性能和质量。
旧版稳定通用模型
Gemini 3.7 Flash (
gemini-3.7-flash): 之前的 Gemini 3.x Flash 模型,可提供媲美大型模型的出色性能,但成本却低得多。 (结算不是必需的)Gemini 3.6 Flash (
gemini-3.6-flash): 之前的 Gemini 3.x Flash 模型,可提供媲美大型模型的出色性能,但成本却低得多。 (结算不是必需的)Gemini 3.5 Flash (
gemini-3.5-flash): 之前的 Gemini 3.x Flash 模型,可提供媲美大型模型的出色性能,但成本却低得多。 (结算不是必需的)Gemini 3.1 Flash‑Lite (
gemini-3.1-flash-lite):之前的 Gemini 3.x Flash‑Lite 模型,适用于对成本敏感的大量日常任务。 (结算不是必需的)
图片生成模型
Gemini 3 Pro Image(Nano Banana Pro)
gemini-3-pro-image
前沿图片生成和编辑模型,可高度根据上下文创建原生图片。
Gemini 3.1 Flash Image (Nano Banana 2)
gemini-3.1-flash-image
功能强大、高效的图片生成和编辑模型,专为极致速度与大规模量产场景而优化。
Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)
gemini-3.1-flash-lite-image
超低延迟且经济高效的图片生成和编辑模型,专为高用量交互式应用场景而设计。
音频生成模型
文字转语音 (TTS) 模型
您可以使用 Gemini TTS 模型根据文本输入生成语音。
Gemini 3.x Flash TTS
gemini-3.1-flash-tts-preview
根据文本输入生成低延迟的强大语音。
Live API 个模型
您可以使用支持 Gemini Live API 的模型生成双向流式音频。
Gemini 3.x Flash(支持 Gemini Live API 原生音频)
Gemini Developer API:gemini-3.1-flash-live-preview
Agent Platform Gemini API:
不支持
支持与双向 Gemini 模型进行低延迟、实时的语音和视频互动。
Gemini 2.5 Flash(支持 Gemini Live API 原生音频)
Gemini Developer API:gemini-2.5-flash-native-audio-preview-12-2025
Agent Platform Gemini API:gemini-live-2.5-flash-native-audio
支持与双向 Gemini 模型进行低延迟、实时的语音和视频互动。
本页的其余部分详细介绍了 Firebase AI Logic 支持的型号。
比较模型:
- 支持的输入和输出
- 支持的功能的高级比较
- 规范和限制,例如输入 token 数上限或输入视频时长上限
说明模型如何进行版本控制,特别是其稳定版、预览版和实验版
在初始化期间包含在代码中的可用模型名称列表
在本页底部,您可以查看有关上一代模型的详细信息。
对比模型
每种模型都具有不同的功能,可支持各种用例。请注意,本部分中的每个表格都描述了每个模型在与 Firebase AI Logic 搭配使用时的情况。每种模型可能都具有使用我们的 SDK 时无法使用的其他功能。
如果您在以下子部分中找不到所需信息,还可以在所选 API 提供商的文档中找到更多信息:Gemini Developer API 或 Agent Platform Gemini API (formerly Vertex AI)。
支持的输入和输出
下表列出了将每个模型与 Firebase AI Logic 搭配使用时支持的输入和输出类型。
如需了解支持的文件类型,请参阅支持的输入文件和要求。
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| 输入类型 | ||||||
| 文字 | ||||||
| 代码 | ||||||
| 文档 (PDF 或纯文本) |
||||||
| 图片 | ||||||
| 视频 | ||||||
| 音频 | ||||||
| 输出类型 | ||||||
| 文字 | ||||||
| 文本(流式传输) | ||||||
| 代码 | ||||||
| 结构化输出 (例如 JSON) |
||||||
| 图片 | ||||||
| 视频 | ||||||
| 音频 | ||||||
支持的功能和特性
下表列出了将每种模型与 Firebase AI Logic 搭配使用时支持的功能和特性。
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| 思考型 | ||||||
| 根据纯文本输入或多模态输入生成文本 | 交错或作为图片的一部分 | 交错或作为图片的一部分 | 交错或作为图片的一部分 |