了解支持的型号

对于移动应用和 Web 应用,Firebase AI Logic SDK 可让您直接从应用中与受支持的 Gemini 模型互动。

Gemini 模型之所以被视为多模态模型,是因为它们能够处理甚至生成多种模态的内容,包括文本、代码、PDF、图片、视频和音频。

此外,请查看我们的常见问题解答,了解 Firebase AI Logic 支持和不支持的所有模型。

FAST AND INTELLIGENT

gemini-3.8-flash

以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。 (结算是必需的)

超快

gemini-3.5-flash-lite

一款高吞吐量、成本敏感型实用模型,具有 Gemini 3 系列的性能和质量。 (结算是必需的)

正在生成图片

gemini-3.1-flash-image

功能强大、高效的图片生成和编辑模型,专为极致速度与大规模量产场景而优化。 (需要结算)

通用模型

前往包含模型详细信息的表格

gemini-3.1-pro-preview

具备高级智能、复杂问题解决能力,以及强大的智能体和氛围编程能力。(需要结算)

gemini-3.8-flash

以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。 (结算是必需的)

gemini-3.5-flash-lite

一款高吞吐量、成本敏感型实用模型,具有 Gemini 3 系列的性能和质量。 (结算是必需的)

旧版稳定通用模型
  • Gemini 3.7 Flash (gemini-3.7-flash): 之前的 Gemini 3.x Flash 模型,可提供媲美大型模型的出色性能,但成本却低得多。 (结算是必需的)

  • Gemini 3.6 Flash (gemini-3.6-flash): 之前的 Gemini 3.x Flash 模型,可提供媲美大型模型的出色性能,但成本却低得多。 (结算是必需的)

  • Gemini 3.5 Flash (gemini-3.5-flash): 之前的 Gemini 3.x Flash 模型,可提供媲美大型模型的出色性能,但成本却低得多。 (结算是必需的)

  • Gemini 3.1 Flash‑Lite (gemini-3.1-flash-lite):之前的 Gemini 3.x Flash‑Lite 模型,适用于对成本敏感的大量日常任务。 (结算是必需的)

图片生成模型

前往包含模型详细信息的表格

gemini-3-pro-image

前沿图片生成和编辑模型,可高度根据上下文创建原生图片。(需要结算)

gemini-3.1-flash-image

功能强大、高效的图片生成和编辑模型,专为极致速度与大规模量产场景而优化。 (需要结算)

gemini-3.1-flash-lite-image

超低延迟且经济高效的图片生成和编辑模型,专为高用量交互式应用场景而设计。 (需要结算)

音频生成模型

文字转语音 (TTS) 模型

您可以使用 Gemini TTS 模型根据文本输入生成语音。

前往包含模型详细信息的表格

gemini-3.1-flash-tts-preview

根据文本输入生成低延迟的强大语音。 (结算是必需的)

Live API 个模型

您可以使用支持 Gemini Live API 的模型生成双向流式音频。

前往包含模型详细信息的表格

Gemini Developer API:
gemini-3.1-flash-live-preview

Agent Platform Gemini API:
不支持

支持与双向 Gemini 模型进行低延迟、实时的语音和视频互动。 (结算是必需的)

Gemini Developer API:
gemini-2.5-flash-native-audio-preview-12-2025

Agent Platform Gemini API:
gemini-live-2.5-flash-native-audio

支持与双向 Gemini 模型进行低延迟、实时的语音和视频互动。 (结算是必需的)


本页的其余部分详细介绍了 Firebase AI Logic 支持的型号。

  • 比较模型

    • 支持的输入和输出
    • 支持的功能的高级比较
    • 规范和限制,例如输入 token 数上限或输入视频时长上限
  • 说明模型如何进行版本控制,特别是其稳定版预览版实验版

  • 在初始化期间包含在代码中的可用模型名称列表

  • 模型支持的语言列表

在本页底部,您可以查看有关上一代模型的详细信息



对比模型

每种模型都具有不同的功能,可支持各种用例。请注意,本部分中的每个表格都描述了每个模型在与 Firebase AI Logic 搭配使用时的情况。每种模型可能都具有使用我们的 SDK 时无法使用的其他功能。

如果您在以下子部分中找不到所需信息,还可以在所选 API 提供商的文档中找到更多信息:Gemini Developer APIAgent Platform Gemini API (formerly Vertex AI)

支持的输入和输出

下表列出了将每个模型与 Firebase AI Logic 搭配使用时支持的输入和输出类型

如需了解支持的文件类型,请参阅支持的输入文件和要求

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
输入类型
文字
代码
文档
(PDF 或纯文本)
图片
视频
音频
输出类型
文字
文本(流式传输)
代码
结构化输出
(例如 JSON)
图片
视频
音频

支持的功能和特性

下表列出了将每种模型与 Firebase AI Logic 搭配使用时支持的功能和特性

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
思考型
根据纯文本输入或多模态输入生成文本 交错或作为图片的一部分 交错或作为图片的一部分 交错或作为图片的一部分