Gemini Interactions API

The Gemini Interactions API allows developers to build generative AI applications using Gemini models. Gemini is our most capable model, built from the ground up to be multimodal. It can generalize and seamlessly understand, operate across, and combine different types of information including language, images, audio, video, and code. You can use the Gemini API for use cases like reasoning across text and images, content generation, dialogue agents, summarization and classification systems, and more.

Версия API: v1beta v1

Создание взаимодействия

публикация https://generativelanguage.googleapis.com/v1beta/interactions

Создает новое взаимодействие.

Путь / Параметры запроса

api_version строка (обязательно)

Какую версию API использовать?

Текст запроса

Тело запроса содержит данные следующей структуры:

модель ModelOption (необязательно)

Название модели, использованной для генерации взаимодействия.
Обязательно, если параметр `agent` не указан.

Модель, которая выполнит ваш запрос.\n\nДополнительную информацию см. в разделе [модели](https://ai.google.dev/gemini-api/docs/models).

Возможные значения

  • gemini-2.5-flash

    Наша первая гибридная модель рассуждений, поддерживающая контекстное окно в 1 миллион токенов и имеющая бюджеты мышления.

  • gemini-2.5-pro

    Наша передовая многоцелевая модель, превосходно справляющаяся с задачами программирования и сложным логическим мышлением.

  • gemma-4-26b-a4b-it

    Джемма 4 26B A4B IT

  • gemma-4-31b-it

    Джемма 4 31B IT

  • gemini-flash-latest

    Последняя версия Gemini Flash

  • gemini-flash-lite-latest

    Новейшая версия фонарика Gemini Flash-Lite

  • gemini-pro-latest

    Последняя версия Gemini Pro

  • gemini-2.5-flash-lite

    Наша самая компактная и экономичная модель, предназначенная для масштабного использования.

  • gemini-2.5-flash-image

    Наша собственная модель генерации изображений, оптимизированная для скорости, гибкости и контекстного понимания. Стоимость ввода и вывода текста такая же, как у 2,5-дюймовой версии Flash.

  • gemini-3-flash-preview

    Наша самая интеллектуальная модель, созданная для скорости, сочетает в себе передовые методы разведки с превосходными возможностями поиска и посадки на землю.

  • gemini-3.1-pro-preview

    Наша новейшая, передовая модель логического мышления с беспрецедентной глубиной и детализацией, а также мощными возможностями многомодального понимания и кодирования.

  • gemini-3.1-pro-preview-customtools

    Gemini 3.1 Pro Preview оптимизирован для использования пользовательских инструментов.

  • gemini-3.1-flash-lite

    Наша наиболее экономичная модель, оптимизированная для выполнения больших объемов агентских задач, перевода и простой обработки данных.

  • gemini-3-pro-image

    Изображение Gemini 3 Pro

  • nano-banana-pro-preview

    Предварительный просмотр изображения Gemini 3 Pro

  • gemini-3.1-flash-image

    Изображение Gemini 3.1 Flash.

  • gemini-3.5-flash

    Наша наиболее интеллектуальная модель для достижения устойчиво высоких результатов в задачах, связанных с агентным программированием и кодированием.

  • gemini-3.6-flash

    Наша наиболее интеллектуальная модель для достижения устойчиво высоких результатов в задачах, связанных с агентным программированием и кодированием.

  • gemini-3.7-flash

    Наша наиболее интеллектуальная модель для достижения устойчиво высоких результатов в задачах, связанных с агентным программированием и кодированием.

  • lyria-3-clip-preview

    Наша модель генерации музыки с низкой задержкой оптимизирована для высококачественных аудиоклипов и точного контроля ритма.

  • lyria-3-pro-preview

    Наша передовая генеративная модель, способная обрабатывать целые композиции и обладающая глубоким пониманием композиции, оптимизирована для точного структурного контроля и сложных переходов между различными музыкальными стилями.

  • gemini-robotics-er-1.6-preview

    Gemini Robotics-ER 1.6 Preview

  • gemini-robotics-er-2-preview

    Предварительный обзор Gemini Robotics Embodied Reasoning 2

агент AgentOption (необязательно)

Имя агента, использованного для генерации взаимодействия.
Обязательно, если параметр `model` не указан.

Агент, с которым необходимо взаимодействовать.

Возможные значения

  • deep-research-pro-preview-12-2025

    Агент по глубоким исследованиям компании Gemini

  • deep-research-preview-04-2026

    Агент по глубоким исследованиям компании Gemini

  • deep-research-max-preview-04-2026

    Gemini Deep Research Max Agent

  • antigravity-preview-05-2026

    Используйте управляемый агент Antigravity для выполнения многоэтапных задач, требующих логического мышления, работы с файлами и использования инструментов.

Входные данные: Content или array ( Content ) или array ( Step ) или string (обязательно)

Входные данные для взаимодействия (общие для модели и агента).

строка системной инструкции (необязательно)

Системная инструкция для взаимодействия.

массив инструментов ( Инструмент ) (необязательно)

Список объявлений инструментов, которые модель может вызывать во время взаимодействия.

response_format ResponseFormat или массив ( ResponseFormat ) (необязательно)

Обеспечивает, чтобы сгенерированный ответ представлял собой объект JSON, соответствующий схеме JSON, указанной в этом поле.

потоковое логическое значение (необязательно)

Только ввод данных. Будет ли взаимодействие передаваться в потоковом режиме.

хранить логическое значение (необязательно)

Только ввод. Следует ли сохранять ответ и запрос для последующего получения.

фоновое логическое значение (необязательно)

Только ввод данных. Следует ли запускать взаимодействие с моделью в фоновом режиме.

generation_config GenerationConfig (необязательно)

Конфигурация модели
Параметры конфигурации для взаимодействия модели.
Альтернатива `agent_config`. Применимо только при заданном `model`.

Параметры конфигурации для взаимодействия моделей.

Поля

max_output_tokens — целое число (необязательно)

Максимальное количество токенов, которые можно включить в ответ.

Начальное целое число (необязательно)

Исходные данные используются при декодировании для обеспечения воспроизводимости.

speech_config SpeakerConfig или массив (SpeechConfig) (необязательно)

Дополнительно. Настройка речи и работы с несколькими говорящими.

Настройка для работы с несколькими говорящими и генерации речи.

Поля

Массив динамиков (SpeechConfig) (необязательно)

Индивидуальные настройки акустических систем.

Настройки для речевого взаимодействия.

Поля

языковая строка (необязательно)

Язык речи.

Кабель для подключения динамика (опционально)

Имя выступающего должно совпадать с именем выступающего, указанным в задании.

голосовая строка (необязательно)

Голос говорящего.

массив stop_sequences (строка) (необязательно)

Список последовательностей символов, которые прекратят взаимодействие с выводом.

thinking_level ThinkingLevel (необязательно)

Уровень мыслительных токенов, которые должна генерировать модель.

Возможные значения

  • minimal

    Практически никакого размышления.

  • low

    Низкий уровень мышления.

  • medium

    Средний уровень сложности мышления.

  • high

    Высокий уровень мыслительных способностей.

thinking_summaries ThinkingSummaries (необязательно)

Стоит ли включать в ответ краткое изложение мыслей?

Возможные значения

  • auto

    Краткие обзоры автоматического мышления.

  • none

    Никаких кратких изложений мысли.

tool_choice ToolChoiceConfig или перечисление (строка) (необязательно)

Конфигурация выбора инструмента.

Возможные значения:

  • auto

    Автоматический выбор инструмента.

  • any

    Любой выбор инструмента.

  • none

    Выбор инструментов отсутствует.

  • validated

    Выбор инструмента подтвержден.

transcription_config TranscriptionConfig (необязательно)

Необязательно. Настройки для распознавания речи (транскрипции). Если присутствует, функция автоматического распознавания речи (ASR) включена.

Настройка распознавания речи (транскрипции).

Поля

массив custom_vocabulary (строка) (необязательно)

Необязательно. Список пользовательских лексических фраз, которые помогут модели распознавания речи сместить акцент в сторону распознавания конкретных терминов.

массив language_codes (строка) (необязательно)

Необязательно. Коды языков BCP-47, указывающие на языки, присутствующие в аудиозаписи. Если поле опущено или пустое, по умолчанию используется автоматическое определение языка.

режим TranscriptionMode или перечисление (строка) (необязательно)

Параметры или перечисление режима дифференцированной транскрипции.

Настройки режима транскрипции.

Возможные типы

SmartTranscriptionMode

Настройки для режима интеллектуальной транскрипции.

тип объекта (обязательно)

Описание отсутствует.

Всегда устанавливать режим "smart" .

Режим дословной транскрипции

Настройки для режима дословной транскрипции.

diarization_mode string (необязательно)

Необязательный параметр. Настраивает диаризацию говорящих. Поддерживаемые значения: "speaker".

массив timestamp_granularities (строка) (необязательно)

Необязательный параметр. Укажите степень детализации временных меток, которые будут включены в выходные данные транскрипции. Поддерживаемые значения: "word". Если поле пустое, временные метки не генерируются.

тип объекта (обязательно)

Описание отсутствует.

Всегда устанавливайте значение "verbatim" .

video_config VideoConfig (необязательно)

Настройки для генерации видео.

Параметры конфигурации для генерации видео.

Поля

перечисление задач (строка) (необязательно)

Дополнительный режим работы для генерации видео. Если не указан, модель автоматически определяет соответствующий режим на основе предоставленной текстовой подсказки и входных данных.

Возможные значения:

  • text_to_video

    Создает видео исключительно на основе текстовой подсказки.

  • image_to_video

    Создает видео из одного или двух исходных изображений. Первое изображение определяет начальный кадр, а дополнительное второе изображение определяет конечный кадр.

  • reference_to_video

    Создает видео, используя исходные медиафайлы (такие как изображения, аудио или видео).

  • edit

    Изменяет существующее входное видео.

  • extend

    Расширяет возможности существующего входного видео.

объект agent_config (необязательно)

Конфигурация агента
Настройки агента.
Альтернатива `generation_config`. Применимо только при заданном `agent`.

Возможные типы

Полиморфный дискриминатор: type

AntigravityAgentConfig

Настройки среды выполнения агента Antigravity. Обеспечивают управление средой выполнения агента и конфигурацией инструментов на стороне сервера.

max_total_tokens строка (необязательно)

Максимальное общее количество токенов для выполнения задания агентом.

строка модели (необязательно)

Модель, используемая для рассуждений агента.

тип объекта (обязательно)

Описание отсутствует.

Всегда устанавливайте режим "antigravity" .

CodeMenderAgentConfig

Настройки агента CodeMender.

find_request FindRequest (необязательно)

Параметры для поиска уязвимостей.

Параметры запроса, специфичные для сессий FIND, используются для обнаружения уязвимостей в кодовой базе.

Поля

строка описания (необязательно)

Дополнительный контекст или пользовательские инструкции, предоставленные пользователем для проведения анализа уязвимостей.

finding_id строка (необязательно)

Идентификатор конкретной уязвимости, подлежащей проверке. В основном используется в режиме ПРОВЕРКИ (VERIFY) для того, чтобы сосредоточить проверку агента на выполнении на одной конкретной уязвимости.

режим перечисления (строка) (необязательно)

Режим работы поисковой сессии.

Возможные значения:

  • scan

    Быстрое сканирование с использованием только исходного классификатора.

  • verify

    Проводит классификацию с последующим детальным исследованием.

массив source_files (FileContent) (необязательно)

Список исходных файлов, которые необходимо предоставить в качестве контекста для сканирования.

Содержимое отдельного файла в кодовой базе.

Поля

строка содержимого (необязательно)

Содержимое файла, закодированное в UTF-8.

строка пути (необязательно)

Относительный путь к файлу относительно корневого каталога проекта.

fix_request FixRequest (необязательно)

Параметры для устранения уязвимостей.

Параметры запроса, специфичные для FIX-сессий, используются для генерации и проверки обновлений безопасности.

Поля

строка описания (необязательно)

Дополнительный контекст или пользовательские инструкции, предоставленные пользователем для управления процессом создания патча.

finding_id строка (необязательно)

Идентификатор конкретной уязвимости, подлежащей устранению. Этот идентификатор соответствует ранее обнаруженной уязвимости.

массив source_files (FileContent) (необязательно)

Список исходных файлов, предоставляющих контекст для устранения проблемы. Как правило, это файлы, содержащие выявленную уязвимость.

Содержимое отдельного файла в кодовой базе.

Поля

строка содержимого (необязательно)

Содержимое файла, закодированное в UTF-8.

строка пути (необязательно)

Относительный путь к файлу относительно корневого каталога проекта.

строка модели (необязательно)

Название модели, используемой для агента CodeMender. Одна сессия CodeMender будет использовать только одну модель.

session_config SessionConfig (необязательно)

Дополнительные параметры конфигурации, специфичные для каждой сессии, позволяют переопределить поведение агента по умолчанию.

Настройка сессий CodeMender.

Поля

max_rounds — целое число (необязательно)

Максимальное количество раундов взаимодействия, которое агент может выполнить до истечения тайм-аута.

session_id строка (необязательно)

Параметр для группировки нескольких взаимодействий, относящихся к одной и той же сессии CodeMender.

тип объекта (обязательно)

Описание отсутствует.

Всегда устанавливайте значение "code-mender" .

DeepResearchAgentConfig

Настройки агента Deep Research.

collaborative_planning логическое значение (необязательно)

Включает планирование с участием человека для агента Deep Research. Если установлено значение true, агент Deep Research предоставит план исследования в своем ответе. Затем агент продолжит работу только в том случае, если пользователь подтвердит план на следующем ходу.

enable_bigquery_tool boolean (необязательно)

Включает инструмент BigQuery для агента Deep Research.

thinking_summaries ThinkingSummaries (необязательно)

Стоит ли включать в ответ краткое изложение мыслей?

Возможные значения

  • auto

    Краткие обзоры автоматического мышления.

  • none

    Никаких кратких изложений мысли.

тип объекта (обязательно)

Описание отсутствует.

Всегда устанавливайте значение "deep-research" .

перечисление визуализации (строка) (необязательно)

Стоит ли включать визуализации в ответ.

Возможные значения:

  • off

    Не включайте визуализации.

  • auto

    Автоматическое добавление визуализаций.

DynamicAgentConfig

Настройка для динамических агентов.

тип объекта (обязательно)

Описание отсутствует.

Всегда устанавливайте значение "dynamic" .

среда EnvironmentConfig или строка (необязательно)

Конфигурация среды для взаимодействия. Может представлять собой объект, указывающий на удаленные источники среды, или строку, ссылающуюся на существующий идентификатор среды.

объект меток (необязательно)

Метки с заданными пользователем метаданными для запроса.

previous_interaction_id строка (необязательно)

Идентификатор предыдущего взаимодействия, если таковое имелось.

массив safety_settings (SafetySetting) (необязательно)

Настройки безопасности для взаимодействия.

Параметр безопасности, влияющий на поведение блокировки безопасности. Параметр безопасности состоит из категории вреда и порогового значения для этой категории.

Поля

метод перечисления (строка) (необязательно)

Необязательный параметр. Способ блокировки контента. Если не указан, по умолчанию используется оценка вероятности.

Возможные значения:

  • severity

    Метод блокировки вреда использует как вероятностные оценки, так и оценки тяжести последствий.

  • probability

    Метод блокировки вреда использует показатель вероятности.

пороговое значение перечисления (строка) (необязательно)

Обязательно. Пороговое значение для блокировки контента. Если вероятность причинения вреда превысит этот порог, контент будет заблокирован.

Возможные значения:

  • block_low_and_above

    Блокируйте контент с низкой или высокой вероятностью причинения вреда.

  • block_medium_and_above

    Блокируйте контент со средней или высокой вероятностью причинения вреда.

  • block_only_high

    Блокируйте контент с высокой вероятностью причинения вреда.

  • block_none

    Не блокируйте никакой контент, независимо от вероятности его нанесения вреда.

  • off

    Полностью отключите защитный фильтр.

тип HarmCategory (необязательно)

Обязательно. Категория вреда, подлежащая блокировке.

Возможные значения

  • hate_speech

    Контент, пропагандирующий насилие или разжигающий ненависть к отдельным лицам или группам на основе определенных признаков.

  • dangerous_content

    Контент, который пропагандирует, способствует или поощряет опасные действия.

  • harassment

    Оскорбительный, угрожающий контент, направленный на запугивание, мучение или высмеивание.

  • sexually_explicit