Ir para o conteúdo principal
Google Cloud Documentation
Documentação
  • Começar
  • Começar a usar o Google Cloud
  • Lista de produtos
  • Cloud Customer Care
  • Produtos em destaque
  • Agent Platform
  • Gerenciamento de APIs da Apigee
  • BigQuery
  • Compute Engine
  • Cloud CDN
  • Cloud Run
  • Cloud Storage
  • Cloud SQL
  • Gemini Enterprise
  • Google Kubernetes Engine
  • Looker
  • Ferramentas de vários produtos
  • Gerenciamento de recursos e acesso
  • Gerenciamento de custos e uso
  • Infraestrutura como código
  • SDK, linguagens, frameworks e ferramentas
  • Áreas de tecnologia
  • IA e ML
  • Desenvolvimento de aplicativos
  • Hospedagem de aplicativos
  • Computação
  • Pipelines e análises de dados
  • Bancos de dados
  • Distribuído, híbrido e multicloud
  • Soluções por setor
  • Migração
  • Rede
  • Observabilidade e monitoramento
  • Segurança
  • Storage
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
  • Gemini Enterprise Agent Platform
Comece sem custos financeiros
Visão geral Studio Agentes Modelos Notebooks
  • Agent Platform
  • IA generativa
Blog de desenvolvedores
Google Cloud Documentation
  • Documentação
    • Mais
    • Visão geral
    • Studio
    • Agentes
    • Modelos
    • Notebooks
    • Preço
      • Mais
    • Blog de desenvolvedores
  • Console
  • Visão geral
  • Guia para iniciantes
  • Começar
  • Introdução à Agent Platform
  • Desenvolver código da API Gemini com o SDK da IA generativa
  • Conectar-se ao servidor MCP do Knowledge
  • consiga uma chave de API
  • Configurar as credenciais padrão do aplicativo
  • Migrar do Google AI Studio para a Agent Platform
  • Comece a usar o Gemini 3
  • Guias para desenvolvedores de modelos do Gemini
    • Gemini 3.8 Flash
    • Gemini 3.7 Flash
    • Gemini 3.6 Flash
    • Gemini 3.5 Flash
  • Bibliotecas de IA generativa do Google
  • Livro de receitas de IA generativa
  • Acessar modelos do Gemini usando bibliotecas da OpenAI
  • Modo expresso
    • Visão geral
    • Tutorial do console
    • Tutorial da API
  • Selecionar modelos
    • Model Garden
    • Visão geral do Model Garden
    • Usar modelos no Model Garden
    • Testar recursos do modelo
    • Modelos do Google
    • Todos os modelos do Google
    • Gemini
      • Migrar para os modelos mais recentes do Gemini
      • Pro
      • 3.1 Pro
      • 3 Pro Image
      • 2.5 Pro
      • Flash
      • 3.8 Flash
      • 3.7 Flash
      • 3.6 Flash
      • 3.5 Flash
      • 3.1 Imagem em Flash
      • 3 Flash
      • 2.5 Flash
      • Imagem do 2.5 Flash
      • 2.5 Flash Live API
      • Flash Lite
      • 3.5 Flash Lite
      • 3.1 Flash-Lite Image
      • 3.1 Flash-Lite
      • 2.5 Flash-Lite
      • Omni
      • Omni 1.1 Flash
      • Omni Flash
      • Cyber
      • 3.8 Flash Cyber
      • Transcrever
      • Gemini 3.5 Transcribe
      • Traduzir
      • Gemini 3.5 Live Translate
      • Incorporação
      • Embedding do Gemini 2
      • Robótica
      • Gemini Robotics ER 2
        • Visão geral
        • Raciocínio espacial
        • Recursos agênticos
        • Orquestração de tarefas
        • Compreensão do vídeo
    • Veo
      • Veo 3
      • Veo 3.1
    • Lyria
      • Lyria 2
      • Lyria 3
    • Simulador virtual
    • Versões do modelo
    • Modelos de parceiros
    • Visão geral dos modelos de parceiros
    • Claude
      • Visão geral
      • Solicitar previsões
      • Cotas para modelos Claude da Anthropic
      • Previsões em lote
      • Respostas estruturadas
      • Armazenamento em cache de comandos
      • Contar tokens
      • Pesquisa na web
      • Classificadores de segurança
      • Programa de verificação cibernética
      • Detalhes do modelo
      • Claude Opus 5.5
      • Claude Fable 5.1
      • Claude Opus 5
      • Claude Sonnet 5
      • Claude Fable 5
      • Claude Opus 4.8
      • Claude Opus 4.7
      • Claude Sonnet 4.6
      • Claude Opus 4.6
      • Claude Opus 4.5
      • Claude Sonnet 4.5
      • Claude Opus 4.1
      • Claude Haiku 4.5
      • Claude Opus 4
      • Claude Sonnet 4
    • Grok
      • Visão geral
      • API Responses
      • Chamadas de função
      • Saída estruturada
      • Raciocínio
      • Detalhes do modelo
      • Grok 4.1 Fast
      • Grok 4.20
      • Grok 4.3
      • Grok 4.6
    • Mistral AI
      • Visão geral
      • Detalhes do modelo
      • Mistral Medium 3
      • OCR do Mistral (25/05)
      • Mistral Small 3.1 (25/03)
      • Codestral 2
    • Implantar modelos de parceiros do Model Garden
    • Descontinuações de modelos de parceiros
    • Modelos abertos
    • Visão geral
    • AlphaFold 3
    • AlphaGenome
    • DeepSeek
      • Visão geral
      • DeepSeek-V3.2
      • DeepSeek-V3.1
      • DeepSeek-R1-0528
      • DeepSeek-OCR
    • Incorporação (e5)
      • E5 Small multilíngue
      • Multilíngue E5 Large
    • Gemma do Google
      • Modelo como serviço (MaaS)
      • Gemma-4-26B-A4B-IT MaaS
      • Usar o Gemma
      • Tutorial: implantar e inferir o Gemma (GPU)
      • Tutorial: implantar e fazer inferência com a Gemma (TPU)
    • Kimi
      • Visão geral
      • Kimi K2 Thinking
    • Llama
      • Visão geral
      • Solicitar previsões
      • Detalhes do modelo
      • Llama 4 Maverick
      • Llama 4 Scout
      • Llama 3.3
    • MiniMax
      • Visão geral
      • MiniMax M2
    • OpenAI
      • Visão geral
      • OpenAI gpt-oss-120b
      • OpenAI gpt-oss-20b
    • Qwen
      • Visão geral
      • Qwen 3 Next Instruct 80B
      • Qwen 3 Next Thinking 80B
      • Qwen 3 Coder
      • Qwen 3 235B
    • ZAI.org
      • Visão geral
      • GLM 5.2
      • GLM 5
      • GLM 4.7
    • Modelos abertos gerenciados (MaaS)
      • Visão geral
      • Usar modelos abertos via Model as a Service (MaaS)
      • Conceder acesso a modelos abertos
      • API
      • Chamar APIs do MaaS para modelos abertos
      • Chamadas de função
      • Pensando
      • Saída estruturada
      • Previsão em lote
      • Descontinuações de modelos abertos
    • Modelos abertos autoimplantados
      • Visão geral
      • Implantar modelos abertos
        • Implantar modelos abertos do Model Garden
        • Implantar modelos abertos com contêineres pré-criados
        • Implantar modelos abertos com um contêiner vLLM personalizado
        • Implantar modelos com pesos personalizados
      • Usar modelos do Hugging Face
      • Tutoriais
        • Otimizar o desempenho do modelo com recursos avançados no Model Garden
        • Hex-LLM
        • Guia completo do vLLM para disponibilização de LLMs de texto e multimodais (GPU)
        • TPU vLLM
        • xDiT
        • Implantar modelos Llamma 3 com SpotVM e reservas
  • Build
    • Design de comandos
    • Introdução à criação de comandos
    • Estratégias de comando
      • Visão geral
      • Dê instruções claras e específicas
      • Usar as instruções de sistema
      • Incluir exemplos de few-shot
      • Adicionar informações contextuais
      • Estruturar comandos
      • Comparar comandos
      • Instruir o modelo a explicar o raciocínio
      • Divida tarefas complexas
      • Teste os valores de parâmetro
      • Estratégias de iteração de prompt
    • Orientação de comandos específicos para tarefas
      • Criar comandos multimodais
      • Criar prompts de chat
    • Recursos
    • Segurança
      • Visão geral
      • IA responsável
      • Instruções do sistema para segurança
      • Configurar filtros de conteúdo
      • Gemini para filtragem de segurança e moderação de conteúdo
      • Monitoramento de abuso
      • Processar respostas bloqueadas
      • Credenciais de conteúdo
      • API AI Content Detection
    • Geração de textos e códigos
      • Geração de texto
      • Instruções do sistema
      • Saída estruturada
      • Parâmetros de geração de conteúdo
    • Geração de imagens
      • Gerar imagens com o Gemini
      • Gerar imagens de vídeos com o Gemini
      • Edite imagens com o Gemini
      • Práticas recomendadas para geração de imagens no Gemini
      • Gerar imagens de simulador virtual
      • Limitações da geração de imagens do Gemini
      • IA responsável e uso da geração de imagens do Gemini
      • Documentação do Imagen
    • Geração de vídeo
      • Visão geral
      • Texto para vídeo
      • Primeira imagem do frame para vídeo
      • Primeiro e último frames para vídeo
      • Gerar vídeos com base em referências
      • Estender vídeos
      • Editar vídeos
      • Guia de comandos
      • Práticas recomendadas para vídeo
      • IA responsável para o Veo
    • Geração de música
      • Introdução ao Lyria
      • Gerar músicas usando o Lyria
      • Guia de comandos do Lyria
    • Análise de mídia
      • Compreensão de imagens
      • Compreensão do vídeo
      • Compreensão de áudio
      • Entendimento de documentos
      • Detecção de caixa delimitadora
    • Contexto do URL
    • Pensando
      • Visão geral
      • Assinaturas de raciocínio
      • Guia de comandos
    • API em tempo real
      • Visão geral
      • Começar
        • Começar a usar o SDK da IA generativa
        • Começar a usar WebSockets
        • Começar a usar o ADK
      • Iniciar e gerenciar sessões ao vivo
      • Enviar streams de áudio e vídeo
      • Configurar idioma e voz
      • Configurar recursos do Gemini
      • Chamada de função assíncrona
      • Práticas recomendadas com a API Live
      • Solução de problemas da API Live
      • Apps e recursos de demonstração
    • Embeddings
      • Visão geral
      • Embeddings de texto
        • Acessar incorporações de texto
        • Escolher um tipo de tarefa de embeddings
      • Acessar embeddings multimodais
      • Receber inferências de embeddings em lote
    • Tradução
    • Gerar fala com base em texto
    • Transcrever fala
    • Ferramentas de modelo
    • Execução de código
    • Uso do computador
    • Chamadas de função
    • Embasamento
      • Visão geral
      • Embasamento com a Pesquisa Google
      • Embasamento com o Google Maps
      • Embasamento com a Pesquisa do agente
      • Embasamento com sua API Search
      • Embasar respostas usando RAG
      • Embasamento com o Elasticsearch
      • Embasamento com a Pesquisa Google Paralela na Web
      • Embasamento com a pesquisa na Web da Exa
      • Embasamento na Web para empresas
    • Ferramentas para Desenvolvedores
    • Usar recursos de escrita com tecnologia de IA para comandos
      • Visão geral
      • Otimizar comandos
        • Visão geral
        • Otimizador zero-shot
        • Otimizador few-shot
        • Otimizador orientado por dados
      • Usar modelos de comando
    • Ajuste de modelos
    • Introdução aos ajustes
    • Ajuste de modelos do Gemini
      • Ajuste supervisionado
        • Sobre o ajuste fino supervisionado
        • Preparar os dados
        • Usar o ajuste fino supervisionado
        • Modalidades aceitas
          • Ajuste de texto
          • Ajuste de documentos
          • Ajuste de imagem
          • Ajuste de áudio
          • Ajuste de vídeo
          • Ajustar a chamada de função
      • Ajuste do aprendizado por reforço
        • Sobre o ajuste do aprendizado por reforço
        • Guia de início rápido sobre o uso do console
        • Guia de início rápido sobre como usar a API
        • Job de ajuste do aprendizado por reforço
          • Visão geral
          • Conjunto de dados de ajuste
          • Hiperparâmetros
          • Funções de recompensa
          • Métricas e monitoramento
        • Ajuste contínuo
      • Ajuste de preferências
        • Sobre o ajuste de preferências
        • Preparar os dados
        • Usar o ajuste de preferências
      • Usar checkpoints de ajuste
      • Usar o ajuste contínuo
      • Recomendações de ajuste com a LoRA e a QLoRA
    • Modelos abertos
      • Ajuste supervisionado e de destilação
    • Modelos de embeddings
      • Ajustar modelos de incorporações de texto
    • Modelos de tradução
      • Sobre o ajuste fino supervisionado
      • Preparar os dados
      • Usar o ajuste fino supervisionado
    • Migrar
    • Chamar modelos da Agent Platform usando bibliotecas da OpenAI
      • Visão geral
      • Autenticar
      • Exemplos
      • Migrar do SDK da OpenAI
  • Avaliar
    • Visão geral
    • Tutorial: realizar a avaliação usando o console
    • Realizar a avaliação usando o cliente de IA generativa no SDK do Agent Platform
      • Tutorial: avaliar modelos usando o cliente de IA generativa no SDK da Agent Platform
      • Definir as métricas de avaliação
        • Definir as métricas de avaliação
        • Detalhes das métricas gerenciadas com base em rubricas
      • Preparar o conjunto de dados de avaliação
      • Execute uma avaliação.
      • Conferir e interpretar os resultados da avaliação
      • Avaliar agentes
    • Métodos de avaliação alternativos
    • Avaliar usando o módulo de avaliação no SDK da Agent Platform
      • Tutorial: realizar uma avaliação usando o módulo de avaliação no SDK da Agent Platform
      • Definir as métricas de avaliação
      • Preparar o conjunto de dados de avaliação
      • Execute uma avaliação.
      • Interpretar os resultados da avaliação
      • Modelos para métricas baseadas em modelo
      • Avaliar agentes
      • Avaliar um modelo de avaliação
      • Configurar um modelo de avaliação
    • Executar o pipeline AutoSxS
    • Executar um pipeline de avaliação baseado em computação
  • Implantar
    • Visão geral das opções de consumo
    • Capacidade de processamento provisionada
      • Visão geral da capacidade de processamento provisionada
      • Modelos compatíveis
      • Calcular os requisitos de capacidade de processamento provisionada
      • Capacidade de processamento provisionada para a API Live
      • Capacidade de processamento provisionada para modelos do Gemini 3 (Nano Banana)
      • Capacidade de processamento provisionada para modelos do Gemini Omni
      • Capacidade de processamento provisionada para modelos Veo 3
      • Capacidade de processamento provisionada de zona única
      • Comprar capacidade de processamento provisionada
      • Usar a capacidade de processamento provisionada
    • PayGo
      • PayGo padrão
      • Prioridade PayGo
      • Flex PayGo
    • Inferência em lote
      • Visão geral
      • Criar um job em lote no Cloud Storage
      • Criar um job em lote no BigQuery
      • Retomar um job em lote incompleto
    • Cotas e limites do sistema
    • Armazenar em cache o contexto do comando reutilizado
      • Visão geral
      • Criar um cache de contexto
      • Usar um cache de contexto
      • Receber informações do cache de contexto
      • Atualizar um cache de contexto
      • Excluir um cache de contexto
      • Cache de contexto para modelos do Gemini ajustados
    • Implantar modelos de IA generativa
    • Como solucionar problemas do código de erro 429
    • Repetir estratégia
  • Administrar
    • Controle de acesso
    • Rede
    • Controles de segurança
    • Controlar o acesso aos modelos do Model Garden
    • Ativar registros de auditoria de acesso a dados
    • Salvar e compartilhar comandos
    • Monitorar modelos
    • Monitorar custos usando rótulos de metadados personalizados
    • Geração de registros de solicitação/resposta
    • Proteger um app de IA generativa usando o IAP
      • Visão geral
      • Configure seu projeto e o repositório de origem.
      • Criar um serviço do Cloud Run
      • Criar um balanceador de carga
      • Configurar o IAP
      • Teste o app protegido por IAP.
      • Limpar o projeto
  • Criar seu próprio modelo
    • Visão geral
    • MLOps na Agent Platform
    • Interfaces da Agent Platform
    • Guias para iniciantes da Agent Platform
      • Treinar um modelo do AutoML
      • Treinar um modelo personalizado
      • Receber inferências de um modelo personalizado
      • Treinar um modelo usando a Agent Platform e o SDK do Python
        • Introdução
        • Pré-requisitos
        • Criar um notebook
        • Criar conjunto de dados
        • Criar um script de treinamento
        • Treinar um modelo
        • Fazer uma inferência
    • Frameworks de ML integrados
      • PyTorch
      • TensorFlow
    • Agent Platform para usuários do BigQuery
    • Glossário
    • Começar
    • Configurar um projeto e um ambiente de desenvolvimento
    • Instalar o SDK da Agent Platform para Python
    • Autenticar na Agent Platform
    • Escolha um método de treinamento
    • Teste um tutorial
      • Visão geral dos tutoriais
      • Tutoriais do AutoML
        • Dados de imagem do Hello
          • Visão geral
          • Configurar o projeto e o ambiente
          • Criar um conjunto de dados e importar imagens
          • Treinar um modelo de classificação de imagens do AutoML
          • Avaliar e analisar o desempenho do modelo
          • Implantar um modelo em um endpoint e fazer uma inferência
          • Limpar o projeto
        • Dados tabulares do Hello
          • Visão geral
          • Configurar o projeto e o ambiente
          • Criar um conjunto de dados e treinar um modelo de classificação do AutoML
          • Implantar um modelo e solicitar uma inferência
          • Limpar o projeto
      • Tutoriais de treinamento personalizados
        • Treinar um modelo tabular personalizado