Ir para o conteúdo principal
Google Cloud Documentation
Documentação
  • Começar
  • Começar a usar o Google Cloud
  • Lista de produtos
  • Cloud Customer Care
  • Produtos em destaque
  • Agent Platform
  • Gerenciamento de APIs da Apigee
  • BigQuery
  • Compute Engine
  • Cloud CDN
  • Cloud Run
  • Cloud Storage
  • Cloud SQL
  • Gemini Enterprise
  • Google Kubernetes Engine
  • Looker
  • Ferramentas de vários produtos
  • Gerenciamento de recursos e acesso
  • Gerenciamento de custos e uso
  • Infraestrutura como código
  • SDK, linguagens, frameworks e ferramentas
  • Áreas de tecnologia
  • IA e ML
  • Desenvolvimento de aplicativos
  • Hospedagem de aplicativos
  • Computação
  • Pipelines e análises de dados
  • Bancos de dados
  • Distribuído, híbrido e multicloud
  • Soluções por setor
  • Migração
  • Rede
  • Observabilidade e monitoramento
  • Segurança
  • Storage
/
Console
  • English
  • Deutsch
  • Español
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
  • Cloud Dataflow
Comece sem custos financeiros
Visão geral Guias ML do Dataflow Referência Exemplos Recursos
Google Cloud Documentation
  • Documentação
    • Mais
    • Visão geral
    • Guias
    • ML do Dataflow
    • Referência
    • Exemplos
    • Recursos
  • Console
  • Descoberta
  • Visão geral do produto
  • Casos de uso
  • Modelo de programação para o Apache Beam
  • Começar
  • Para começar com o Dataflow
  • Guias de início rápido
    • Usar o builder de jobs
    • Usar um modelo
  • Criar pipelines
  • Visão geral
  • Usar o Apache Beam
    • Visão geral
    • Instalar ou atualizar o SDK do Apache Beam
    • Criar um pipeline em Java
    • Criar um pipeline em Python
    • Criar um pipeline em Go
  • Usar a interface do builder de jobs
    • Visão geral UI interface do job builder
    • Crie um job personalizado
    • Carregar e salvar arquivos YAML de job
    • Usar o editor YAML do builder de jobs
    • Empacotar e importar transformações
    • Tutorial: criar pipelines usando o formulário do builder na interface do job builder
  • Usar modelos
    • Sobre modelos
    • Executar um modelo de amostra
    • Modelos fornecidos pelo Google
      • Todos os modelos fornecidos
      • Criar funções definidas pelo usuário para modelos
      • Usar certificados SSL com modelos
      • Criptografar parâmetros de modelo
    • Modelos Flex
      • Usar modelos Flex para empacotar um pipeline
      • Executar modelos Flex
      • Criar e executar um exemplo de modelo Flex
      • Imagens de base dos modelos flexíveis
    • Modelos clássicos
      • Criar modelos clássicos
      • Executar modelos clássicos
  • Usar notebooks
    • Começar a usar os notebooks
    • Usar recursos avançados de notebook
  • E/S do Dataflow
    • E/S gerenciada
    • Práticas recomendadas de E/S
    • Apache Iceberg
      • E/S gerenciada para Apache Iceberg
      • Ler no Apache Iceberg
      • Gravar no Apache Iceberg
      • Gravação de streaming no Apache Iceberg com o catálogo REST do Lakehouse
      • Leitura de CDC do Apache Iceberg com o catálogo REST do Lakehouse
    • Apache Kafka
      • E/S gerenciada para Apache Kafka
      • Ler do Apache Kafka
      • Gravar no Apache Kafka
      • Usar o serviço gerenciado para Apache Kafka
      • Comparativos de performance: Apache Kafka para BigQuery
      • Comparativos de performance: Apache Kafka para Iceberg
      • Replicar dados do Kafka para o Serviço gerenciado para Apache Kafka
    • BigQuery
      • E/S gerenciada para BigQuery
      • Ler pelo BigQuery
      • Gravar no BigQuery
      • Gravar dados do serviço gerenciado para Apache Kafka no BigQuery
    • Bigtable
      • Ler do Bigtable
      • Gravar no Bigtable
    • Cloud Storage
      • Ler do Cloud Storage
      • Gravar no Cloud Storage
      • Gravar dados do Serviço gerenciado para Apache Kafka no Cloud Storage
    • Bancos de dados
      • E/S gerenciada para bancos de dados
      • Ler de bancos de dados
      • Gravar em bancos de dados
    • Pub/Sub
      • Ler do Pub/Sub
      • Gravar no Pub/Sub
      • Comparativos de performance: Pub/Sub para BigQuery
  • Enriquecer dados
    • Transformação de enriquecimento
    • Usar o Apache Beam e o Bigtable para enriquecer dados
    • Usar o Apache Beam e o BigQuery para enriquecer dados
    • Usar o Apache Beam e o Vertex AI Feature Store para enriquecer dados
  • Práticas recomendadas
    • Práticas recomendadas do Dataflow
    • Práticas recomendadas para pipelines de lotes grandes
    • Práticas recomendadas do Pub/Sub para o BigQuery
  • Executar pipelines
  • Implantar canais
  • Usar o Portable Runner
  • Configurar opções de pipeline
    • Definir opções de canal
    • Referência das opções de pipeline
    • Opções de serviço do Dataflow
    • Configurar VMs de worker
    • Usar VMs do Arm
  • Gerenciar dependências do pipeline
  • Definir o modo de streaming do pipeline
  • Usar aceleradores (GPUs/TPUs)
    • GPUs
      • Visão geral da GPU
      • Compatibilidade do Dataflow com GPUs
      • Práticas recomendadas para GPU
      • Executar um pipeline com GPUs
      • Métricas da GPU
      • Usar GPUs NVIDIA L4
      • Usar o serviço de multiprocessamento NVIDIA
      • Processar imagens de satélite com GPUs
      • Resolver problemas de GPUs
    • TPUs
      • Suporte do Dataflow para TPUs
      • Executar um pipeline com TPUs
      • Guia de início rápido: como executar o Dataflow em TPUs
      • Resolver problemas de TPUs
  • Usar contêineres personalizados
    • Visão geral
    • Criar imagens de contêiner personalizadas
    • Crie imagens de contêineres com várias arquiteturas
    • Executar um job do Dataflow em um contêiner personalizado
    • Resolver problemas com contêineres personalizados
  • Regiões
  • Monitoramento
  • Visão geral
  • Painel de monitoramento do projeto
  • Personalizar o painel de monitoramento
  • Monitorar jobs
    • Lista de jobs
    • Gráficos do job
    • Informações da etapa do job
    • Sobre o detector de gargalos
    • Detalhes da execução
    • Métricas do job
    • Custo estimado
    • Recomendações
    • Escalonamento automático
    • Usar o Cloud Monitoring
    • Usar alertas prontos para uso
    • Usar o Cloud Profiler.
    • Usar o rastreamento do OpenTelemetry
  • Logging
    • Geração de registros de auditoria para o Dataflow
    • Geração de registros de auditoria para pipelines de dados
    • Trabalhar com registros do pipeline
    • Controlar a ingestão de registro
    • Dados de amostra do pipeline
  • Ver linhagem de dados
  • Otimizar
  • Usar o Streaming Engine para jobs de streaming
  • Dataflow Shuffle para jobs em lote
  • Usar escalonamento e reequilíbrio automáticos
    • Escalonamento automático horizontal
    • Ajustar o escalonamento automático horizontal de streaming
    • Escala dinâmica de linhas de execução
    • Ajuste direito
    • Entender o rebalanceamento de trabalho dinâmico
    • Use o Dataflow Prime
      • Sobre o Dataflow Prime
      • Escalonamento automático vertical
  • Usar o Insights do Dataflow
  • Usar a programação flexível de recursos
  • Usar reservas do Compute Engine
  • Otimize os custos
  • Gerenciar
  • Atualizações do pipeline
    • Guia de upgrade
    • Atualizar um pipeline de streaming
  • Interromper um pipeline em execução
  • Pausar um job
  • Solicitar cotas
  • Migrar jobs entre projetos
  • Usar snapshots do Dataflow
  • Trabalhar com pipelines de dados
  • Usar o Eventarc para gerenciar jobs do Dataflow
  • Controle o acesso
  • Authentication
  • Papéis e permissões do Dataflow
  • Segurança e permissões
  • Especificar uma rede
  • Configurar regras de firewall e acesso à Internet
  • Usar chaves de criptografia gerenciadas pelo cliente
  • Usar restrições personalizadas
  • Guia de desenvolvimento do Dataflow
  • Planejar pipelines de dados
  • Ciclo de vida do pipeline
  • Desenvolver e testar pipelines
  • Projetar fluxos de trabalho de pipelines
  • Representação de dados em pipelines de streaming
  • Processamento único
  • Exemplo de cargas de trabalho do Dataflow
  • Aprendizado de máquina
    • Tutoriais do Python ML
    • Executar um LLM em um pipeline de streaming
  • Comércio eletrônico
    • Criar um pipeline de streaming de e-commerce
    • Padrões de tarefas do Java
  • Fazer streaming do Apache Kafka para o BigQuery
  • Fazer streaming do Pub/Sub para o BigQuery
  • Importar dados de catálogos externos do Iceberg para o Lakehouse sem fronteiras
  • Importar arquivos Parquet do armazenamento para o Lakehouse sem bordas
  • Importar tabelas do Delta Lake para o Lakehouse sem fronteiras
  • Cargas de trabalho com alto paralelismo de HPC