Batch Model Pipelines with Cloud Dataflow and Apache Beam
Build scalable batch processing pipelines to run machine learning models on large datasets and write results to BigQuery using Apache Beam.
-
💬
Instrutor de IA
Pergunte sobre qualquer aula e receba uma resposta clara na hora, quando quiser. -
🕐
Comece quando quiser
Sem horários nem prazos: aprenda no seu ritmo, quando quiser. -
🌐
Em português
Aulas, tarefas e certificado: tudo totalmente no seu idioma.
Sobre este curso
As datasets grow, running machine learning models on millions of rows requires robust, distributed infrastructure. Scaling these workloads manually is complex, but using dedicated pipeline frameworks simplifies the process. In this text-only course, you will learn how to design, execute, and monitor batch processing pipelines for machine learning inference. You will start with the fundamental concepts of distributed data processing, progress to writing pipeline logic, and finish by deploying production-ready workflows that store predictions efficiently.
What you'll learn:
- Understand the core architecture of Cloud Dataflow and Apache Beam for batch processing
- Write robust pipeline transforms to ingest, preprocess, and format large-scale datasets
- Integrate machine learning models directly into pipeline steps for scalable batch inference
- Configure BigQuery destinations to store, query, and manage model predictions
- Test pipeline logic locally using modern unit testing practices and pytest
- Monitor pipeline execution, optimize resource allocation, and debug common bottlenecks
You will start with essential definitions and architecture basics before moving on to hands-on pipeline construction. The course guides you through reading and understanding local pipelines, scaling them to the cloud, and applying testing and monitoring best practices through written explanations and code examples.
This course is designed for beginner data engineers, developers, and aspiring machine learning practitioners who want to learn scalable data processing. No prior experience with Cloud Dataflow or Apache Beam is required.
Start reading today to build efficient, scalable pipelines for your machine learning workflows.
O que você vai receber
-
📜
Certificado de conclusão
Adicione ao seu perfil do LinkedIn -
💬
Tutor AI pessoal
Travou em uma aula? Pergunte ao seu tutor integrado qualquer coisa, a qualquer hora. -
🎧
Versão em áudio incluída
Estude em qualquer lugar, sem tela -
♾️
Acesso vitalício
Volte quando quiser, sem expirar -
📱
Celular ou computador
Funciona em qualquer dispositivo -
💸
Reembolso em 14 dias
Sem perguntas -
⚡
Curto e focado
2 h 36 min de conteúdo prático
Avaliações
Ainda não há avaliações — seja o primeiro a compartilhar sua experiência.
Outros também fizeram
🎓 Com certificado
Apache ZooKeeper: Coordenação Distribuída e Administração de Cluster
Certificado
Prática
₮54 000
→
⚡ Ideal para começar
🎓 Com certificado
Fundamentos de Big Data e Hadoop
Certificado
Prática
₮54 000
→
🔥 Em demanda
🎓 Com certificado
Introdução à Engenharia de Dados na Nuvem
Certificado
Prática
₮54 000
→
🔥 Em demanda
🎓 Com certificado
Azure Data Fundamentals e preparação para o exame DP-900
Certificado
Prática
₮54 000
→
Perguntas frequentes
O que preciso para fazer este curso? +
Só um celular ou computador com internet. Sem instalações nem hardware especial.
Como faço para pagar? +
Com cartão via Stripe. Não guardamos dados do cartão — o Stripe processa com segurança.
Posso pedir reembolso? +
Sim — reembolso integral em 14 dias, sem perguntas.
Por quanto tempo terei acesso? +
Para sempre. Uma vez comprado, o curso é seu para revisar quando quiser.
Vou receber um certificado? +
Sim. Ao concluir, você recebe um certificado que pode adicionar ao seu perfil do LinkedIn.
Feito para profissionais em
Tecnologia
Design
Finanças
Marketing
Saúde
Educação
Hotelaria
Indústria