DP-203: engenharia de dados Azure, percurso histórico
DP-203 histórico: seis aulas, 40 perguntas e seis casos sobre pipelines Azure, Data Lake, streams, segurança, monitorização e recuperação.
Objetivos e percurso
Percurso histórico independente baseado nos objetivos DP-203 de 24-10-2024, com seis aulas, 40 perguntas e seis casos PT-PT/EN. O exame e a certificação foram retirados em 31-03-2025. Os exemplos originais ligam armazenamento, processamento batch e streaming, autorização, monitorização e otimização ao trabalho de APS e gestão técnica. A documentação técnica foi consultada em outubro de 2026; atualizações posteriores são distinguidas do programa arquivado. A avaliação interna reutiliza 30 decisões em 60 minutos, sem atribuir certificação externa. Não representa preparação automaticamente equivalente a outro exame.
Para quem: Engenheiros de dados Azure, equipas APS, suporte L3 e gestores de projetos de dados.
Pré-requisitos: Fundamentos Azure, SQL, operações com ficheiros e noções de Python. Casos fictícios sem necessidade de recursos cloud reais.
300 minutos de estudo estimados
- Escolhe a disposição dos dados pelo padrão de consulta e pela distribuição real.
- Define a unidade de repetição e o momento em que uma carga está realmente concluída.
- Separa progresso do consumidor, tratamento de atrasos e unicidade dos efeitos.
- Valida a identidade de execução e cada fronteira de autorização e rede.
- Relaciona estados técnicos com frescura, completude e resultados esperados.
- Melhora desempenho sem perder correção ou capacidade de recuperação.
Módulos
- Armazenamento, distribuição e exploração
- Cargas incrementais e recuperação
- Streams, tempo e efeitos externos
- Acesso ao lake e gestão de segredos
- Monitorização e aceitação do produto de dados
- Otimização, custo e retenção
Continua a aprender
Referências e versão
DP-203 objectives 2024-10-24; retired 2025-03-31
- Azure Data Engineer retirement · 2026-10-01
- DP-203 archived objectives October 24 2024 · 2026-10-01
- Incremental loading and change tracking · 2026-10-01
- Integration runtime network and execution boundaries · 2026-10-01
- Copy fault tolerance and skipped records · 2026-10-01
- Stateful tumbling window triggers · 2026-10-01
- Serverless SQL storage layout and query efficiency · 2026-10-01
- File and folder metadata in serverless SQL · 2026-10-01
- Dedicated SQL distribution and skew · 2026-10-01
- Data Lake RBAC ABAC and ACL evaluation · 2026-10-01
- Structured Streaming foreachBatch delivery · 2026-10-01
- Structured Streaming watermarks and state · 2026-10-01
- Delta merge ambiguity and runtime differences · 2026-10-01
- Event Hubs partitions consumer groups and checkpoints · 2026-10-01
- Data Lake traversal and default ACLs · 2026-10-01
- Data Factory run monitoring · 2026-10-01
- Pipeline execution and trigger types · 2026-10-01
- Dedicated SQL statistics maintenance · 2026-10-01
- Delta data file retention and vacuum · 2026-10-01
- Data Factory lineage integration limitations · 2026-10-01
- Stream Analytics time handling · 2026-10-01
- Conditional paths and pipeline outcome · 2026-10-01
- Copy activity metrics and bottlenecks · 2026-10-01
- Storage private endpoints and DNS · 2026-10-01
- Data Factory Key Vault credential references · 2026-10-01
- Delta compaction and data layout · 2026-10-01
- Synapse Spark performance diagnosis · 2026-10-01
- Stream Analytics processing and delivery guarantees · 2026-10-01
- Mapping data flow schema drift · 2026-10-01
O que vais explorar
0 / 6Armazenamento, distribuição e exploração
Escolhe a disposição dos dados pelo padrão de consulta e pela distribuição real.
Cargas incrementais e recuperação
Define a unidade de repetição e o momento em que uma carga está realmente concluída.
Streams, tempo e efeitos externos
Separa progresso do consumidor, tratamento de atrasos e unicidade dos efeitos.
Acesso ao lake e gestão de segredos
Valida a identidade de execução e cada fronteira de autorização e rede.
Monitorização e aceitação do produto de dados
Relaciona estados técnicos com frescura, completude e resultados esperados.
Otimização, custo e retenção
Melhora desempenho sem perder correção ou capacidade de recuperação.