The Role: Builds performant data processing pipelines, manages relational databases, and constructs cloud-portable data lake environments using modern open storage formats and embedded analytical engines. Responsibilities: Pipeline Design: Construct resilient data processing pipelines in Python usin