workloads from the Cloudera Hadoop platform (HDFS, Hive, Impala, Spark) to AWS Cloud. Design, develop, and optimise data ingestion, transformation, and loading processes into Amazon S3 Data Lake and Amazon Redshift. Develop and maintain SQL-based data integration, transformation, validation, and reconciliation processes. Integrate and support data services … including AWS Glue Data Catalog, Athena, Redshift Spectrum, EMR Spark Perform data migration, testing, reconciliation, and unit testing activities to ensure data integrity and successful platform migration. Create and maintain Unix/Linux shell scripts supporting ETL processing, automation, and operational activities. Work closely with architects, business analysts ...