Senior Data Engineer
CurrentResults-driven Data Engineer with expertise in designing, optimizing, and maintaining ETL processes using Informatica PowerCenter, AWS Glue, SSIS, and Talend. Proficient in data modeling, performance tuning, and large-scale data processing using Amazon EMR, Apache Spark, and MapReduce. Demonstrated success in data analysis and machine learning with Python and R, achieving 70% accuracy in predictive monitoring and creating models for successful match assessments. Skilled in implementing CI/CD pipelines with Kubernetes, Docker, and GitHub for robust development environments, and using Terraform for scalable infrastructure management. Strong collaborator with cross-functional teams, delivering data solutions across diverse environments like Hadoop, HDFS, and AWS S3, and leveraging real-time data streams from Kafka.