Senior Data Scientist
CurrentDeveloped Spark code in Scala and Spark-SQL/Streaming for faster data processing. Created Automation Regressing Scripts in Python to validate ETL processes across multiple databases including AWS Redshift, Oracle, MongoDB, T-SQL, and SQL Server. Worked in AWS environment for development and deployment of custom Hadoop applications. Utilized Python for developing Spark programs, applying functional programming principles to process complex structured datasets. Managed code control using… Show more Developed Spark code in Scala and Spark-SQL/Streaming for faster data processing. Created Automation Regressing Scripts in Python to validate ETL processes across multiple databases including AWS Redshift, Oracle, MongoDB, T-SQL, and SQL Server. Worked in AWS environment for development and deployment of custom Hadoop applications. Utilized Python for developing Spark programs, applying functional programming principles to process complex structured datasets. Managed code control using Git-Bucket and utilized AWS CDK Components like Airflow, Elastic Map Reduce (EMR), and Snowflake.Processed location and segments data from S3 to Snowflake using tasks, streams, pipes, and stored procedures. Show less