$ cat resume.md
Data Infrastructure Engineer
employment
- Led migration from GitLab to GitHub across 10+ repositories, including automated conversion of 10,000+ merge requests to pull requests using custom scripts, achieving zero downtime despite API rate limits
- Established observability for ~100 Airflow DAGs by implementing Datadog log ingestion, creating monitoring dashboards, and integrating Slack-based failure alerts
- Designed and implemented multi-tenant data architecture supporting 25 to 50 TB across 300+ tables, enabling secure onboarding of new tenants while maintaining strict data isolation
- Introduced infrastructure-as-code using Terraform (OpenTofu) across 8+ environments (prod, staging, tenant-specific), standardizing deployments and enabling scalable environment provisioning
- Developed infrastructure for an LLM-powered internal cloud agent (4,000+ daily Slack invocations), improving issue triage speed and enforcing data security via deterministic credential filtering and compliance-aligned SLAs
- Owned and scaled batch and real-time data pipelines processing multiple terabytes of data daily and high-throughput event streams using AWS Kinesis, Kafka, Flink, Glue, and EMR
- Designed low-latency streaming architectures enabling near real-time data availability for AI, billing, risk, and compliance systems
- Reduced AWS costs by 20%+ through compute optimization, partitioning strategies, and storage tuning across large-scale data workloads
- Implemented data quality frameworks (e.g., Great Expectations) and monitoring systems, strengthening SLAs and improving data reliability across critical pipelines
- Built secure cross-account data access patterns using IAM roles, enabling compliant data sharing across internal teams and external partners
- Built and deployed full-stack features using Kotlin, REST APIs, Kubernetes, and React, improving system performance and user experience
- Developed and productionized ML data pipelines, reducing hiring costs by 30%, improving model accuracy by 10%, and cutting training and data extraction time by 40%+
education
Minor in Business Administration
skills
Python
SQL
Apache Spark
Terraform
Docker
Airflow
Apache Kafka
Kinesis
Firehose
Glue
EMR
AWS
GCP
Datadog
Oracle
Microsoft SQL Server
PostgreSQL
DynamoDB