$ cat resume.md

James Kang

↓ download pdf

Data Infrastructure Engineer

(541) 221-6780 jameskang2357@gmail.com github linkedin

employment

Data Infrastructure Engineer
Valon
Feb 2026 - Present
  • Led migration from GitLab to GitHub across 10+ repositories, including automated conversion of 10,000+ merge requests to pull requests using custom scripts, achieving zero downtime despite API rate limits
  • Established observability for ~100 Airflow DAGs by implementing Datadog log ingestion, creating monitoring dashboards, and integrating Slack-based failure alerts
  • Designed and implemented multi-tenant data architecture supporting 25 to 50 TB across 300+ tables, enabling secure onboarding of new tenants while maintaining strict data isolation
  • Introduced infrastructure-as-code using Terraform (OpenTofu) across 8+ environments (prod, staging, tenant-specific), standardizing deployments and enabling scalable environment provisioning
  • Developed infrastructure for an LLM-powered internal cloud agent (4,000+ daily Slack invocations), improving issue triage speed and enforcing data security via deterministic credential filtering and compliance-aligned SLAs
Data Engineer
BILL
Feb 2022 - Dec 2025
  • Owned and scaled batch and real-time data pipelines processing multiple terabytes of data daily and high-throughput event streams using AWS Kinesis, Kafka, Flink, Glue, and EMR
  • Designed low-latency streaming architectures enabling near real-time data availability for AI, billing, risk, and compliance systems
  • Reduced AWS costs by 20%+ through compute optimization, partitioning strategies, and storage tuning across large-scale data workloads
  • Implemented data quality frameworks (e.g., Great Expectations) and monitoring systems, strengthening SLAs and improving data reliability across critical pipelines
  • Built secure cross-account data access patterns using IAM roles, enabling compliant data sharing across internal teams and external partners
Software Developer
Avant
Nov 2020 - Feb 2022
  • Built and deployed full-stack features using Kotlin, REST APIs, Kubernetes, and React, improving system performance and user experience
  • Developed and productionized ML data pipelines, reducing hiring costs by 30%, improving model accuracy by 10%, and cutting training and data extraction time by 40%+

education

B.S. in Computer Science
University of Oregon · Eugene, OR
2020
Minor in Business Administration

skills

Python SQL Apache Spark Terraform Docker Airflow Apache Kafka Kinesis Firehose Glue EMR AWS GCP Datadog Oracle Microsoft SQL Server PostgreSQL DynamoDB