가상 이력서 예시입니다. 이름·재직 이력·성과는 설명을 위해 만든 내용이며 실제 직원의 기록이 아닙니다.
황현지
SLO·에러 버짓·장애 대응·복구 가능한 인프라 지도 실습 경험을 갖춘 사이트 신뢰성 엔지니어 인턴. 주요 수행 분야: Kubernetes · Terraform · Prometheus · SLO
경력
쿠팡
대한민국 서울
사이트 신뢰성 엔지니어 인턴
2026년 6월 - 2026년 8월
- 지도 아래 추적 로그·배포 이벤트·SLO 알림으로 장애 타임라인 재구성; 원인이 된 의존 서비스 장애를 복구 훈련에 반영하고 실제 복구 시간 측정
- 결제 API의 가용성·지연 시간 SLO를 정의하고 Prometheus에 다중 구간 에러 버짓 소진 알림을 구현. 조사 자료 준비와 검증·문서화를 지원하고, 맡은 작업을 멘토에게 검토받음. 단순 임계치 알림을 고객에게 영향을 주는 장애 중심 호출로 바꿨음
- 트래픽을 전환하기 전에 데이터베이스 복구 시점과 롤백 기준을 확인하며 Kubernetes 서비스의 리전 장애 전환을 훈련. 조사 자료 준비와 검증·문서화를 지원하고, 맡은 작업을 멘토에게 검토받음. 복구 절차서에 빠져 있던 서비스 의존성을 발견
- 지도 아래 Prometheus 알림·Grafana 추적을 활용한 온콜 복구 훈련 책임; Kubernetes 의존성 장애 해결 및 합의한 SLO 시간 내 원복 완료
- 지도 아래 Linux 로그·Terraform 상태를 활용한 Python 디버깅 검사 구축; 장애 분류 32분에서 14분으로 단축 및 시험한 CI/CD 복구 안내 배포
주요 프로젝트
사이트 신뢰성 엔지니어 실무 사례 연구
인턴 프로젝트 참여자
2025년 9월 - 2026년 5월
- 멘토의 검토를 받는 모의 실습에서 Grafana 에러 버짓 소진 대시보드와 온콜(on-call) 절차서로 Kubernetes 서비스의 관측성(observability)을 구축. 호출마다 단순 CPU 임계치 대신 SLO와 검증된 완화 조치를 연결
- 후속 지도 실습에서 리뷰된 Terraform 계획으로 Linux 노드 교체를 훈련하며 워크로드 배출·스토리지 마운트·복구 시간을 확인. 기존 복구 절차에 빠져 있던 마운트 의존성을 기록
- 지도 아래 수동 운영 변경을 리뷰된 Terraform 계획·드리프트 검사·단계별 배포 게이트로 전환. 조사 자료 준비와 검증·문서화를 지원하고, 맡은 작업을 멘토에게 검토받음
- 정상·잘못된 입력·중단 상황의 독립 테스트 데이터 구성; 구현 실행 전에 기대 응답을 기록해 결함과 가정 변경 구분
- 재현 절차·설정·회귀 테스트를 프로젝트에 포함; 초기화 환경에서 실행 안내를 검증하고 운영 준비 완료 주장 대신 미지원 사례 명시
- 독립 입력을 활용한 개인 회귀 테스트 구성 책임; 경계 사례 오류 해결 및 기대 출력이 포함된 재현 시험 자료 배포
학력
숭실대학교
서울 · 대한민국
컴퓨터학부 공학사 · 재학 중
2023년 3월 - 2027년 2월
관련 과목: 알고리즘, 운영체제, 데이터베이스, 컴퓨터 네트워크
핵심 역량
직무 전문성
Kubernetes · Terraform · Prometheus · SLO · 장애 대응
자격증
AWS Certified Solutions Architect – Associate
Amazon Web Services
2025년 12월

