가상 이력서 예시입니다. 이름·재직 이력·성과는 설명을 위해 만든 내용이며 실제 직원의 기록이 아닙니다.
신나영
SLO·에러 버짓·장애 대응·복구 가능한 인프라 업무를 담당한 시니어 사이트 신뢰성 엔지니어. 주요 수행 분야: Kubernetes · Terraform · Prometheus · SLO
경력
쿠팡
대한민국 서울
시니어 사이트 신뢰성 엔지니어
2021년 1월 - 현재
- 업무 리드로서 Grafana 에러 버짓 소진 대시보드와 온콜(on-call) 절차서로 Kubernetes 서비스의 관측성(observability)을 구축. 호출마다 단순 CPU 임계치 대신 SLO와 검증된 완화 조치를 연결
- 검토 기준을 책임지고 리뷰된 Terraform 계획으로 Linux 노드 교체를 훈련하며 워크로드 배출·스토리지 마운트·복구 시간을 확인. 기존 복구 절차에 빠져 있던 마운트 의존성을 기록
- 업무 리드로서 고객 요청 경로의 Go 탐침과 복구 자료를 확인하는 Python 점검을 구축. 장애 전환 훈련에서 프로세스는 정상이지만 데이터가 불완전한 상황을 탐지해 절차서를 개선하고 재훈련으로 복구 검증을 완료
- 추적 로그·배포 이벤트·SLO 알림으로 장애 타임라인 재구성; 원인이 된 의존 서비스 장애를 복구 훈련에 반영하고 실제 복구 시간 측정
- Prometheus 알림·Grafana 추적을 활용한 온콜 복구 훈련 책임; Kubernetes 의존성 장애 해결 및 합의한 SLO 시간 내 원복 완료
- Linux 로그·Terraform 상태를 활용한 Python 디버깅 검사 구축; 장애 분류 32분에서 14분으로 단축 및 시험한 CI/CD 복구 안내 배포
네이버
성남 · 대한민국
사이트 신뢰성 엔지니어
2016년 3월 - 2020년 12월
- 요청 트레이스와 시간대별 타임라인으로 장애 대응을 리뷰하고 재시도 제한·큐 역압력 개선 담당자 지정. 관련 팀의 판단 기준과 담당 범위도 조율. 절차서 수정에 그치지 않고 재현 테스트로 동일 실패 경로를 차단
- 기존 인터페이스 계약에 맞춰 변경안을 리뷰하고 검토자가 지적한 예외 재현; 병합 전에 누락 테스트·사용 예제 추가
- 연동 팀이 전달한 버전·입력값으로 오류 조사; 최소 재현 테스트와 호환성 안내를 포함한 수정본을 전달하고 최초 신고 사례의 통과를 확인한 뒤 종료
주요 프로젝트
사이트 신뢰성 엔지니어 실무 사례 연구
협업 프로젝트 리드
2023년 3월 - 2023년 7월
- 수동 운영 변경을 리뷰된 Terraform 계획·드리프트 검사·단계별 배포 게이트로 전환. 관련 팀의 판단 기준과 담당 범위도 조율
- 정상·잘못된 입력·중단 상황의 독립 테스트 데이터 구성; 구현 실행 전에 기대 응답을 기록해 결함과 가정 변경 구분
- 재현 절차·설정·회귀 테스트를 프로젝트에 포함; 초기화 환경에서 실행 안내를 검증하고 운영 준비 완료 주장 대신 미지원 사례 명시
- 독립 입력을 활용한 개인 회귀 테스트 구성 책임; 경계 사례 오류 해결 및 기대 출력이 포함된 재현 시험 자료 배포
학력
숭실대학교
서울 · 대한민국
컴퓨터학부 공학사
2008년 3월 - 2012년 2월
관련 과목: 알고리즘, 운영체제, 데이터베이스, 컴퓨터 네트워크
핵심 역량
직무 전문성
Kubernetes · Terraform · Prometheus · SLO · 장애 대응
자격증
AWS Certified Solutions Architect – Associate
Amazon Web Services
2023년 11월

