Week 1은 추상의 주간이었다. CALMS의 다섯 축, DORA의 네 메트릭, Well-Architected의 여섯 기둥, AWS DevOps 도구 지도, 그리고 멀티 계정 거버넌스. 따로 두면 각자 하나의 거대한 책이지만, DOP-C02 시나리오 안에서는 항상 두세 개가 한 묶음으로 등장한다. "분기 1회 배포 → 일 1회"로 가속하는 일에는 Automation 도구만 깔아서 풀리지 않고, blast radius·계정 분리·서명 검증·롤백 자동화·관찰성까지 한 번에 끌려 올라온다.
오늘은 그 묶음 풀이를 12개의 시나리오로 굳힌다. 각 문제는 Day 1-4의 두세 가지 개념을 엮어 만들었고, 시험장에서 정확히 같은 형태의 문제를 만난다고 가정하고 풀이를 적었다. 결국 Week 1이 가르치고 싶은 것은 "DevOps는 코드를 빠르고 안전하게 흘려보내는 시스템이고, AWS의 도구·계정 구조·메트릭은 그 시스템을 코드로 옮기기 위한 부품"이라는 한 문장이다.
W-AF Pillar 분류: "이 시나리오가 어느 Pillar를 묻는가" (Reliability? Cost? Security?)
CALMS/DORA 진단: 어느 축이 약하고 어느 메트릭이 깨졌는가
AWS 도구 후보 추리기: 도메인별 도구 지도에서 3-4개 후보
trade-off로 단일 정답 선택: 우선순위·blast radius·비용·운영 부담
🎯 시나리오: "Slack 알림이 너무 많아 무시당한다"는 보고가 올라온다. 무엇이 문제인가? 도구가 아니라 Measurement 정의가 잘못된 상태다. SLO/SLI 없이 모든 메트릭을 alert로 만든 결과 alert fatigue가 생긴 것. 정답은 도구 추가가 아니라 SLO 정의 + Composite Alarm으로 노이즈 축소 + Error Budget 기반 분류다. CALMS의 M 축이 양적으로는 충족됐지만 질적으로 무너진 사례.
한 대형 핀테크가 "분기 1회 배포 → 주 1회 배포"로 가속을 추진한다. 현재 상태: 단일 AWS 계정에서 dev/staging/prod를 VPC로만 분리, CodePipeline 없이 사람이 콘솔에서 직접 배포, 사고 발생 시 평균 8시간 복구 소요. CALMS 진단 + 우선순위 처방으로 가장 적합한 것은?
문제 2
한 회사가 us-east-1과 eu-west-1에 동일 워크로드를 배포한다. 사용자는 글로벌이고 GDPR 준수가 필수. 단일 계정에서 운영 중이라 사고 시 blast radius 우려가 크다. Organizations 도입 후 가장 적합한 OU 구조는?
문제 3
한 회사가 SaaS 모니터링 도구 Datadog를 도입한다. Datadog가 우리 AWS 계정의 메트릭에 접근해야 한다. 보안 + 자동화 관점에서 가장 적합한 설정은?
문제 4
한 회사가 "배포 빈도는 일 5회로 Elite 수준인데 Change Failure Rate가 40%"라는 문제를 보고했다. 다음 조치 중 가장 효과적인 것은?
문제 5
한 글로벌 회사가 5개 리전에 배포하면서 모든 계정의 CloudTrail 로그를 중앙 집중 + 변조 방지로 관리하려 한다. 가장 적합한 아키텍처는?
문제 6
한 회사가 멀티 계정 환경에서 CI/CD를 구축한다. CodePipeline은 Shared Services 계정에 있고, 배포 대상은 Prod 계정. Prod 계정의 ECS 서비스로 배포해야 하며, KMS 키로 암호화된 artifact를 사용한다. 가장 정확한 권한 설정은?
문제 7
한 회사가 모든 계정에 "ap-northeast-2와 us-east-1 외 리전에서 EC2/RDS/S3 작업 금지"를 강제하려 한다. SCP를 작성할 때 반드시 주의해야 할 점은?
문제 8
한 회사가 EKS 클러스터를 Prod 계정에 운영하고, ArgoCD를 통해 GitOps 방식으로 배포한다. 단일 클러스터 시나리오에서 ArgoCD는 어디에 두는 게 가장 적합한가?
문제 9
한 회사가 "DORA 메트릭을 dashboard로 시각화하라"는 요구를 받았다. AWS 환경에서 가장 적합한 데이터 파이프라인은?
문제 10
한 회사가 Production 계정의 "특정 시간(주말, 새벽 0-6시)에 자동으로 read-only mode"를 강제하려 한다. 가장 적합한 메커니즘은?
문제 11
Werner Vogels의 "You Build It, You Run It" 원칙을 AWS 환경에서 가장 정확히 구현하는 조직 모델은?
문제 12
한 회사가 "한 팀이 sandbox 계정에서 비용을 한 달에 \$30,000 쓴 사고가 발생했다. 같은 일이 재발하지 않게 하라"는 요구를 받았다. 가장 효과적인 조치 조합은?
오늘까지 본 다섯 가지 — DevOps 운영 모델, CALMS/DORA, W-AF, 도구 지도, 멀티 계정 — 는 DOP-C02 도메인 1~6 전부의 배경이 된다. 도메인 1(SDLC)을 다음 주부터 본격적으로 들어가는데, 그때 만나게 될 CodePipeline / CodeBuild / CodeDeploy 시나리오는 모두 다음 두 질문 위에서 풀린다.
"이 변경을 얼마나 빠르고 안전하게 흘려보낼 것인가" (DORA)
"사고가 나면 얼마나 좁은 범위에서 멈출 것인가" (blast radius + 멀티 계정)
이 두 질문을 잊지 않으면 다음 주 트렁크 기반 개발, OIDC 페더레이션, CodeArtifact, 코드 서명 같은 주제들이 "각각 따로 외워야 할 도구"가 아니라 "같은 사고 프레임의 다른 부품"으로 보이기 시작할 것이다.