채널 분산(이미 붐비는 채널에 있는 사람은 새 서버로 옮길 수 없음), 새 서버의 시작·데이터 로딩 시간 줄이기.
인프라팀 할 일
이벤트 전 미리 확장, 예열된 예비 서버, 줄일 때는 남은 사람이 빠진 뒤 끄기.
수치 감각
부하를 감지하는 데 1~몇 분(지표를 몇 분 평균해서 보기 때문), 새 서버를 켜고 게임 데이터를 읽고 캐시를 채우는 데 또 수 분.
그래프에서는
접속·점검 직후 폭증 · 인스턴스 수, CPU 사용률, 접속 대기
확인할 곳
오토스케일링 활동 기록(확장을 결정한 시각, 새 인스턴스가 서비스에 들어간 시각)을 CPU 사용률·접속 수 그래프에 겹쳐 봄. AWS는 Auto Scaling 그룹 지표(켜 두어야 보임) GroupDesiredCapacity(목표 대수)·GroupPendingInstances(준비 중)·GroupInServiceInstances(서비스 중)
이러면 맞음
접속이 급증한 뒤 몇 분 동안 목표 대수와 준비 중 인스턴스만 늘고 기존 서버의 CPU가 한도에 붙어 있다가, 서비스 중 인스턴스가 늘어난 시각부터 풀림
이러면 아님
새 인스턴스가 들어온 뒤에도 느리면 서버 대수 밖의 원인(DB 같은 공용 자원, 연쇄 장애) 쪽
확인 수단
인프라 도구로 확인(게임 코드 불필요)
더 알아보기
오토스케일링은 주로 로그인·게이트웨이·던전처럼 새 서버에 새 사람을 받으면 되는 곳에 씁니다. 줄일 때도 탈이 납니다. 사람이 빠진 새벽에 서버를 줄이면서 남은 사람이 빠지기를 기다리지 않고 끄면 그 사람들의 접속이 끊깁니다.