사용자 증상에서 출발하는 서비스 지표, 다음 실험으로 이어지는 회고
CPU 사용률만 보고 있으면 요청이 실패하는데도 상태가 정상처럼 보일 수 있다. 자원 지표와 사용자가 경험하는 결과를 함께 관찰해야 한다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.
만들며 배우고, 배운 것을 나눕니다.
더 나은 제품을 향한 개발의 기록.
작은 발견부터 깊이 있는 고민까지.
CPU 사용률만 보고 있으면 요청이 실패하는데도 상태가 정상처럼 보일 수 있다. 자원 지표와 사용자가 경험하는 결과를 함께 관찰해야 한다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.
요청이 프록시와 API, 작업 큐를 거치면 한 줄의 오류만으로 전체 흐름을 찾기 어렵다. 각 구간이 같은 상관 식별자를 공유하면 조사 범위를 좁힐 수 있다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.
같은 요청의 실패를 찾는데 로그 문장마다 형식이 다르면 검색식이 복잡해진다. 사람이 읽는 설명과 기계가 집계할 필드를 나눌 필요가 있다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.
연결 문자열과 인증 헤더를 통째로 기록하면 장애 분석용 로그가 자격 증명의 복사본이 된다. 설정 확인 편의와 접근 권한을 함께 생각해야 한다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.
누락된 환경 변수가 특정 기능을 누르는 순간에야 드러나면 배포 성공 표시를 믿기 어렵다. 기본값으로 조용히 우회하는 설정은 원인 파악도 어렵게 한다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.
배포 중 서버가 종료되면서 처리하던 요청까지 끊어질 수 있다. 새 요청을 막는 시점과 진행 중인 작업을 정리하는 시점을 구분해야 한다. 결론보다 남은 질문를 중심으로 작은 예제와 확인 기준을 정리합니다.