문제 발생
graceful shutdown 문제가 나타난 입력, 직전 동작과 실제 결과를 함께 적습니다. 예를 들어 “가끔 실패”라고 쓰는 대신 정상 사례와 실패 사례를 하나씩 두고, 두 사례에서 달라진 version·설정·데이터를 표로 남깁니다.
| 사례 | 입력과 상태 | 결과 |
|---|---|---|
| 정상 | 가장 작은 정상 조건 | 기대한 결과 |
| 실패 | 한 조건만 달라진 재현 | 실제 오류·값 |
원인 분석
server가 새 request를 받지 않은 뒤 active request와 background task가 종료 유예 안에 끝나고 connection pool이 닫혀야 합니다.
heap 사용량과 열린 file·socket·timer·listener를 분리합니다. 작업이 끝난 뒤에도 handle 수가 기준선으로 돌아오지 않는지 확인합니다. Actuator metric, trace, thread dump, Hikari pool, transaction과 configuration property source를 확인한다. 정상과 실패를 번갈아 실행하고, 이 원인이 맞다면 달라져야 할 값부터 확인합니다. 관련 없는 로그와 설정을 한꺼번에 바꾸지 않습니다.
해결 방안
자원을 만든 코드가 성공·실패·취소 경로 모두에서 닫도록 수명주기를 한곳에 둡니다. timeout과 finally·cleanup을 짝으로 관리합니다. proxy와 transaction 경계를 명확히 하고 외부 호출을 긴 DB transaction 밖으로 옮기며 설정을 타입으로 검증한다.
수정 전 실패 사례가 사라지고 기존 정상 사례가 유지돼야 합니다. 통합 테스트와 부하 테스트에서 pool, lock, p99, graceful shutdown과 오류 응답 계약을 확인한다. 정상 완료, 중간 오류와 취소를 반복한 뒤 열린 handle·descriptor·task 수가 기준선으로 돌아오고 다음 작업이 정상 실행되는지 확인합니다. 가장 작은 실패 입력은 자동 테스트나 실행 가능한 점검 명령으로 남깁니다.
공식 문서와 적용 범위
문서의 기본값과 동작은 version에 따라 달라질 수 있습니다. 현재 version, 실제 적용 설정, 자원 제한과 운영 환경에서 다시 확인합니다.