EC2 서버에서 로그가 갑자기 안 남는 원인 정리

로그가 멈추는 순간 서버 운영은 눈을 잃는다

Amazon Web Services 환경에서 EC2 서버를 운영할 때 로그는 서버 상태를 파악할 수 있는 가장 기본적인 정보다. 서비스가 정상 동작하는지, 오류가 언제 발생했는지, 누가 어떤 요청을 보냈는지 모두 로그를 통해 확인한다. 그런데 어느 순간부터 로그가 더 이상 기록되지 않는다면, 서버는 동작하고 있어도 운영자는 상황을 파악할 수 없는 상태가 된다. EC2 서버에서 로그가 갑자기 안 남는 현상은 생각보다 흔하며, 대부분은 반복적으로 나타나는 원인이 존재한다.

디스크 용량 부족이 가장 흔한 원인

EC2 서버에서 로그가 갑자기 멈췄다면 가장 먼저 확인해야 할 것은 디스크 용량이다. 로그 파일은 지속적으로 디스크에 기록되기 때문에, 저장 공간이 부족해지면 더 이상 파일을 쓸 수 없게 된다. 이 경우 로그 프로세스는 오류를 발생시키거나 조용히 기록을 중단한다.

특히 로그 로테이션 설정이 없거나 제대로 동작하지 않는 환경에서는 디스크 용량이 서서히 소모되다가 어느 순간 임계점에 도달한다. 운영자는 로그가 안 남는다는 사실을 뒤늦게 알아차리게 된다.

로그 로테이션 설정 오류

로그 로테이션은 오래된 로그를 정리하고 새로운 로그 파일을 생성하는 중요한 설정이다. 이 설정이 잘못되어 있으면 로그 파일이 계속 하나의 파일에만 쌓이거나, 파일 권한 문제로 새로운 로그 파일을 생성하지 못하는 상황이 발생한다.

로그 로테이션 설정 파일이 변경되었거나, 관련 서비스가 중단된 경우에도 로그 기록이 멈출 수 있다. 이 문제는 로그 자체가 아예 생성되지 않기 때문에 원인 파악이 쉽지 않다.

로그 디렉터리 권한 문제

로그는 특정 디렉터리에 파일 형태로 저장된다. 이 디렉터리에 대한 쓰기 권한이 변경되거나 소유자가 잘못 설정되면 로그 기록은 즉시 중단된다. 운영 중에 권한 변경 작업을 하거나, 자동화 스크립트가 권한을 잘못 수정하는 경우 이런 문제가 발생할 수 있다.

서버 자체는 정상 동작하지만 로그만 남지 않는 경우, 권한 문제를 의심해볼 필요가 있다.

로그를 남기는 프로세스 중단

로그는 보통 웹 서버, 애플리케이션 서버, 로그 수집 에이전트 같은 프로세스에 의해 기록된다. 이 프로세스가 중단되거나 비정상 상태에 빠지면 로그는 더 이상 생성되지 않는다.

문제는 로그 프로세스가 중단되더라도 서비스 자체는 계속 동작하는 경우가 많다는 점이다. 이 때문에 로그가 안 남는 현상을 바로 인지하지 못하고, 장애 발생 후에야 문제를 알게 되는 상황이 자주 발생한다.

로그 설정 변경 또는 배포 영향

애플리케이션 배포 과정에서 로그 설정이 변경되는 경우도 많다. 로그 레벨을 낮추거나, 로그 출력 경로를 잘못 지정할 경우 정상적으로 로그가 남지 않는다. 특히 설정 파일이 여러 환경에서 공유되는 구조에서는 운영 환경에 맞지 않는 설정이 반영되는 실수가 자주 발생한다.

배포 이후 특정 시점부터 로그가 안 남기 시작했다면, 설정 변경 여부를 반드시 확인해야 한다.

로그 파일 핸들 문제

운영체제 수준에서 로그 파일 핸들이 꼬이는 경우도 있다. 로그 파일은 존재하지만 실제로는 더 이상 쓰이지 않는 상태가 되는 경우다. 이 문제는 로그 로테이션 이후 프로세스가 새로운 파일을 인식하지 못할 때 발생하기도 한다.

이 경우 로그 파일은 그대로 존재하지만, 크기가 더 이상 증가하지 않는다. 운영자는 로그가 있는 것처럼 보이지만 실제로는 기록이 멈춰 있는 상태를 겪게 된다.

서버 시간 문제로 인한 로그 혼란

서버 시간이나 Timezone 설정이 어긋나 있으면 로그가 안 남는 것처럼 보이는 착각이 생길 수 있다. 실제로는 로그가 기록되고 있지만, 예상과 다른 시간대의 파일에 쌓이거나 과거 시간으로 기록되어 운영자가 찾지 못하는 경우다.

여러 EC2 서버를 운영하는 환경에서는 서버별 시간 설정 차이로 인해 로그가 사라진 것처럼 보이는 상황이 자주 발생한다.

로그 저장 위치 변경 문제

로그 저장 경로가 변경되었는데 운영자가 이를 인지하지 못하는 경우도 있다. 설정 변경이나 배포 과정에서 로그 경로가 바뀌면, 기존 위치에는 더 이상 로그가 남지 않는다. 운영자는 “로그가 안 남는다”고 느끼지만, 실제로는 다른 경로에 로그가 기록되고 있는 경우다.

이 문제는 서버 구조를 명확히 파악하지 못한 상태에서 특히 자주 발생한다.

로그 수집 에이전트 장애

EC2 서버에서 로그를 외부로 전송하는 구조를 사용하는 경우, 로그 수집 에이전트가 중단되면 로그가 남지 않는 것처럼 보일 수 있다. 실제 서버 로컬에는 로그가 있지만, 중앙 로그 시스템에는 아무 기록도 나타나지 않는다.

운영자는 서버 자체의 로그 문제로 오해하기 쉽지만, 원인은 로그 수집 계층에 있는 경우도 많다.

로그 문제는 장애 대응을 불가능하게 만든다

로그가 남지 않는 상태에서 장애가 발생하면 원인 분석은 거의 불가능해진다. 언제, 어떤 요청이, 어떤 순서로 발생했는지 알 수 없기 때문이다. 로그 문제는 단독 장애라기보다, 더 큰 장애를 키우는 위험 요소다.

따라서 로그 기록 상태는 서버 성능 지표만큼이나 중요하게 관리되어야 한다.

EC2 서버 로그 미기록 문제 정리

EC2 서버에서 로그가 갑자기 안 남는 원인은 디스크 용량 부족, 로그 로테이션 오류, 권한 문제, 로그 프로세스 중단, 설정 변경, 파일 핸들 문제 등 매우 다양하다. 대부분은 사전에 점검하고 관리하면 충분히 예방할 수 있는 문제들이다.

로그는 서버 운영의 기록이자 증거다. EC2 서버를 안정적으로 운영하려면 로그가 정상적으로 남고 있는지 항상 확인해야 하며, 로그가 멈추는 순간을 단순한 설정 문제가 아닌 심각한 운영 리스크로 인식해야 한다. 로그 관리가 잘 되는 서버 환경이 곧 신뢰할 수 있는 서버 운영의 출발점이다.

댓글 남기기