본문 바로가기

전체 글19

AXGATE 40D DNAT 포트포워딩 설정과 접속 장애 점검 방법 ## 들어가며 외부에서 내부 서버의 특정 TCP 포트로 접속해야 할 때 방화벽에서는 보통 DNAT, 흔히 말하는 포트포워딩을 구성한다. 이번 기록은 AXGATE 40D에서 WAN 주소로 들어오는 TCP 18000, 18010, 18011, 18012 포트를 내부 서버로 전달하는 흐름을 정리한 것이다. 공개 글에서는 실제 주소를 사용하지 않고 WAN은 `PUBLIC_WAN_ADDRESS`, 내부 서버는 `INTERNAL_SERVER_ADDRESS` 같은 비주소형 예시 값으로 치환했다. 포트포워딩은 NAT 설정 하나만으로 끝나지 않는다. 서비스 객체, DNAT 프로파일, IPv4 보안정책, 내부 서버 Listen 상태, 리턴 경로가 함께 맞아야 한다. 특히 AXGATE 계열은 DNAT 프로파일을 만들고 정책.. 2026. 10. 2.
Uptime Kuma에서 Gatus로 옮기며 모니터링 오판정을 줄인 기록 ## 들어가며 이날 작업의 핵심은 server-a의 모니터링 체계를 정리하는 것이었다. 기존에는 Uptime Kuma 기반 구성이 돌아가고 있었지만, 운영하면서는 더 단순한 실행 구조와 관리 포인트가 필요했다. 그래서 Gatus로 전환하되, 기존 감시 대상과 알림 흐름은 최대한 유지하는 방향으로 작업을 잡았다. 막상 진행해 보니 단순한 도구 교체로 끝나는 일이 아니었다. 모니터링 실패가 실제 장애인지, DNS 해석 문제인지, 호스트 이름 해석 설정의 우선순위 때문인지, 프록시 진입 경로나 헬스 체크 경로가 잘못된 것인지 하나씩 분리해야 했다. gateway 서비스와 Vaultwarden 서비스는 겉으로는 장애처럼 보였지만, 실제로는 감시 경로와 브라우저 진입 경로의 차이에서 비롯된 오판정에 가까웠다. #.. 2026. 10. 2.
Ubuntu 업그레이드 이후 드러난 자동화 운영 부채 정리 ## 들어가며 Ubuntu 메이저 업데이트 이후 여러 자동화가 동시에 흔들렸다. `weather_bot` 데몬은 정상 실행되지 않았고, `tg-monitor.service`는 반복 재시작 상태에 들어갔다. Telegram 봇의 사용량 그래프도 멈췄고, Grafana에서는 server-a만 `no data`로 보였다. 처음에는 각각 다른 장애처럼 보였지만, 점검을 이어가면서 공통점이 보였다. 업데이트가 모든 문제의 직접 원인이라기보다는, 기존 스크립트와 서비스가 특정 환경을 너무 강하게 전제하고 있었고 그 전제가 업그레이드 이후 표면으로 올라온 것이다. 운영 자동화는 평소에는 조용히 돌아가지만, 한번 어긋나면 여러 층에서 동시에 증상이 나타난다. 알림 봇이 흔들리면 장애 감지가 늦어지고, 리포트 값이 비면.. 2026. 9. 29.
디스크 정리에서 OS 업그레이드 판단까지, 운영 서버 점검 기록 ## 들어가며 운영 서버의 장애는 늘 큰 사건처럼 시작되지 않는다. 이번 작업은 `server-a`의 루트 디스크 사용률이 97%까지 올라간 것을 확인하면서 시작했다. 25GB SSD 중 대부분을 이미 사용 중이었고, 남은 공간은 1GB 미만이었다. 이 정도면 서비스가 바로 멈추지 않더라도 로그 기록 실패, 패키지 작업 실패, 컨테이너 동작 불안정 같은 문제가 따라올 수 있다. 처음에는 급한 디스크 정리가 목표였다. 하지만 막상 살펴보니 같은 유형의 캐시와 불필요 패키지가 다른 서버에도 남아 있었고, 통합 리포트 대상 서버도 늘려야 했다. 여기에 모니터링 도구의 용량 부담과 Ubuntu LTS 업그레이드 시점까지 같이 검토하게 됐다. 하루 작업이었지만 내용은 단순 청소보다 운영 기준을 다시 세우는 쪽에 .. 2026. 9. 29.