[회사명] n8n 운영 플레이북 v1.0
작성일: YYYY-MM-DD | 담당자: 이름 | 검토자: 이름
---
1. 환경 정보
- n8n 버전: (업데이트 시 갱신)
- 서버: [VPS 제공사], [사양], IP: [IP]
- 도메인: https://n8n.[회사].com
- 운영 모드: Queue Mode (Worker 2대)
- 데이터베이스: PostgreSQL 16
2. 접속 방법
- 웹 UI: https://n8n.[회사].com
- SSH: ssh [username]@[IP]
- 비상 연락: [담당자 연락처]
3. 일상 운영 절차
매일 확인 (5분)
- [ ] Uptime Kuma 대시보드 이상 없는지 확인
- [ ] 슬랙 #n8n-alerts 채널 오류 알림 없는지 확인
- [ ] 디스크 사용량 80% 미만인지 확인
매주 확인 (10분)
- [ ] 백업 파일 정상 생성 여부 (~/backups/n8n/)
- [ ] n8n 신규 버전 릴리즈 여부 확인
- [ ] 실행 실패율이 높은 워크플로우 점검
매월 확인 (30분)
- [ ] n8n 업데이트 진행 (릴리즈 노트 검토 후)
- [ ] 사용하지 않는 워크플로우 아카이브
- [ ] 크리덴셜 만료 여부 확인
- [ ] 팀원 권한 재검토
4. 장애 대응 절차
Level 1: n8n 접속 불가
1. ping [서버 IP] → 서버 생존 확인
2. docker compose ps → 컨테이너 상태 확인
3. docker compose restart n8n → 재시작 시도
4. docker compose logs n8n --tail=50 → 오류 원인 파악
Level 2: 워크플로우 전체 실패
1. 최근 Git Push 내용 확인
2. n8n 이전 버전으로 롤백 고려
3. DB 백업에서 복구 고려
Level 3: 서버 완전 장애 (신규 서버 복구)
1. VPS 제공사에서 새 서버 생성
2. Docker 설치 (DAY 3 참조)
3. 최신 백업 파일로 복구 (DAY 12 참조)
4. DNS 변경으로 트래픽 전환
5. 팀 운영 규칙
- 워크플로우 네이밍: [팀]_[동작]_[대상]_v[버전]
- 새 기능 테스트: 반드시 Dev 프로젝트에서
- 운영 수정: 팀장 슬랙 승인 후
6. 연락처
- n8n 담당자: [이름], [연락처]
- VPS 지원: [URL]
- n8n 커뮤니티: https://community.n8n.io