강의인프라 서비스 운영
인프라 서비스 운영 트랙

온프레미스와 클라우드 모두에서 통하는 실무 인프라 운영 역량

서버 운영, Web/WAS 미들웨어, 배포, 장애 대응, 보안까지 실무 인프라 엔지니어의 전체 역량을 체계적으로 다룹니다.

51시간📦 52개 모듈💬 한국어🆓 전체 무료초급 11중급 39고급 2
무료· 회원가입 없이 바로
📅 지속 업데이트 중
🎓 수료증 발급 예정
📱 모바일·태블릿 학습 지원

🎯 완료 후 할 수 있는 것

서버 초기 구축부터 SSH 보안, 방화벽 설정까지 직접 수행할 수 있다
Nginx/Apache/Tomcat을 구성하고 장애를 독립적으로 진단할 수 있다
WAR 배포 스크립트를 작성하고 롤백 전략을 수립할 수 있다
로그 분석으로 403/500/502/504 에러 원인을 추적할 수 있다
SSL 인증서 교체, DNS 변경, 방화벽 오픈 요청을 처리할 수 있다

📋 커리큘럼

52개 모듈

01

[Infra Ops] Modern Web/WAS 아키텍처와 서버 운영 SRE 핵심 직무초급
35

02

[Infra Ops] 리눅스 서버 초기 구축 세팅 및 보안 하드닝 체크리스트초급
55

03

[Infra Ops] Linux 핵심 파일시스템 구조와 권한(chmod) 체계 완벽 요약초급
60

04

[Infra Ops] 프로세스(ps), 포트(netstat), 리소스(top) 모니터링 실무초급
50

05

[Infra Ops] 실무 백엔드 자동화를 위한 Bash 쉘 스크립트 작성 기법중급
70

06

[Infra Ops] Linux 사용자/그룹/권한 체계와 서비스 계정 관리초급
55

07

[Infra Ops] SSH 접속 보안 강화와 배스천 호스트 기반 접근 제어초급
50

08

[Infra Ops] OS 보안 패치와 미들웨어 버전 업 절차중급
60

09

[Infra Ops] Web Server와 WAS 미들웨어 구조의 이해중급
50

10

[Infra Ops] WEB/WAS/DB 망 분리와 이중화 구조 설계중급
60

11

[Infra Ops] HTTP 요청이 서버에 도달하기까지의 전체 흐름중급
55

12

[Infra Ops] Nginx 설치, 기본 설정, 정적 파일 서빙 실무초급
55

13

[Infra Ops] Nginx 리버스 프록시와 로드밸런싱 설정중급
65

14

[Infra Ops] Let's Encrypt 인증서 발급과 Nginx SSL 설정중급
60

15

[Infra Ops] httpd VirtualHost 설정과 리버스 프록시 운영중급
60

16

[Infra Ops] WAR 배포부터 server.xml 튜닝, 장애 대응까지중급
70

17

[Infra Ops] Tomcat 세션 클러스터링과 Redis 세션 외부화중급
65

18

[Infra Ops] Heap/GC/Thread Dump 분석과 OOM 대응 실무중급
65

19

[Infra Ops] SSL/TLS 인증서 형식 변환과 갱신 절차중급
60

20

[Infra Ops] A레코드/CNAME 운영과 /etc/hosts 활용 실무초급
50

21

[Infra Ops] L4/L7 로드밸런서와 VIP 기반 이중화 구성중급
60

22

[Infra Ops] 네트워크 방화벽 정책과 요청서 작성 실무중급
55

23

[Infra Ops] Proxy/NAT 구조와 폐쇄망 외부 통신 설정중급
60

24

[Infra Ops] RESTful API 구조와 curl/Postman 테스트 실무초급
50

25

[Infra Ops] 트래픽 제어와 이벤트 기반 연계 구조중급
55

26

[Infra Ops] 써드파티 API와 공공 인프라 연계 실무중급
60

27

[Infra Ops] SAML/OAuth 기반 싱글사인온 구성과 장애 분석고급
65

28

[Infra Ops] SMTP 메일과 SMS 게이트웨이 운영 실무초급
50

29

[Infra Ops] SFTP/배치 파일 송수신과 외부 기관 연계 실무초급
50

30

[Infra Ops] JDBC Connection Pool과 DB 장애 분리 실무중급
60

31

[Infra Ops] Redis/Elasticsearch 접속 확인과 운영 기초중급
55

32

[Infra Ops] Cron/Quartz 장애 분석과 배치 재처리 실무중급
60

33

[Infra Ops] dev/stg/prod 환경변수와 설정 파일 분리 전략중급
55

34

[Infra Ops] Git/GitLab 브랜치 전략과 릴리즈 관리중급
50

35

[Infra Ops] Maven/Gradle/npm 빌드와 산출물 관리중급
55

36

[Infra Ops] DDL 반영 절차와 Migration 안전 운영중급
60

37

[Infra Ops] WAR/JAR/정적파일 배포와 배포 스크립트 작성중급
65

38

[Infra Ops] 컨테이너 배포 vs WAS 배포 비교와 실무 전환중급
60

39

[Infra Ops] systemd 서비스 등록과 자동 재시작 설정중급
55

40

[Infra Ops] 작업계획서 작성과 변경관리 체크리스트중급
60

41

[Infra Ops] 파일/설정/DB/인증서 롤백 절차와 판단 기준중급
60

42

[Infra Ops] HTTP 에러 코드 해석과 장애 원인 추적중급
65

43

[Infra Ops] Filebeat/rsyslog 기반 로그 수집 파이프라인 구성중급
60

44

[Infra Ops] CPU/메모리/디스크 임계치 관리와 logrotate중급
60

45

[Infra Ops] 애플리케이션 성능 모니터링과 대시보드 구성중급
65

46

[Infra Ops] 타임라인 분석과 재발 방지 대책 수립중급
55

47

[Infra Ops] 계정 권한 관리, 보안 헤더, TLS 강화 실무중급
60

48

[Infra Ops] 웹방화벽 403 분석과 CDN 캐시 관리 실무중급
55

49

[Infra Ops] 취약점 조치와 보안 심사 대응 실무중급
60

50

[Infra Ops] 파일/설정/DB 백업과 재해복구 기초중급
65

51

[Infra Ops] AWS 기반 인프라 운영 실무와 전환 고려사항중급
70

52

[Infra Ops] 장애/배포/연계/보안 케이스 실전 종합고급
90

🧪 실습 Labs

개념을 익혔다면 직접 손으로 해보는 시간. 서버에서 따라하고 verify.sh로 검증하세요.

Labs 전체 보기 →

Nginx 설치 및 기동

초급

Linux 서버에 Nginx를 설치하고 systemd 서비스로 등록하여 80포트에서 응답하는 상태까지 만든다.

40📋 3단계💻 직접 환경

배포 후 502 — 원인 찾기

중급

Spring Boot 앱 배포 직후 Nginx 502 에러가 발생했다. 에러 로그와 프로세스 상태를 분석해 원인을 파악하고 서비스를 복구한다.

60📋 5단계💻 직접 환경

GitHub Actions — CI 파이프라인 구축

초급

팀이 Jenkins에서 GitHub Actions로 CI를 전환하는 과정에서 기본 파이프라인을 구성하는 실습. .github/workflows/ci.yml 작성(push/PR 트리거) → 빌드+테스트 단계 → 아티팩트 업로드 → 시크릿 참조까지 4단계. YAML 문법과 Actions 생태계의 핵심 개념을 파악한다.

45📋 4단계💻 직접 환경

Nginx 리버스 프록시 + SSL 설정

중급

Node.js 앱 앞에 Nginx를 배치해 리버스 프록시를 구성하고, self-signed 인증서로 HTTPS를 적용한다.

75📋 4단계

Prometheus + Grafana — 인프라 모니터링 구축

중급

서버 CPU/메모리/디스크 사용률을 Prometheus + Grafana로 실시간 모니터링하는 스택 구축. Node Exporter 설치 → Prometheus scrape 설정 → Grafana 데이터소스 연동 → 대시보드 임포트(ID:1860) 4단계. 설치형 모니터링 스택의 핵심 구조와 메트릭 수집 원리를 이해한다.

45📋 4단계💻 직접 환경

Jenkins 빌드 실패 — 로컬에선 됩니다

중급

CI 파이프라인이 실패했다. 빌드 로그를 분석해 원인 2가지를 파악하고 Jenkinsfile을 수정해 파이프라인을 복구한다.

65📋 5단계💻 직접 환경

Tomcat WAS 응답 지연 — 스레드 풀·GC 진단

중급

CPU는 한가한데 WAS가 느리다. 원인은 보통 둘 중 하나다: 스레드 풀 고갈(maxThreads 부족·느린 외부 호출로 스레드가 묶임) 또는 GC 폭주(힙 부족·풀 GC 빈발). 스레드 덤프와 GC 로그로 어느 쪽인지 가르고, Connector/힙 설정을 근거 있게 조정한다.

45📋 3단계💻 직접 환경

SSL 인증서 갱신 운영 — 만료 진단부터 자동 갱신까지

중급

인증서 만료는 예고된 장애다. openssl로 현재 인증서의 만료일·체인·도메인을 진단하고, certbot으로 갱신한 뒤 웹서버에 무중단 반영하고, systemd timer(또는 cron)로 자동 갱신을 걸어 "만료"라는 사건 자체를 없앤다. 갱신 후 reload를 잊어 옛 인증서가 서빙되는 흔한 함정도 다룬다.

40📋 3단계💻 직접 환경

흩어진 로그 추적 — 다중 서버 로그 집계와 상관 분석

중급

6대 서버에 흩어진 로그에서 "2시 10분 결제 실패"의 원인을 찾는다. 시간 동기화(타임존/NTP)와 요청 ID(trace id)가 왜 집계의 전제인지 체감하고, journalctl/grep으로 시간창을 좁히고, 여러 서버 로그를 하나의 타임라인으로 합쳐 근본 원인을 특정한다. 중앙 집계가 없을 때의 응급 추적과, 있어야 하는 이유를 함께 다룬다.

45📋 3단계💻 직접 환경

로드밸런서 헬스체크·페일오버 — 죽은 노드로 트래픽이 가는 이유

중급

백엔드 1대가 죽었는데 LB가 계속 그쪽으로 보내 502가 절반씩 난다. 헬스체크가 왜 동작하지 않는지(경로·주기·임계치) 진단하고, 헬스체크를 바로잡아 죽은 노드를 풀에서 자동 제외하고, 노드를 살린 뒤 자동 복귀까지 확인한다. 헬스체크 경로가 실제 서비스 상태를 반영하는지(얕은 체크의 함정)도 다룬다.

45📋 3단계💻 직접 환경

나쁜 배포 즉시 롤백 — "먼저 되돌리고, 원인은 나중에"

중급

배포 직후 에러율이 폭증했다. 장애 대응의 철칙은 "원인 분석보다 복구 우선"이다. 배포와 장애의 시간 상관으로 신규 릴리스를 범인으로 특정하고, 안전하게 직전 버전으로 롤백하고, 에러율 회복을 확인한다. DB 마이그레이션이 섞인 배포의 롤백 함정(되돌릴 수 없는 변경)과 롤백을 빠르게 만드는 배포 구조(블루-그린/심링크)도 다룬다.

45📋 3단계💻 직접 환경

백업 복구 리허설 — RPO·RTO를 실제로 검증하기

중급

"백업은 있는데 복구는 안 해봤다"가 진짜 위험이다. 백업의 무결성·신선도를 점검하고, 격리 환경에서 실제로 복구해 데이터가 살아나는지 검증하고, 복구에 걸린 시간(RTO)과 잃은 데이터 구간(RPO)을 측정한다. PITR(특정 시점 복구) 개념과 백업이 조용히 깨지는 흔한 원인(권한·용량·암호키)도 다룬다.

50📋 3단계💻 직접 환경

서버 침해 의심 대응 — 격리·조사·증거 보존

고급

새벽에 의심스러운 프로세스와 아웃바운드 트래픽이 발견됐다. 침해 대응의 원칙은 "끄지 말고 격리, 지우지 말고 보존"이다. 의심 프로세스·네트워크 연결·지속성(크론/서비스/SSH 키)을 조사하고, 네트워크를 격리하면서 휘발성 증거를 보존하고, 침투 경로 단서를 로그에서 찾는다. 성급한 재부팅·삭제가 왜 최악인지 체득한다.

50📋 3단계💻 직접 환경

배치 스케줄러 장애 — cron이 "등록은 됐는데 안 도는" 이유

중급

cron에 등록된 야간 배치가 실행되지 않았다. cron 미실행의 원인은 거의 정해져 있다: 환경변수/PATH 차이, 로그 미수집으로 실패를 모름, 시간대/시각 오해, 중복·과다 실행. 실행 여부를 로그로 확인하고, 환경 차이를 재현·교정하고, 멱등성·잠금(중복 방지)과 모니터링까지 더해 "조용한 실패"를 없앤다.

40📋 3단계💻 직접 환경

환경 설정 드리프트 — "스테이징은 되는데 운영만 안 됨"

중급

같은 코드가 환경마다 다르게 동작한다. 원인은 코드가 아니라 환경별 설정 차이(누락된 환경변수, 다른 시크릿, 잘못된 엔드포인트)다. 환경 간 설정을 안전하게 비교(시크릿 값은 가리고 키만)하고, 차이를 특정하고, 12-factor 원칙대로 설정을 코드에서 분리해 드리프트를 구조적으로 막는다.

40📋 3단계💻 직접 환경

systemd 서비스 부팅 실패 — 자동 기동·의존성·순서 진단

중급

재부팅 후 서비스가 자동으로 안 뜬다. 수동 start는 되는데. 원인은 (1) enable 누락(자동 시작 미등록), (2) 의존성/순서 문제(DB·네트워크·마운트가 준비되기 전에 기동), (3) 환경/권한 차이다. enable·journalctl·의존성으로 진단하고, After/Requires와 재시작 정책으로 부팅 후 안정 기동을 보장한다.

40📋 3단계💻 직접 환경