전체 글

서버 인프라, 리눅스/윈도우 운영, 트러블슈팅 실무 기록 Server Infra Linux Window

infra/Linux & Windows

추석 연휴 리눅스 서버 점검 스크립트

연휴 출근을 막기 위한 서버 사전 점검 연휴가 길어질수록 서버 엔지니어에게는 불안한 시간이기도 하다. 평소라면 바로 대응했을 장애가, 하필 연휴 중에 터지면 결국 출근길에 오르게 되는 경우가 종종 있다.이 글은 그런 상황을 조금이라도 줄여보기 위해, 연휴 시작 전 미리 서버 상태를 점검해두는 방법과 그 과정에서 만든 스크립트를 정리한 기록이다. """ 서버 점검 스크립트 (Windows PC에서 실행) - SSH ID/PW로 접속 후 sudo su root로 권한 상승 - CPU / 메모리 / 디스크 사용량 조회 (설정 변경 없음, 조회 전용 명령만 사용) - 사용률이 임계치를 넘으면 "이상" 으로 자동 표시 - 결과를 텍스트 파일(메모장으로 열림)로 저장 사전 준비 (Windows PC, 최초 1회)..

infra/Linux & Windows

Rocky Linux 서버, 관리자 명령어 실행 이력은 어떻게 남기고 있을까 (bash trap + rsyslog 감사 구조 분석)

보안 점검 항목 중 "관리자 작업로그 저장 여부"를 확인하다가, 이미 운영 중인 서버에 생각보다 잘 만들어진 명령어 감사 구조가 있어서 정리해본다. auditd가 아니라 순수 bash 기능 + rsyslog만으로 구성된 방식인데, 원리를 알아두면 다른 서버 점검할 때도 바로 써먹을 수 있다. 1. 점검 배경리눅스 서버 보안 점검 체크리스트에는 보통 아래 항목들이 세트로 묶여 나온다.rsyslog 서비스로 관리자 접속 시 작업 이력 및 책임추적성 확보 여부NTP(시간 동기화) 설정 여부관리자 작업로그 저장 여부로그 열람 및 삭제 권한 통제 여부이 중 3번 "관리자 작업로그 저장 여부"가 애매하다. auditd가 켜져 있어도 규칙(rule)이 없으면 사실상 아무것도 안 남기 때문에, 서비스 running 상..

MY stock

GPT vs Gemini vs Claude

주식 추천 35일 후 성적표2026년 5월 20일기준일 : 2026년 4월 16일국내 3종목 + 해외 3종목 지난 4월 16일, 세 AI에게 각각 국내·해외 주식을 한 종목씩 추천받고 기준가를 기록했습니다. 35일이 지난 오늘 5월 20일, 중간 성적표를 공개합니다. 결과는 꽤 극단적이었습니다.한눈에 보는 결과🤖 GPT+16.1%국내 +31.5%해외 +0.7%💎 Gemini-11.4%국내 -10.7%해외 -12.0%🌀 Claude+18.3%국내 +61.1%해외 -24.5%종합 1위는 Claude이지만, 국내 종목이 워낙 잘 나와서 해외 손실을 만회한 케이스입니다. Gemini는 양쪽 모두 손실로 유일하게 마이너스를 기록했습니다.🇰🇷 국내 주식 상세종목기준가 (4/16)현재가 (5/20)수익률..

infra/Linux & Windows

HCI VMware 환경에서 Ansible 운영 가이드 — 300대 VM을 효율적으로 관리하는 법

Ansible이란?Ansible은 Red Hat이 만든 오픈소스 IT 자동화 도구다.서버 설정, 패키지 설치, 파일 배포, 서비스 관리 등 인프라 운영에서 반복되는 작업들을 코드로 정의해두고 자동으로 실행할 수 있게 해준다. 비슷한 도구로 Puppet, Chef, SaltStack 등이 있지만, Ansible이 압도적으로 많이 쓰이는 이유는 딱 하나다.💡 에이전트가 필요 없다. 대상 서버에 SSH만 연결되면 끝이다.다른 도구들은 대상 서버에 별도 에이전트 소프트웨어를 설치해야 한다. 반면 Ansible은 SSH만 연결되면 끝이다. 기존 서버에 아무것도 건드리지 않아도 바로 사용할 수 있다. 특징 설명에이전트리스대상 서버에 별도 설치 불필요, SSH만 있으면 됨YAML 기반사람이 읽기 쉬운 문법으로 작..

infra/Linux & Windows

리눅스 서버 관리자가 알아야 할 기본 명령어 & 로그 확인 가이드

리눅스 서버를 운영하면서 자주 확인하게 되는 로그 파일 위치, 시스템 상태 확인 명령어,네트워크 진단 방법 등을 정리했습니다.목차SSH 로그 확인로그인 / 로그아웃 / 계정 관련 로그방화벽 로그 및 명령어시스템 로그 / 기본 정보 확인서버 리소스 확인 명령어네트워크 상태 확인프로세스 확인 명령어그 밖의 유용한 리눅스 관리 명령어1. SSH 로그 확인로그 파일 위치배포판 로그 파일 경로RHEL / CentOS / Rocky/var/log/secureUbuntu / Debian/var/log/auth.logsystemd 기반 공통journalctl -u sshd기본 로그 확인 명령어# 실시간 SSH 로그 모니터링tail -f /var/log/secure# 최근 100줄 확인tail -100 /var/log/..

MY stock

GPT vs Gemini vs Claude, 누가 돈을 벌어줄까? AI 주식 추천 실험

2026년 4월 투자 실험 GPT vs Gemini vs Claude AI 주식 추천 대결 🤖📈 세 AI에게 각각 100만 원씩, 국내·해외 종목을 고르게 했다.누가 돈의 냄새를 가장 잘 맡을까? GPT — 인프라/전력 Gemini — 로봇 Claude — 역발상 ✦ 실험 배경 요즘 주식 시장의 흐름은 단순하다. 반도체 → AI → 전력 인프라 → 방산으로 자금이 이동했고, 이제는 "다음 수혜 섹터"를 찾는 싸움이 시작됐다. 그렇다면 세 AI는 같은 질문에 어떻게 다른 답을 낼까? GPT, Gemini, Claude에게 동일한 조건을 던졌다. 국내 1개 + 해외 1개, 총 600만 원 가상 투자. 1~3개월 뒤 수익률로 누가..

infra/Linux & Windows

nginx 포트 설정, 어디서 오는 걸까? — 실전 트러블슈팅

· Linux / nginx · 실제 디버깅 과정 정리상황두 서버의 /etc/nginx/nginx.conf.default가 완전히 동일한데, 한 서버는 80/443 포트가 모두 LISTEN 상태이고, 다른 서버는 443만 열려 있었다. 설정이 같은데 왜 다를까?1단계 — 어떤 파일이 실제로 적용되는지 파악.default 파일은 nginx 설치 시 제공되는 예제 파일로, 실제 동작에 영향을 주지 않는다. 실제 적용 파일은 nginx.conf다.cat /etc/nginx/nginx.conf핵심 포인트: nginx.conf 안의 include 지시어로 어떤 파일을 추가로 불러오는지 확인해야 한다.2단계 — 현재 적용 중인 설정 전체 확인nginx가 실제로 읽고 있는 모든 설정을 한번에 출력하는 명령어다. 운영..

infra/Linux & Windows

journalctl 완벽 정리 — Rocky Linux 9 systemd 로그 관리

서버를 운영하다 보면 로그를 확인할 일이 정말 많습니다. Rocky Linux 9 (RHEL 8+) 부터는 기존 텍스트 파일 방식의 로그 대신 systemd-journald가 모든 로그를 통합 수집하고, journalctl 명령어로 조회합니다.이 포스트에서는 journalctl의 개념부터 실무에서 자주 쓰는 명령어, 용량 관리까지 한 번에 정리합니다.목차journalctl 이란?기존 로그 방식과 차이점Rocky 9에서 둘 다 쓰는 이유영구 저장 설정 (persistent)자주 쓰는 명령어 모음용량 관리설정 파일 정리1. journalctl 이란?한마디로 systemd의 통합 로그 뷰어입니다.예전 Linux (CentOS 6 이하)에서는 로그가 /var/log/messages, /var/log/secure..

infra/Linux & Windows

Rocky Linux 서버 로그 체크리스트 — 운영자가 꼭 알아야 할 명령어 모음

서버를 운영하다 보면 "누가 언제 접속했지?", "언제 재부팅됐지?", "이 에러는 어디서 확인하지?" 같은 상황을 자주 맞닥뜨리게 됩니다.이 포스트는 Rocky Linux 9 기준으로 서버 상태를 빠르게 파악할 수 있는 로그 확인 명령어들을 체크리스트 형식으로 정리한 글입니다. 인수인계 문서나 점검 루틴으로 바로 활용할 수 있도록 구성했습니다.목차최근 로그인 확인재부팅 / 셧다운 이력SSH 접속 로그/var/log/messages — 시스템 일반 로그/var/log/secure — 인증 / 보안 로그그 밖의 주요 로그주요 로그 파일 위치 요약1. 최근 로그인 확인last — 로그인 이력 전체 조회/var/log/wtmp 파일을 읽어 로그인·로그아웃 기록을 출력합니다. 접속 시간, 사용자 계정, IP 주..

infra

SFTP 속도 지연 이슈 — 서버 점검부터 전송 테스트까지 완전 정리

SFTP 속도 지연 이슈 — 서버 점검부터 전송 테스트까지 완전 정리배경APP 담당자로부터 서버 SFTP 사용 시 속도 지연 이슈 확인 요청이 들어왔다. 서버 자원부터 네트워크, 실제 전송 테스트까지 단계별로 확인한 내용을 정리한다.1단계 — 기본 서버 자원 확인가장 먼저 서버 과부하 여부를 확인한다. bash # CPU 사용률top# 메모리 사용량free -h# 디스크 용량df -h→ CPU / Memory / Disk 용량 모두 이상 없음 확인2단계 — 네트워크 인터페이스 확인 bash# NIC 상태 및 패킷 드롭/에러 확인ip -s link# NIC 실제 연결 속도 확인ethtool ens192 | grep -E 'Speed|Duplex'확인 포인트errors / dropped 값이 지속적으로 ..

infra/HCI or VMware

HCI 노드 장애 — HA가 동작하지 않았던 날의 기록

장애 인지평소처럼 업무를 보던 중 Zabbix SMS 알림이 동시다발적으로 쏟아졌다. ping failed 문자가 여러 건 연속으로 오는 건 심상치 않은 신호다. 확인해보니 6노드로 구성된 HCI 클러스터에서 노드 1개가 완전히 다운된 상태였다. 상황 파악HCI의 핵심 기능 중 하나가 HA(High Availability)다. 노드 장애 시 해당 노드에서 동작하던 VM들을 살아있는 노드로 자동 이전시켜 재기동해주는 기능이다.실제로 일부 VM은 HA가 정상 동작해 자동으로 재부팅되어 올라왔다. 그런데 용량이 큰 VM들은 올라오지 않았다.원인문제는 기존 노드들의 여유 자원이었다. 당시 클러스터 전체의 memory/disk 평균 사용률이 80% 수준이었다. HA가 동작하려면 장애 노드의 VM을 받아줄 여유 공..

infra/Linux & Windows

리눅스 서버 갑자기 재부팅? 원인 찾는 법 완전 정리

Linux 서버 갑자기 재부팅됐을 때 — 원인 찾는 법 완전 정리들어가며 (최근 리눅스버전 기반 명령어)서버가 갑자기 재부팅됐을 때 가장 먼저 드는 생각은 "왜 꺼진 거지?" 입니다. 이 글은 실제 장애 분석 경험을 바탕으로, 원인을 찾기 위해 확인해야 할 로그와 명령어를 순서대로 정리한 것입니다.1단계. 재부팅 시간부터 파악하기 bashlast rebootlast -x reboot shutdownwho -b재부팅이 언제 일어났는지 먼저 파악해야 어느 로그를 봐야 할지 알 수 있습니다.2단계. journald 로그 확인 bash# 이전 부팅 목록 확인journalctl --list-boots# 직전 부팅 에러만 보기journalctl -b -1 -p err# 직전 부팅 마지막 50줄 (종료 직전 상황..

infra

Storage 및 가상화 스토리지 개념

스토리지 및 가상화 스토리지개념 정리Storage & Virtualized Storage Concepts 1. 스토리지(Storage) 개요스토리지란 데이터를 영구적으로 저장하고 관리하는 장치 또는 시스템입니다. 서버, 네트워크, 클라우드 환경에서 핵심 인프라 구성 요소입니다. 1-1. 스토리지 기본 유형유형설명대표 장치DAS (Direct Attached Storage)서버에 직접 연결된 스토리지HDD, SSD, NVMeNAS (Network Attached Storage)네트워크를 통해 파일 단위로 공유NetApp, SynologySAN (Storage Area Network)전용 네트워크로 블록 단위 스토리지 제공FC-SAN, iSCSIObject Storage객체 단위로 저장, 대용량 비정형 데..

KT cloud Tech up/클라우드 인프라 과정

실무통합 프로젝트 개요 (자료조사)

아래 내용은 공개 자료·기술 트렌드·대규모 공공 트래픽 시스템의 일반적인 설계 패턴을 종합한 분석입니다.👉 코레일 내부의 정확한 아키텍처는 비공개이므로, **일부는 추론 기반(추측입니다)**이며, 확실하지 않은 부분은 명시합니다.🚄 코레일 명절 예매 시스템 – 인프라 관점 분석 1️⃣ 왜 코레일 명절 예매가 국내 최상위 난이도 트래픽인가수 분 내 수백만 세션일반적인 “동시 접속자 수”가 아니라👉 초당 수만~수십만 요청(Request Burst)사용자 행동 패턴이 거의 동일로그인 → 조회 → 좌석 선택 → 결제매크로/자동화 시도 비율이 매우 높음➡️ Traffic-Master 프로젝트의 “AI 매크로 vs AI 방패” 시나리오와 정확히 동일한 전장2️⃣ 코레일 명절 예매 인프라 – 전체 구조 (추론..

KT cloud Tech up/클라우드 인프라 과정

프로젝트 2차 (연학학습을 위한 멀티클라우드 장애 대응형 K8s 학습 플랫폼)

#담당업무 [팀원] 안XX - CI/CD 구현- ArgoCD, GitOps 등 인프라 코드 자동화 목표- AWS-AZure 멀티 클라우드 쿠버네티스에 대한 이해 (EKS,AKS 등) 🚀 "연합학습을 위한 멀티 클라우드 장애 대응형 Kubernetes 학습 플랫폼" 프로젝트 개요 AWS(EKS + Kapenter + Spot instance) 에서 학습과 가중치 계산을 수행하고, Azure에는 중앙 노드와 체크포인트(blob storage)를 유지하여 장애 발생 시 즉시 학습을 재개할 수 있도록 설계한 연합학습 전용 멀티 클라우드 Kubernetes 플랫폼 #Project Background 1. AI 인프라 비용 효율화 (FinOps)배경 (Background)대규모 AI 모델 학습 시 GPU 컴..