AI가 코드를 다 짠다고?
그래서 우리가 할 일이 더 많아졌다.
매일 10분, AI·웹앱·블록체인·인프라 생존 지식을 한 편씩. 불안을 누적 학습으로 바꾸는 공부방.
오늘 글 읽기오늘 도착한 3편을 다 읽으면 +5%. 안 읽으면… 알지?
Prometheus도 디스크가 꽉 차면 장애 원인이 된다: 쿼리 추적 파일로 보는 관측 시스템 운영
Prometheus 3.13.2의 active query tracker 디스크 full SIGBUS 수정 사례를 바탕으로, 관측 시스템을 단일 노드 시계열 데이터베이스로 보고 디스크 예산, 쿼리 제한, cardinality, 장애 대응 runbook을 운영하는 방법을 정리한다.
사이드카는 왜 보조 컨테이너가 아니라 Pod 생명주기 계약일까
Kubernetes v1.33에서 stable이 된 native sidecar를 바탕으로 sidecar를 단순 보조 컨테이너가 아니라 앱과 운영 파이프라인 사이의 시작 순서, readiness, 종료 순서, 로그 flush, 리소스 비용 계약으로 설계하는 방법을 정리한다.
CloudNativePG 1.30은 왜 DB 운영을 Kubernetes 리소스 계약으로 바꿀까
CloudNativePG 1.30.0의 DatabaseRole CRD, Kubernetes Lease 기반 primary election, instance manager 인증과 search_path/password 보안 패치를 바탕으로 PostgreSQL 운영 자동화를 권한·장애·네트워크 경계가 분리된 Kubernetes 리소스 계약으로 설계하는 법을 정리한다.
HPA는 왜 CPU보다 큐 깊이를 봐야 할까: Kubernetes custom metrics로 배우는 백프레셔 오토스케일링
Kubernetes custom metrics exporter와 HPA 문서, Prometheus Adapter를 바탕으로 CPU 기반 오토스케일링의 한계를 짚고 queue depth·consumer lag·처리율·metric freshness를 백프레셔 제어 루프로 설계하는 방법을 정리한다.
etcd 패치 업데이트는 왜 “버전 올리기”가 아니라 컨트롤 플레인 노출면 점검일까
etcd v3.7.1, v3.6.14, v3.5.33 패치 릴리스를 바탕으로 Kubernetes control plane의 watch 권한 경계, TLS handshake DoS 노출면, network reachability, snapshot·compaction·defrag maintenance를 작은 팀의 운영 체크리스트로 정리한다.
PostgreSQL 18 논리 복제는 왜 “복사 파이프”가 아니라 WAL 보존 계약일까
PostgreSQL 18의 논리 복제 개선을 바탕으로 replication slot이 WAL을 붙잡는 원리, idle_replication_slot_timeout의 checkpoint 기반 invalidation, generated column publication, conflict counter 관측성을 작은 팀의 CDC·마이그레이션 운영 체크리스트로 정리한다.
Docker Content Trust 종료는 왜 “서명 도구 교체”가 아니라 배포 정책 마이그레이션일까
Docker Content Trust와 Notary v1 종료 일정을 바탕으로, 컨테이너 이미지 신뢰를 tag 기반 검증이 아니라 digest pinning, Cosign/Notation 서명, Kyverno/Ratify admission enforcement로 재설계하는 방법을 정리한다.
멀티 리전 서버리스는 왜 “두 군데 배포”가 아니라 헬스 계약일까: Cloud Run service health로 보는 자동 failover
Cloud Run multi-region service health 업데이트를 바탕으로, 서버리스 고가용성을 단순한 다중 리전 배포가 아니라 readiness probe, 리전별 service health, serverless NEG, Application Load Balancer가 함께 만드는 트래픽 수락 계약으로 해석한다.
대AI 시대 개발자 생존 공부방 · 매일 10분 · status: alive