hello

Homelab) 클러스터 노드 검토

Share
CPU RAM Disk Network OS Single Core Multi Core IO Rnd RO IO Rnd RW IO Seq RO IO Seq RW
AMD 7960x DDR5 128GB 2TB 10G ubuntu 22.04 2254.19 56078.18 12985.32 22.52 13492.85 263.66
AMD 5950x DDR4 128GB 2TB 1G ubuntu 22.04 1698.87 29841.54 19729.73 75.65 20682.53 131.14
AMD 7940hs DDR5 32GB 2TB 1G ubuntu 22.04 2409.24 20019.26 44862.48 148.61 52492.47 309.91
AMD 7840hs (VM) DDR5 48GB 1TB 2.5G ubuntu 22.04 1619.88 16899.34 38231.69 74.40 42129.76 117.64
AMD 7735hs (VM) DDR4 48GB 1TB 2.5G ubuntu 22.04 2042.24 16358.30 33632.35 6.13 35596.01 7.20
AMD 5560u DDR4 64GB 2TB 1G ubuntu 22.04 1791.04 10725.99 26079.66 5.00 28216.79 7.52
AMD 5825u DDR4 64GB 2TB 2.5G ubuntu 22.04 1935.60 11976.88 28427.89 140.23 31994.37 304.55
AMD 5625u DDR4 64GB 1TB 1G ubuntu 22.04 1897.67 11295.37 30822.69 25.98 36217.74 25.34

클러스터 노드로 사용할 장비들의 성능을 측정.

검토

7840hs, 7735hs는 VM이기 때문에 disk 성능이 문제가 됨. worker node로만

5825u는 4개의 RAID HDD가 구성되며 2.5G 인터페이스가 2개. storage class로 적합

7960x는 GPU가 달린 Workstatoin으로 ECC메모리, 10G Network가 강점

그외 PC들은 모두 미니 PC, 중국 제품으로 안정성이 다소 걱정이 됨

계획

Control Plane (3 노드 고가용성)

호스트 역할 설명
7960x Master + etcd (리더) 강력한 CPU, ECC 메모리, 10G NIC — 메인 제어 노드로 이상적
7940hs Master + etcd 싱글코어 성능 우수, RAM은 32GB지만 충분함
5825u Master + etcd 2.5G NIC ×2로 통신 안정적, etcd 안정성 확보
모든 Master 노드는 taint를 걸어 워커 역할 제외 (단, 필요시 해제 가능)
etcd 3노드 분산 구성으로 장애 복원력 확보

Worker Nodes

호스트 설명
7735hs (VM) VM이므로 IO는 약하지만 CPU/메모리는 충분 — 일반 workload에 적합
7840hs (VM) 위와 동일, 일부 웹 서비스 또는 비 IO집약적 파드 할당
5560u 미니PC지만 나쁘지 않은 CPU와 RAM. 엣지나 라이트 workload 배정
5625u 5560u와 유사. 일부 CI/테스트 파드 배정 등 적절
5950x CPU, RAM 모두 여유 — 성능 높은 워커 노드로 활용 (단 1G NIC 주의)

Storage Node / Provisioner

호스트 역할 설명
5825u + StorageClass RAID HDD 구성, 별도 local-path 또는 NFS 기반 스토리지로 사용 가능
PVC를 위한 StorageClass 구성 시 이 노드 지정 (nodeAffinity)
또는 로컬볼륨 기반으로 RWX 불가능하지만 속도 보장

네트워크 토폴로지

  • 모든 컨트롤 플레인 및 주요 워커는 최소 2.5G 이상 인터페이스 사용 검토
  • 10G NIC 장비는 다른 노드와 별도 연결 또는 스위치로 연결
  • kube-vip or keepalived로 VIP 구성하여 고가용성 API endpoint 제공
  • 클러스터 DNS, Ingress, Metrics Server는 마스터 제외 노드에 배포

요약 구성

역할 장비
Master 노드 7960x, 7940hs, 5825u
etcd 3노드 동일 (7960x, 7940hs, 5825u)
워커 노드 5950x, 5560u, 5625u, 7840hs (VM), 7735hs (VM)
스토리지 5825u (RAID HDD 기반 StorageClass)

기타

  • 각 노드에 node-label 잘 설정해서 workload routing 정교하게
  • VM 노드는 부하 낮은 서비스 (UI, test, CI 등)에 배정
  • Prometheus/Grafana는 VM 아닌 노드에 설치 (IO 때문)

Read more

LLM 시대, 프롬프트 엔지니어링보다 '도메인 전문성'이 더 강력한 무기인 이유

최근 AI 도구들이 비약적으로 발전하면서 '프롬프트 엔지니어링'이라는 기술적 기법에 많은 관심이 쏠렸습니다. 하지만 실제 현업에서 LLM을 극한으로 활용해 고도의 결과물을 만들어내는 사람들의 공통점은 정교한 프롬프트 템플릿을 쓰는 능력이 아니라, 해당 분야에 대한 깊은 '도메인 전문성'을 갖추고 있다는 점입니다. 많은 이들이 LLM이 지식의 격차를 줄여준다고

By JHL

AI 코딩 에이전트 도입 시 고려해야 할 보안 제어 프레임워크: 속도와 안전의 균형 잡기

최근 Claude Code나 Kiro와 같은 AI 코딩 에이전트들이 단순한 코드 완성을 넘어, 자연어 프롬프트 하나로 수십 개의 PR을 생성하고 인프라를 수정하는 수준까지 발전했습니다. 하지만 이러한 생산성 향상은 '기계적 속도'라는 트레이드오프를 동반합니다. AI 에이전트는 조직의 보안 리스크나 컴플라이언스를 이해하지 못한 채 오직 '작업 완료'에만 최적화되어

By JHL

AI 벤치마크의 '포화 상태'와 평가 지표의 유효기간: 우리는 무엇을 믿어야 하는가

최근 LLM의 성능이 비약적으로 상승하면서, 역설적으로 우리가 모델의 성능을 측정하는 '자' 자체가 무용지물이 되는 현상이 가속화되고 있습니다. arXiv에 게재된 "When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation" 연구는 우리가 흔히 신뢰하는 벤치마크 점수가 왜 더 이상 모델 간의 변별력을 제공하지 못하는지, 그리고 이른바 '

By JHL

AI 에이전트 시대의 엔드포인트 보안: 실행 권한을 넘어 '행위 거버넌스'로

DevOps.com을 통해 Airlock Digital이 발표한 'Agentic AI Control & Governance' 솔루션 소식을 접했습니다. 이번 발표의 핵심은 단순히 '어떤 AI 소프트웨어를 실행할 것인가'라는 기존의 화이트리스트 방식(Application Control)을 넘어, 실행 중인 AI 에이전트가 '실제로 어떤 명령을 내리고 어떻게 행동하는가'를 실시간으로 제어하겠다는

By JHL