
Cloud Platform Engineer
공고 요약
담당업무
베어메탈, 가상머신(VM), 컨테이너 리소스를 내부 팀에 제공하는 쿠버네티스 기반 사내 개발자 플랫폼(IDP) 설계, 구축 및 운영
백엔드 API(Python / Rust), 지속성 워크플로우, 데이터베이스, 프론트엔드(TypeScript / React)를 아우르는 엔드투엔드 플랫폼 서비스 개발 및 유지보수
Prometheus, VictoriaMetrics, Loki, Grafana를 통한 플랫폼 전반의 관측 가능성(Observability) 확보
클러스터 운영, 고속 RDMA 네트워킹(RoCE, SR-IOV), PCI 패스스루 디바이스 할당, 동적 볼륨 프로비저닝을 포함한 쿠버네티스 컴퓨트 리소스 관리 및 최적화
IaC(Terraform, Ansible, Helm) 및 GitOps 기반 워크플로우를 통한 인프라 자동화 및 내부 인프라 자산 관리를 위한 CMDB 서비스 구축
내부 서비스 카탈로그 유지보수 및 CI/CD 파이프라인을 위한 빌드/테스트 리소스 제공을 통한 소프트웨어 개발 수명 주기 지원
플랫폼을 하나의 제품으로 대하며 내부 팀의 요구사항을 공통 솔루션으로 추상화하고 자동화 및 반복 개선을 통해 개발자 경험 지속 향상
자격요건
머신러닝 추론 및 PyTorch 워크플로우에 대한 실무적 이해와 복잡한 의존성을 가진 시스템 디버깅 능력
Python, Rust, Go, JS/TS 중 하나 이상을 활용하여 요구사항을 소프트웨어로 구현하고 서비스를 엔드투엔드로 구축한 경험
클러스터 구축, 운영, 워크로드, 네트워크 및 스토리지 트러블슈팅을 포함한 쿠버네티스 운영 경험
근본 원인을 추적하고 자동화를 통해 반복적인 수작업을 제거하는 실용적인 문제 해결 능력
빠르게 변화하는 환경에서 하드웨어, 펌웨어, 애플리케이션 팀과 협업할 수 있는 명확한 커뮤니케이션 역량
우대사항
쿠버네티스 상에서의 가상화 및 가속기 스케줄링 경험 (KubeVirt, DevicePlugin, DRA)
커널, 드라이버, 네트워크 디버깅 및 가상화(KVM/QEMU/libvirt)를 포함한 리눅스 시스템 엔지니어링 경험
RDMA/RoCE/SR-IOV 또는 PCIe/NUMA/IOMMU를 활용한 고속 네트워킹 경험
LLM 추론 프레임워크(예: vLLM) 또는 GPU/NPU 가속기 플랫폼 활용 경험
Ansible, Helm, Terraform 등 IaC 도구 활용 경험
사내 개발자 플랫폼(IDP) 또는 셀프 서비스 포털 구축 경험
Metal3 또는 Ironic을 이용한 베어메탈 프로비저닝 경험
전형절차
서류전형
온라인 인터뷰
온사이트 인터뷰 (과제 포함)
컬처핏 인터뷰
처우 협의
최종 합격
참고사항
본 공고는 모집 완료 시 조기 마감될 수 있습니다
지원서 내용 중 허위사실이 있는 경우에는 합격이 취소될 수 있습니다
채용 및 업무 수행과 관련하여 요구되는 법령 상 자격이 갖추어지지 않은 경우 채용이 제한될 수 있습니다
보훈 대상자 및 장애인 여부는 채용 과정에서 어떠한 불이익도 미치지 않습니다
담당 업무 범위는 후보자의 전반적인 경력과 경험 등 제반사정을 고려하여 변경될 수 있으며, 변경 필요 시 최종 합격 통지 전 후보자와 소통할 예정입니다
마감기한
채용시 마감
리벨리온 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요