인기 검색

Staff, Site Reliability Engineer (Tech Infra)
공고 요약
담당업무
고객 대상 서비스의 안정성·상태·성능 책임
시스템 가용성·성능·안정성 KPI 및 SLO 정의·관리
Incident Management 프로세스와 자동화 구축
모니터링·알림·텔레메트리 시스템 구축 및 운영
Disaster Recovery 테스트 및 Load Testing 자동화
확장성과 운영 용이성을 고려한 제품 설계 협업
프로덕션 배포 가드레일 및 자동화 구축
24x7 온콜 로테이션 및 운영 장애 대응
조직 내 다양한 레벨과의 커뮤니케이션
자격요건
대규모 분산 시스템 구축 및 운영 경험
UNIX/Linux 시스템 이해 및 운영 경험
Python, Java, Golang, Ruby 중 하나 이상 프로그래밍 역량
시스템·네트워크(TCP/IP)·코드 전반의 문제 해결 및 분석 능력
AWS, Azure, Google Cloud Platform 등 클라우드 인프라 경험
CI/CD, IaC 등 DevOps 및 SRE 실무 이해
Docker, Kubernetes 등 컨테이너·오케스트레이션 기술 경험
다양한 조직 및 기술 영역 간 협업·커뮤니케이션 역량
Prometheus, Grafana, Elastic Stack, Datadog, New Relic 등 Observability 도구 경험
우대사항
Terraform 사용 경험
컴퓨터공학·엔지니어링 또는 관련 분야 학사 학위
대규모 웹 기반 Java 아키텍처 및 JVM 설정 경험
클라우드·모니터링 등 관련 기술 자격증
대규모 이커머스 플랫폼 경험
전형절차
서류전형: 영문이력서 제출
화상기술면접 1차
화상기술면접 2차
최종 합격
근무환경
운영을 엔지니어링 문제로 해결하는 자동화 우선 접근
제품 개발 초기부터 운영 이슈 해결까지 개발 조직과 긴밀한 협업
SLI/SLA 기준 유지 및 SRE 원칙·베스트 프랙티스 확산
고가용성·최첨단 기술·초연결 환경
마감기한
채용시 마감
쿠팡 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요