인기 검색

Sr. Director of Engineering, Data Center Infrastructure
공고 요약
담당업무
AI·HPC 데이터센터의 종단간 인프라 전략 수립, 컴퓨팅 아키텍처·시설 요건·운영 모델·확장 계획 정의
수천 대 서버와 가속기를 포함한 대규모 데이터센터 환경의 아키텍처 및 구축 결정 주도
전력 분배, 냉각, 공간 활용, 용량 예측, 운영 준비 계획 및 성능·효율·신뢰성·총소유비용 최적화
실리콘, 서버, 랙 단위 시스템부터 데이터센터 전체에 이르는 시스템 아키텍처 결정과 확장형 인프라 표준 수립
하드웨어·소프트웨어·네트워킹·시스템 설계·플랫폼 엔지니어링 조직과 협업하고 기계·전기·열·펌웨어·소프트웨어 영역의 기술 검토 주도
AI 학습·추론 클러스터의 설계, 배포 및 전 생애주기 관리
SRE 원칙, 관측성 체계, 사고 관리, 용량 계획, 자동화 및 서비스 수준 목표 수립을 통한 운영 안정성 향상
가용성·복원력·성능·비용 최적화를 위한 지속적인 개선 추진
AI·HPC 환경의 네트워크 토폴로지, 고속 패브릭, 스위칭·라우팅 및 가속기 인터커넥트 아키텍처 수립·최적화
소프트웨어 정의 네트워킹, 네트워크 자동화·관측성 도입 및 차세대 네트워킹 기술 평가
50~75명 규모의 엔지니어·아키텍트·기술 리더 조직을 이끌고 멘토링 및 육성
조직 전략, 승계 계획, 인재 개발·채용 계획 수립 및 고성과 엔지니어링 문화 조성
경영진에 AI 인프라 전략·투자 우선순위·산업 동향을 자문하고 고객, 시스템 통합업체, 기술 파트너 및 공급업체와 협업
필요 역량 및 경험
대규모 데이터센터 환경의 설계·구축·운영 경험
대규모 다분야 엔지니어링 조직을 이끈 경험과 기술·사업 목표를 연결하는 역량
AI, 클라우드, 하이퍼스케일, HPC 또는 엔터프라이즈 데이터센터 인프라의 구축·확장 경험
데이터센터 아키텍처, 전력 공급, 열 관리, 용량 계획 및 시설 운영 지식
AI 인프라, 서버 아키텍처, 가속기 기반 컴퓨팅 플랫폼 및 랙 단위 시스템 설계 지식
스위칭, 라우팅, Ethernet 패브릭, RDMA, InfiniBand 및 차세대 인터커넥트 기반 고성능 데이터센터 네트워크 설계 전문성
컴퓨팅 클러스터 배포·수명주기 관리 및 대규모 분산 시스템 운영 경험
SRE, IaC, 자동화 프레임워크, 모니터링, 관측성 및 운영 모범 사례에 대한 이해
기술 전환과 빠른 성장 과정에서 기술 조직을 이끈 경험
하드웨어·소프트웨어·네트워킹·인프라 조직 간 로드맵 조율 및 임원·고객·외부 파트너와의 전략적 소통 역량
마감기한
상시채용
AMD 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요
공고 원문
댓글
AMD에 맞는
이력서로 자동 수정하기