인기 검색

Failure Analysis Engineer
공고 요약
담당업무
서버 및 데이터센터 플랫폼의 시스템·랙 수준 장애 분석과 증상 확인부터 근본 원인 규명 및 해결까지 전 과정 수행
CPU, GPU, 메모리, PCIe, 네트워킹, 전원·열 시스템, 펌웨어 상호작용 관련 하드웨어 및 플랫폼 이슈 디버깅
시스템 로그, 플랫폼 텔레메트리, BIOS, BMC 등 진단 데이터 분석과 장애 패턴 식별
실험실 환경에서 장애 재현, 진단 도구와 방법론을 활용한 수정 사항 검증
설계, 펌웨어, 검증, 제조, 품질, 인프라 팀 및 ODM 파트너와 협업해 시정 조치와 플랫폼 성능 개선
기술 문서, 트러블슈팅 가이드, SOP, 디버그 방법론 및 지식 공유 자료 개발·관리
신뢰성, 서비스성, 제조성 및 운영 준비도 향상을 위한 근본 원인 분석과 지속 개선
AI 지원 도구, 자동화, 지식 시스템을 활용한 트러블슈팅 효율 및 엔지니어링 모범 사례 확장
데이터 기반 분석 결과와 권고사항을 관련 엔지니어링·협업 조직에 전달하고 이해관계자 기대치 관리
자격요건 및 우대 경험
시스템·서버·랙 수준 트러블슈팅 및 장애 분석 경험
하드웨어 디버깅, 근본 원인 분석 및 복합 이슈 해결 경험
Linux 기반 환경, 플랫폼 로그 및 진단 워크플로 이해
서버, 데이터센터, 네트워킹, 스토리지 또는 엔터프라이즈 하드웨어 플랫폼 경험
BIOS, BMC, IPMI, 펌웨어 상호작용 또는 플랫폼 관리 기술 경험
네트워킹 기술, 신호 무결성, 전원 공급 또는 고속 인터페이스 이해
제조, ODM, 검증, 품질 또는 설계 팀과의 협업 경험
기술 문서, SOP, 트러블슈팅 가이드 및 지식 공유 자료 작성 능력
실험실 디버깅 장비와 시스템 진단 도구 활용 경험
AI 도구, AI 에이전트, 자동화 또는 지식 시스템 활용 경험
제조·검증·배포 지원을 위한 간헐적 출장 가능
근무환경
온사이트 근무
마감기한
상시채용
AMD 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요
공고 원문
댓글
AMD에 맞는
이력서로 자동 수정하기