
Rebellions NPU Runtime Software Engineer 채용
공고 요약
주요업무
RBLN SDK를 통한 ML 모델 배포를 위한 런타임 모듈 설계 및 구현
네이티브 PyTorch 실행 지원 아키텍처 설계 및 유지보수
사용자용 성능 분석 프로파일러 설계 및 구현
NPU 추론 성능 향상을 위한 vLLM 개발 및 확장
멀티 NPU 환경에서의 분산 추론 설계 및 최적화
런타임 시스템 성능 벤치마킹 및 최적화 수행
ML 엔지니어 및 인프라 팀과 협업하여 추론 서비스 확장
자격요건
C++ 및 Python 숙련도
딥러닝 기초 및 LLM 아키텍처에 대한 깊은 이해
vLLM, TensorRT-LLM 등 LLM 서빙 프레임워크 실무 경험
모델 최적화 기술(텐서 병렬화, KV 캐시 최적화 등)에 대한 이해
컴파일러, 런타임, 드라이버 등 시스템 소프트웨어 구성 요소에 대한 지식
GPU, NPU 등 하드웨어 가속기 및 메모리 관리 기술 이해
고처리량 추론 환경에서의 디버깅 및 성능 프로파일링 역량
원활한 기술 협업 및 커뮤니케이션 능력
우대사항
AI 가속기 런타임 및 드라이버 API 실무 경험
PyTorch, vLLM, SGLang 등 ML 프레임워크 및 서빙 시스템 기여 경험
torch.compile 및 그래프 최적화에 대한 이해
운영체제, 리소스 관리 및 고성능 컴퓨팅(HPC) 개념 이해
고성능 시스템 개발을 위한 현대적 C++ 숙련도
멀티스레딩 및 병렬 프로그래밍 경험
분산 환경에서의 LLM 배포 경험
전형절차
서류전형
온라인 인터뷰
온사이트 인터뷰 (과제 포함)
컬처핏 인터뷰
처우 협의
최종 합격
참고사항
지원서 내용이 사실과 다를 경우 합격 취소 가능
법령상 자격 미달 시 채용 제한 가능
보훈 대상자 및 장애인 차별 없음
경력 및 경험에 따라 담당 업무 범위 변경 가능
마감기한
채용시 마감
리벨리온 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요