
Senior Machine Learning Engineer, Jockey Core
공고 요약
담당업무
Jockey Core 서빙 엔지니어링 리드
엔진 선택에서 생산 규모 확장까지 관리
벤치마크 및 로드 테스트 구축
실제 트래픽 재현 및 TTFT·토큰 간 대기시간 측정
비용 모델 구축 및 생산 견고화(오토스케일링, 가용성, 장애 대응)
설계 리뷰를 통한 모델 효율성 향상 및 실질적 서빙 개선
AI 보조 개발 도구 활용(Claude, Gemini, GPT)으로 생산성 향상
자격요건
대규모 LLM 추론 서비스 운영 및 최적화 경험
vLLM, TensorRT-LLM, SGLang 등 유사 기술 활용 경험
배치/스케줄링, 양자화, disaggregated prefill/decode, 추론 가설 구동 경험
대규모 분산 시스템 설계·운영, 고성능 GPU 환경 경험
측정 기반의 latency/throughput/cost 의사결정 능력
관측성(SLO/로그/지표) 구축 및 장애 대응 경력
강력한 커뮤니케이션 역량
우대사항
LLM 추론 서버 내부 커스터마이징 참여 경험
압축 모델(pruned/quantized) 서빙 특성 이해
다지역/다클러스터 서빙 인프라 설계 경험
GPU 용량 계획 및 대규모 서비스 운영 경험
Machine Learning/Computer Science 관련 석사/박사 학위 우대
복리후생
하이브리드 근무제
최신 맥북 및 재택근무 장비 지원
3년 주기로 장비 교체
토큰 무제한 사용 지원
연 140만원 상당 자기개발비
영어 교육 프로그램 및 글로벌 버디 프로그램
야간·주말 출퇴근 택시비 지원
식비·교통비 등 법인카드 혜택
사무실 스낵바 운영
건강검진 및 단체보험(제공 중 한 가지 선택)
독감 예방접종비 지원
연말 2주간 휴가(Holiday Break)
근무환경
근무형태: 하이브리드
근무지: 서울, 남산권 인근
부서: TechML Engineering
마감기한
상시채용
트웰브랩스 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요