Recruitment background

LLM 서빙 및 추론 최적화 엔지니어 채용

카카오뱅크|2026. 8. 27. 게시|
5

공고 요약

경력2년 이상
채용 유형정규직
학력무관
지역경기
마감일마감
출처캐치

담당업무

  • LLM 추론 서비스 개발 및 운영

  • LLM 구조·서빙 워크로드·GPU 특성 프로파일링 및 병목 분석

  • 서비스 요구사항에 맞춘 LLM 추론 시스템 설계·구현

  • 추론 성능 및 GPU 자원 사용 현황 모니터링

  • 모델·엔진 변경 전후 회귀 테스트를 통한 문제 조기 발견

  • Kubernetes 환경 추론 시스템 배포·운영

  • 트래픽 변화에 따른 요청 및 GPU 자원 효율적 배분

  • vLLM·SGLang 기반 추론 서버 구현·구성·튜닝

  • 모델 압축, KV 캐시 최적화, 요청 스케줄링, 다중 GPU 분산 추론 적용

  • 추론 성능 개선 및 모델 품질 저하 여부 검증

  • Speculative Decoding, Prefill/Decode Disaggregation, Expert Parallelism 기법 검토·구현·검증

자격요건

  • LLM 서빙 또는 추론 최적화 분야 실무 경험

  • 최신 LLM 구조 및 추론 과정 이해

  • 모델·워크로드 특성에 따른 성능 병목 분석 및 최적화 방향 수립 역량

  • vLLM, SGLang, TensorRT-LLM, TGI 중 하나 이상 실무 사용 경험

  • 추론 엔진 내부 코드 분석·수정 및 워크로드 맞춤 튜닝 경험

  • Python 능숙한 사용 및 추론 엔진 최적화 기능 직접 구현·검증 역량

  • 모델 압축 또는 KV 캐시 최적화 경험

  • 요청 스케줄링·다중 GPU 분산 추론 등 서빙 시스템 최적화 경험

  • Speculative Decoding, Prefill/Decode Disaggregation, Expert Parallelism 등 고급 추론·서빙 최적화 경험

우대사항

  • CUDA, Triton, TileLang 기반 GPU 커널 구현·튜닝 경험

  • 다중 GPU 환경 LLM 분산 서빙 및 GPU 간 통신 비용·부하 불균형 개선 경험

  • MoE·긴 문맥·멀티모달 모델 서빙 및 메모리·연산 병목 해결 경험

  • LLM·NLP 분야 논문 발표 경험

  • 추론 엔진·프레임워크 오픈소스 기여 경험

  • Kubernetes 환경 대규모 LLM 추론 서비스 배포·운영 경험

  • 플랫폼팀과의 협업 경험

  • 금융 등 규제 산업의 보안·규제 요건을 시스템 설계·운영에 반영한 경험

  • 국가유공자 및 장애인 등 취업보호대상자 우대

전형절차

  1. 서류전형

  2. 과제전형

  3. 1차 실무진 면접전형

  4. 1차 면접 전 컬처핏 프로파일 검사

  5. 2차 경영진 면접전형

  6. 연봉 및 처우 협의

  7. 최종합격

  8. 경영진 면접 이후 레퍼런스 체크 진행 가능

  9. 서류전형 결과 개별 안내

접수방법

  • 본사 홈페이지 지원

마감기한

2026년 8월 31일 23:59까지

공고 원문

카카오뱅크 LLM 서빙 및 추론 최적화 엔지니어 채용 채용공고

이런 공고는 어때요?

펄크럼테크놀로지스

펄크럼테크놀로지스

3년~20년 · 정규직 · 서울

Product Engineer#이커머스  #AIAgent  #원격근무
상시
그룹바이그룹바이
155
메크랩

메크랩

3년~10년 · 정규직 · 서울

시뮬레이션 특화 LLM 고도화#LLM고도화  #인공지능  #재택가능
상시
그룹바이그룹바이
149
모다플

모다플

3년~10년 · 정규직 · 서울

머신러닝 엔지니어(3년이상)#머신러닝모델  #모빌리티  #MLOps
상시
그룹바이그룹바이
51
일레븐

일레븐

3년~10년 · 정규직 · 경기

LLM/AI 엔지니어 (LLM/AI Engineer) 채용#LLM인퍼런스  #AI인프라
상시
그룹바이그룹바이
144
폴라펄스

폴라펄스

10년 이하 · 계약직 · 서울

AI Engineer On-premise Graph RAG 엔진 개발자 (Neo4j 기반)#RAG구축  #프로젝트보상  #금융AI
상시
그룹바이그룹바이
186
포밸류소프트

포밸류소프트

7년~20년 · 정규직 · 경기

금융권 AI 전환을 함께할 개발자 채용 (경력 채용)#AI에이전트개발  #핀테크
상시
그룹바이그룹바이
17
스텝에이아이

스텝에이아이

20년 이하 · 정규직 · 서울

[팀 스케일업] AI 풀스택 개발자 (LLM 파이프라인 · 대규모 데이터 수집)#B2BAI  #대용량데이터  #LLM파이프라인
상시
그룹바이그룹바이
133
텔어스

텔어스

20년 이하 · 정규직 · 서울

AI Research Engineer - Agents & Workflows#AI에이전트  #제조업AI  #재택가능
상시
그룹바이그룹바이
41
휴멜로

휴멜로

3년~8년 · 정규직 · 서울

[R&D] AI Research Engineer, Conversational TTS#실시간스트리밍  #음성합성  #TTS아키텍처
상시
그룹바이그룹바이
70
vox.ai

vox.ai

1년~9년 · 정규직 · 서울

Voice Agent Backend Engineer#LLM운영  #백엔드설계  #음성에이전트
상시
그룹바이그룹바이
182
엘리스그룹

엘리스그룹

6년 이하 · 정규직 · 서울

AI Engineer (Platform)#B2BSaaS  #RAG  #LLM
상시
그룹바이그룹바이
180
딥아이

딥아이

20년 이하 · 정규직 · 부산

[딥아이] LLM엔지니어#MLOps  #비파괴검사  #LLM파인튜닝
상시
그룹바이그룹바이
32
주미당

주미당

8년~20년 · 정규직 · 서울

[주미당] Flavor AI의 다음 장을 함께 설계할 CTO#AI페어링  #AINative  #기술아키텍처
상시
그룹바이그룹바이
40
콕스웨이브

콕스웨이브

3년~7년 · 정규직 · 서울

[AX AgentX] 데이터 엔지니어(RAG/LLM Pipeline)#LLMOps  #ETL파이프라인  #AI솔루션
상시
그룹바이그룹바이
42
페이스웹

페이스웹

20년 이하 · 체험형인턴 · 서울

[FACEWEB] 의료 SLM/LLM 엔지니어: Fine-tuning·STT·RAG•경량화#파인튜닝  #의료
상시
그룹바이그룹바이
181
메디콜

메디콜

20년 이하 · 정규직 · 서울

[메디콜] Software Engineer #AI음성처리  #치과  #LLM통합
상시
그룹바이그룹바이
121
디피플래닝

디피플래닝

20년 이하 · 정규직 · 서울

디피플래닝 AI 서비스 개발자 (팀장급) 모집#AIAgent  #RAG  #마케팅자동화
상시
그룹바이그룹바이
20
에이아이카데미

에이아이카데미

20년 이하 · 정규직 · 광주

Junior LLM Application & AI Agent Engineer 채용#RAG구현  #에듀테크
상시
그룹바이그룹바이
25
매버릭스

매버릭스

3년~5년 · 정규직 · 서울

커머스를 혁신할 4번째 팀원을 찾습니다(Product Engineer)#LLM기술적용  #NextJS  #커머스
상시
그룹바이그룹바이
97
오믈렛

오믈렛

5년~20년 · 정규직 · 서울

AI 제품 엔지니어 (AI Product Engineer)#AI에이전트  #백엔드설계  #RAG
상시
그룹바이그룹바이
61