추천 검색

LLM Optimization Engineer
공고 요약
주요업무
LLM(Quantization, Pruning, Distillation)
LLM 추론 최적화(llama.cpp, KV caching, Kernel fusion)
Domain-specific LLM 및 SLM 개발
자격요건
관련 분야 석사 학위 또는 2년 이상 경력 보유
우대사항
특정 딥러닝 가속기(e.g., GPUs, NPUs, FPGAs)에서 경량화/최적화 경험
관련 분야 논문 보유자(국제 학회 또는 SCI/SCIE 저널)
영어 회화 가능(외국인과 업무 소통 가능)
근무환경
고용형태: 정규직
병역특례 가능
근무 시간: 자율출퇴근제(10시 이전 출근, 10시부터 집중 근무, 주 40시간)
전형절차
서류 심사 1차(이력서 및 포트폴리오 필수)
서류 심사 2차(설문 응답)
기술 인터뷰(On-line 또는 Off-line)
최종 인터뷰 및 연봉협상
공고 원문
업무소개
• LLM 경량화(Quantization, Pruning, Distillation) • LLM 추론 최적화(llama.cpp, KV caching, Kernel fusion) • Domain-specific LLM 및 sLM 개발
업무내용
주요업무 • LLM 경량화(Quantization, Pruning, Distillation) • LLM 추론 최적화(llama.cpp, KV caching, Kernel fusion) • Domain-specific LLM 및 sLM 개발 자격요건 • 관련 분야 석사 학위 혹은 2년 이상 경력 보유 우대사항 • 특정 딥러닝 가속기(e.g., GPUs, NPUs, FPGAs)에서 경량화/최적화 경험 • 관련 분야 논문 보유자 (국제 학회 또는 SCI/SCIE 저널) • 영어 회화 가능 (외국인과 업무 소통 가능) 근무조건 • 근무 형태: 정규직, 병역특례 가능 • 근무 시간: 자율출퇴근제 (10시 이전 출근 & 10시부터 집중 근무, 주 40시간 근무) • 근무지역: 서울특별시 강서구 마곡동로 55마커스빌딩 1102호 채용 전형 Step-1: 서류 심사 1차(이력서 및 포트폴리오 필수) Step-2: 서류 심사 2차(설문 응답) Step-3: 기술 인터뷰(On-line 혹은 Off-line) Step-4: 최종 인터뷰 및 연봉협상
이런 공고는 어때요?

펄크럼테크놀로지스
3년~20년 · 정규직 · 서울

메크랩
3년~10년 · 정규직 · 서울

모다플
3년~10년 · 정규직 · 서울

일레븐
3년~10년 · 정규직 · 경기

폴라펄스
10년 이하 · 계약직 · 서울

포밸류소프트
7년~20년 · 정규직 · 경기

스텝에이아이
20년 이하 · 정규직 · 서울

텔어스
20년 이하 · 정규직 · 서울

휴멜로
3년~8년 · 정규직 · 서울

vox.ai
1년~9년 · 정규직 · 서울

엘리스그룹
6년 이하 · 정규직 · 서울

딥아이
20년 이하 · 정규직 · 부산

주미당
8년~20년 · 정규직 · 서울

콕스웨이브
3년~7년 · 정규직 · 서울

페이스웹
20년 이하 · 체험형인턴 · 서울

메디콜
20년 이하 · 정규직 · 서울

디피플래닝
20년 이하 · 정규직 · 서울

에이아이카데미
20년 이하 · 정규직 · 광주

매버릭스
3년~5년 · 정규직 · 서울

오믈렛
5년~20년 · 정규직 · 서울




