추천 검색

Foundation Model Research Engineer
공고 요약
담당업무
인터넷이 닿지 않는 환경에서 동작하는 자체 파운데이션 모델 학습
사전학습(pre-training)·지속사전학습(CPT)·사후학습(SFT·DPO·RLVR) 파이프라인 설계 및 운영
코딩·개발 도메인 정형·비정형 데이터 수집, 분류, 정제, 토큰화, 적재 파이프라인 구축
데이터 품질 관리 및 모델 성능 개선
폐쇄망·온프레미스 환경 모델 서빙
vLLM 등 추론 스택 통합, 양자화·커스텀 커널·서빙 최적화
코드 벤치마크 및 자체 평가 harness 구축·운영과 학습 사이클 반영
에어갭 배포를 위한 모델 경량화·패키징 및 재현 가능한 운영 체계 구축
국방·공공·금융·의료 현장의 개발 업무에 모델 적용
고객 문제 정의와 현장 피드백의 모델 개선 연결
자격요건
LLM·딥러닝 모델 학습 실무 경험
pre-training 또는 post-training(SFT·RLHF·DPO 등) 파이프라인 운영 경험
PyTorch 기반 학습 코드 수정·확장 역량
transformers 및 분산 학습(DeepSpeed·FSDP 등) 경험
GPU 자원 운영 경험
LLM 추론 서빙(vLLM·TGI·TensorRT-LLM 등) 및 양자화 실무 이해
Linux·Docker·GPU 환경 문제 해결 역량
우대사항
정밀 양자화(FP8·FP4·NVFP4), 커스텀 커널, 서빙 스택 포팅 경험
온프레미스·폐쇄망·엔터프라이즈 반입 환경 배포 경험
SWE-bench류 또는 자체 코드 벤치마크 harness 구축 경험
HuggingFace 오픈웨이트 공개, Transformers PR, 리더보드 등재 이력
강화학습 기반 post-training(RLVR·GRPO 등) 실험 경험
ACL·ICLR·NeurIPS·EMNLP 등 top-tier 학회 논문 실적
HuggingFace 모델·데이터셋 커뮤니티 채택 사례
vLLM·veRL·transformers 등 LLM 오픈소스 기여 경험 또는 5k+ stars 오픈소스 배포·유지 경험
지원방법
이력서 제출 필수
포트폴리오 제출 선택
지원 전 콜챗을 통한 포지션·조직 문화·비전 문의 가능
전형절차
서류 전형
동료 인터뷰 40분
리더 인터뷰 40분
최종 합격
근무환경
기반 모델 연구·개발을 위한 GPU 등 인프라 지원
연구·개발 업무와 고객 현장 문제 해결을 연결하는 업무 환경
다양한 전형 운영 및 신속한 진행
마감기한
채용시 마감
공고 원문
이런 공고는 어때요?

펄크럼테크놀로지스
3년~20년 · 정규직 · 서울

메크랩
3년~10년 · 정규직 · 서울

모다플
3년~10년 · 정규직 · 서울

일레븐
3년~10년 · 정규직 · 경기

폴라펄스
10년 이하 · 계약직 · 서울

포밸류소프트
7년~20년 · 정규직 · 경기

스텝에이아이
20년 이하 · 정규직 · 서울

텔어스
20년 이하 · 정규직 · 서울

휴멜로
3년~8년 · 정규직 · 서울

vox.ai
1년~9년 · 정규직 · 서울

엘리스그룹
6년 이하 · 정규직 · 서울

딥아이
20년 이하 · 정규직 · 부산

콕스웨이브
3년~7년 · 정규직 · 서울

페이스웹
20년 이하 · 체험형인턴 · 서울

메디콜
20년 이하 · 정규직 · 서울

디피플래닝
20년 이하 · 정규직 · 서울

에이아이카데미
20년 이하 · 정규직 · 광주

매버릭스
3년~5년 · 정규직 · 서울

오믈렛
5년~20년 · 정규직 · 서울

픽스
3년~10년 · 정규직 · 서울




