추천 검색

AI 최적화 엔지니어
공고 요약
담당업무
Inference & Training Computational Optimization
STT, TTS, Vision, LLM 등 생성 형 AI 모델의 추론, 학습 경로를 분석하고 latency, throughput, 메모리 효율을 포함한 전체 시스템 성능을 최적화
High Performance Kernel Level Optimization ( CUDA / Triton )
TensorRT, Triton, CUTLASS 등 최신 고성능 커널 및 최적화 기법을 적극 적용
성능 요구 사항을 충족 하기 위해 필요 시 커널을 조정 하거나 확장 하여 성능 한계 를 지속적으로 개선
전처리 / 후 처리 를 위한 공통 라이브러리 개발 및 운영
STT, TTS , Vision , LLM 서빙 에 공통 으로 사용 되는 전처리 , 후 처리 컴포넌트 및 Runtime 유틸리티 를 설계 , 개발 , 운영
Serving pipeline 전반 의 효율성 과 안정성 을 고려한 전방위 적 최적화 수행
데이터 파이프 라인 병목 ( 입출력 , 포맷 변환 , CPU GPU 전송 , batching , padding , 메모리 복사 ) 을 분석 하고 latency , throughput , 메모리 효율 관점 에서 전처리 / 후 처리 흐름 을 최적화
훈련 및 서빙 최적화 를 위한 Research , ML 엔지니어 와 의 협업
모델 구조 , 학습 전략 , 추론 요구 사항 를 기반 으로 최적 실행 전략 을 공동 설계
신규 모델 도입 시 초기 단계 부터 성능 , 비용 , 안정성 목표 달성 을 위한 기술적 방향 제시
자격 요건
PyTorch / TensorRT / ONNX 개발 경험
C ++ 코드 분석 역량
Generation model 에 대한 이해
테스트 주도 개발 경험
우대 사항
PyTorch / TensorRT / ONNX 에 대한 깊은 이해
TensorRT - LLM, VLLM 에 대한 이해 및 경험
컴파일러 및 IR 에 대한 이해
TorchDynamo , Triton Language , CUTLASS 에 대한 이해
CPU , GPU 아키텍처 에 대한 이해
성능 프로파일 링 경험
Docker 경험
AWS 클라우드 에 대한 경험
혜택 및 복지
함께 일하고 싶은 동료 들 과 즐겁게 일 해요
출근 시 점심 / 저녁 식사 , 간식 , 음료 모두 회사 에서 제공 해요
성장을 위해 읽고 싶은 책 , 가보고 싶은 직무 세미나 , 배우고 싶은 직무 교육 을 지원 해요
업무 효율성 을 위한 유료 툴 을 다양 하게 사용 하며 , 지원 해요
재택 근무 와 선택적 근로 시간제 를 병행 하여 개인 에게 맞는 최대한 의 몰입 을 추구 해요
모두 함께 자기 주도적 인 업무 와 조직 문화 를 만들어 갑니다
컨펌 없이 , 날짜 제한 없이 자유로운 휴가 사용 이 가능 해요
각종 국제 학회 나 주요 국제 전시회 참가 를 독려 해요
차분한 분위기 속 유연한 협업 과 동료 에 대한 존중 이 갖춰진 곳 이에요
공고 원문
이런 공고는 어때요?

콕스웨이브
3년~7년 · 정규직 · 서울

원체크
3년~10년 · 정규직 · 경기

원체크
3년~10년 · 정규직 · 경기

페이스웹
20년 이하 · 정규직 · 서울

룰루랩
2년 이상 · 정규직 · 서울

페이스웹
9년 이하 · 정규직 · 서울
 (1).png)
에이듀
3년~5년 · 정규직 · 서울

인포시즈
5년~15년 · 정규직 · 서울

카카오
5년 이상 · 정규직 · 경기

토스뱅크
3년 이상 · 정규직 · 서울
SK inc.(AX)
3년 이상 · 정규직 · 경기

AMD
5년 이상 · 정규직 · 해외
유니코써치
5년~12년 · 정규직 · 서울

SCK
5년~12년 · 정규직 · 서울

카카오
3년 이상 · 정규직 · 경기

AMD
7년 이상 · 정규직 · 해외

AMD
10년 이상 · 정규직 · 해외
SK siltron
3년 이상 · 정규직 · 서울

우아한형제들
5년 이상 · 정규직 · 기타

쿠팡
7년 이상 · 정규직 · 기타



