인기 검색

[NetsPresso] Edge AI Engineer Intern (체험형)
공고 요약
담당업무
Torch → ONNX → Vendor Compiler → Device Runtime 전체 모델 변환·최적화 파이프라인 설계
Graph transformation 및 rewriting, dynamic graph → static graph 변환, unsupported ops 제거·대체
NPU·GPU·ASIC 환경의 vendor compiler·runtime framework 활용 및 디바이스 배포
디바이스별 호환성 이슈, dtype·shape·scale 변환 문제 해결
모델 정확도·latency·메모리 변화 분석 및 원본 대비 품질 보존
런타임 프로파일링 기반 연산자별 성능 병목 분석·최적화
Python·CLI 스크립트와 자동화 파이프라인을 활용한 반복 업무 자동화
기술적 배경·문제 정의·실행 전략·정량적 성공 기준 문서화 및 내·외부 커뮤니케이션
자격요건
Torch → ONNX 변환 구조와 모델 그래프 이해·수정 능력
Graph Surgery 및 dynamic graph → static graph 변환 경험
unsupported ops 제거·대체, quantization-aware 구조 설계, 메모리·연산 최적화 역량
ONNX → vendor compiler → NPU·GPU·ASIC runtime 컴파일 워크플로 이해
Transformer, RoPE, attention, KV cache, sampling, diffusion 등 LLM·GenAI 아키텍처 이해
Intel OpenVINO, Jetson Orin, QNN, SNPE 등 디바이스 기반 추론 경험
ONNX 기반 모델 변환 및 디버깅 경험
quantization, pruning, fusion 등 모델 최적화·경량화 경험
Python 기반 자동화 스크립트 작성 능력
하드웨어 또는 vendor compiler 문서 기반 문제 해결 능력
우대사항
정부 과제 또는 PoC 제안서·기술문서 작성 경험
ONNX Runtime, vLLM, TRT-LLM 등 LLM 서빙 스택 이해
TensorRT, QNN, SNPE, TFLite, eIQ 등 다양한 벤더 compiler 경험
실제 디바이스 inference latency·메모리 profiling 경험
AI Tool 사용과 직접적인 논리 구성의 구분 능력
전형절차
서류 검토
과제
1차 인터뷰
최종 선발
절차 간 추가 과제 진행 가능
근무환경
새로운 모델과 하드웨어를 빠르게 이해하고 직접 부딪히며 해결하는 실행력 중시
모델, Compiler, Runtime을 넘나들며 원인을 분석하고 문제를 해결하는 업무
AI 모델과 컴퓨팅 자원을 연결하는 엔지니어로 성장할 수 있는 팀 환경
마감기한
채용시 마감
노타 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요
공고 원문
댓글
노타에 맞는
이력서로 자동 수정하기