Recruitment background

[NetsPresso] Edge AI Engineer Intern (체험형)

노타|2026. 8. 27. 게시|
1

공고 요약

경력신입
채용 유형체험형인턴
학력무관
지역서울
마감일채용시마감
출처직행

담당업무

  • Torch → ONNX → Vendor Compiler → Device Runtime 전체 모델 변환·최적화 파이프라인 설계

  • Graph transformation 및 rewriting, dynamic graph → static graph 변환, unsupported ops 제거·대체

  • NPU·GPU·ASIC 환경의 vendor compiler·runtime framework 활용 및 디바이스 배포

  • 디바이스별 호환성 이슈, dtype·shape·scale 변환 문제 해결

  • 모델 정확도·latency·메모리 변화 분석 및 원본 대비 품질 보존

  • 런타임 프로파일링 기반 연산자별 성능 병목 분석·최적화

  • Python·CLI 스크립트와 자동화 파이프라인을 활용한 반복 업무 자동화

  • 기술적 배경·문제 정의·실행 전략·정량적 성공 기준 문서화 및 내·외부 커뮤니케이션

자격요건

  • Torch → ONNX 변환 구조와 모델 그래프 이해·수정 능력

  • Graph Surgery 및 dynamic graph → static graph 변환 경험

  • unsupported ops 제거·대체, quantization-aware 구조 설계, 메모리·연산 최적화 역량

  • ONNX → vendor compiler → NPU·GPU·ASIC runtime 컴파일 워크플로 이해

  • Transformer, RoPE, attention, KV cache, sampling, diffusion 등 LLM·GenAI 아키텍처 이해

  • Intel OpenVINO, Jetson Orin, QNN, SNPE 등 디바이스 기반 추론 경험

  • ONNX 기반 모델 변환 및 디버깅 경험

  • quantization, pruning, fusion 등 모델 최적화·경량화 경험

  • Python 기반 자동화 스크립트 작성 능력

  • 하드웨어 또는 vendor compiler 문서 기반 문제 해결 능력

우대사항

  • 정부 과제 또는 PoC 제안서·기술문서 작성 경험

  • ONNX Runtime, vLLM, TRT-LLM 등 LLM 서빙 스택 이해

  • TensorRT, QNN, SNPE, TFLite, eIQ 등 다양한 벤더 compiler 경험

  • 실제 디바이스 inference latency·메모리 profiling 경험

  • AI Tool 사용과 직접적인 논리 구성의 구분 능력

전형절차

  1. 서류 검토

  2. 과제

  3. 1차 인터뷰

  4. 최종 선발

  5. 절차 간 추가 과제 진행 가능

근무환경

  • 새로운 모델과 하드웨어를 빠르게 이해하고 직접 부딪히며 해결하는 실행력 중시

  • 모델, Compiler, Runtime을 넘나들며 원인을 분석하고 문제를 해결하는 업무

  • AI 모델과 컴퓨팅 자원을 연결하는 엔지니어로 성장할 수 있는 팀 환경

마감기한

채용시 마감

노타 지원하기 전 이력서 Check

시간이 없다면 AI와 한번에 수정해보세요

공고 원문

노타 [NetsPresso] Edge AI Engineer Intern (체험형) 채용공고
이런 공고 어때요?
지금 많이 보는 공고

댓글