
VLA (Vision-Language-Action) 엔지니어
공고 원문
소개
시각 정보와 자연어 명령을 입력받아 드론의 비행 행동을 직접 출력하는 VLA 모델을 설계하고 개발하는 포지션입니다. Vision Encoder, Language Backbone, Action Decoder로 이어지는 end-to-end 파이프라인을 구축하고, 자율비행 스택과 연동하여 드론이 자연어 임무를 수행할 수 있도록 합니다.
주요업무
* 드론 자율비행을 위한 VLA 모델 아키텍처 설계 및 학습 파이프라인 구축 * Vision Encoder, Language Backbone, Action Decoder 구성 및 도메인 특화 fine-tuning * 비행 시연·로그 데이터 기반 Imitation Learning 데이터셋 구축 및 학습 체계 수립 * 시뮬레이션(Isaac Sim, Gazebo 등) 및 실기체 환경에서의 모델 평가·검증 * 비행 제어 스택(ROS2 / PX4)과의 Action 출력 인터페이스 설계 및 연동 * 엣지 디바이스(Qualcomm, NVIDIA 계열) 추론 최적화
자격요건
* 컴퓨터공학, AI, 로보틱스 또는 관련 분야 석사 이상 (또는 학사 + 동등 경력) * 딥러닝 기반 모델 개발 경력 2년 이상 * PyTorch 기반 Multi-modal 모델 학습 및 fine-tuning 경험 * Vision-Language 모델 또는 Robot Learning 관련 실무·연구 경험 * 리눅스 환경 개발 및 Git 협업 경험
우대사항
* VLA 모델 직접 개발 또는 재현 경험 (RT-2, OpenVLA, π0, Octo, Helix 등) * Imitation Learning, Behavior Cloning, Diffusion Policy 등 정책 학습 경험 * 로보틱스 시뮬레이터(Isaac Sim/Lab, Gazebo, MuJoCo) 활용 경험 * 드론·로봇 등 Embodied AI 도메인 경험 * 모델 경량화 및 엣지 추론 최적화 경험 (quantization, distillation, action chunking 등) * ROS2 기반 제어 시스템 연동 경험
혜택 및 복지
* 점심 식대 지원 * 음료, 간식 제공 * 성과 기반 인센티브 제공
퀀텀에어로 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요