Recruitment background

TTS AI Research Engineer

마인드로직|2025. 7. 23. 게시|
236

공고 원문

경력3년~5년
채용 유형정규직
학력무관
지역서울
마감일마감
출처원티드

소개

# TTS AI Research Engineer # 정규직 # 전문연구요원 현역 신규 가능 # 전직 및 산업기능요원은 채용하지 않습니다.# 함께 더 이야기 하고 싶은 AI를 만드는 사람들, 마인드로직입니다. [마인드로직이 만들어낸 성과] • 국내외 유수의 투자자들로부터 누적 투자 150억, 탄탄한 재무구조 • 6년 이상 딥러닝 기반 챗봇 상용 서비스 제공 중 • 독창적인 페르소나 그라운딩 및 장기기억 기술에 기반한 세계 최고 수준의 페르소나 챗봇 엔진 보유 • 서울대학교, 서강대학교, 숙명여자대학교 등 다수의 대학에 AI서비스 제공 중 • 포브스 선정 한국인이 사랑한 모바일앱 17위, 소셜부문 6위 달성 • 구글 어시스턴트 트래픽 글로벌 Top 5 달성

주요업무

## 현재 해결해야 할 핵심 과제 • 자연스러운 인토네이션 개선: 페르소나별 말투와 억양을 정확히 재현하는 TTS 모델 개발 • 감정 표현 고도화: 웃음소리, 한숨, 감탄사 등 자연스러운 감정 표현이 가능한 TTS 구현 • 첫 토큰 지연 최소화: 실시간 대화를 위한 ultra-low latency TTS 시스템 구축 ## 핵심 연구개발 영역 • Realtime Conversational Voice Cloning: 대화 상황에 최적화된 실시간 음성 복제 기술 개발 • 페르소나 기반 Expressive TTS: 캐릭터별 고유한 음성 스타일과 감정을 반영한 개인화 음성합성 엔진 • Neural Audio Codec 최적화 • TTS 데이터 파이프라인: 음성 데이터 전처리, 정제, 증강을 통한 모델 성능 향상

자격요건

• 컴퓨터 공학, 전기전자공학, 또는 관련 분야 석사 이상 또는 이에 준하는 실무 경험 보유 • TTS/음성합성 연구개발 경험 3년 이상 • PyTorch, TensorFlow 등 딥러닝 프레임워크에 대한 깊은 이해와 활용 경험 • 최신 딥러닝 기반 TTS 알고리즘 (FastSpeech, VITS, XTTS 등) 구현 및 커스터마이징 경험 • 음성신호처리 기초 지식: FFT, STFT, Mel-spectrogram, MFCC 등의 이해와 활용 • TTS 모델 학습 파이프라인 구축 경험: 데이터 전처리, 학습, 추론 및 튜닝 전반 • Python 및 관련 오디오 처리 라이브러리 (librosa, torchaudio 등) 숙련도 • 영어 기술 문서 이해 및 작성 가능한 수준의 언어 능력

우대사항

• 실시간 대화형 TTS 구현 경험 (특히 첫 토큰 지연 최소화) • Emotional & Expressive TTS: 웃음, 한숨, 감탄사 등 자연스러운 감정 표현 구현 경험 • Voice Cloning 및 Conversational TTS 개발 경험 • 음성합성 관련 국제학회 논문 발표: Interspeech, ICASSP, NeurIPS, ICLR 등 • 최신 TTS 모델 실험 경험: VITS, XTTS, NeuralSpeech, SpeechT5, Bark, CSM 등 • Neural Vocoder 최적화: WaveNet, WaveGlow, HiFi-GAN, BigVGAN 등 실시간 인퍼런스 구현 경험 • Neural Audio Codec 모델 실험 및 최적화 경험: SNAC, Soundstream, encodec 등 • 음성학(Phonetics) 또는 언어학 배경지식 (인토네이션 패턴 이해) • TTS 상용 서비스 적용 및 운영 경험 (API 서버 구축, 배포 등) • MLOps 및 모델 서빙 경험 (Docker, Kubernetes, 클라우드 서비스) ## 기술스택 • 프로그래밍 언어: Python, TypeScript/JavaScript • 딥러닝 프레임워크: PyTorch, TensorFlow, Hugging Face Transformers • 데이터베이스: PostgreSQL, Redis • 클라우드 서비스: AWS • 컨테이너 오케스트레이션: Docker • CI/CD: GitHub Actions • 버전 관리: Git • 협업 도구: Slack, Jira, Notion • AI 도구: ChatGPT, Claude, Cursor

혜택 및 복지

• 주 5일 근무 • 자율 시차 출퇴근 (산업기능요원/전문연구요원은 병무청에서 허가하는 유연근무제) • 강남구 선정릉역 도보 1분 미만 거리의 단독 오피스 • 최신 업무용 개인 맥북 제공 (맥북 M4) • ChatGPT Pro or Claude / Cursor 구독 지원 • 동료들의 생일 축하 & 선물 • 그룹 액티비티 서포트 • 자율복장

이런 공고는 어때요?

휴멜로

휴멜로

3년~8년 · 정규직 외 1개 · 서울

[R&D] AI Research Engineer, Speech, STT, TTS#음성AI  #TTS연구  #주1회재택
상시
원티드원티드
62
코클

코클

5년 이하 · 정규직 · 서울

Sound AI Research Engineer#신호처리연구  #원격근무  #인공지능
상시
원티드원티드
388
이씨에스텔레콤

이씨에스텔레콤

3년 이상 · 정규직 · 서울

IPT & Video 엔지니어#재택근무  #통신  #제안서작성
상시
원티드원티드
139
채널코퍼레이션

채널코퍼레이션

10년 이하 · 정규직 외 1개 · 서울

[채널톡] MachineLearning Engineer(Model Training)#전문연구요원  #B2BSaaS  #자체모델학습
상시
원티드원티드
167
휴멜로

휴멜로

3년~8년 · 정규직 · 서울

[R&D] AI Research Engineer, Conversational TTS#실시간스트리밍  #음성합성  #TTS아키텍처
상시
그룹바이그룹바이
75
포도노스

포도노스

3년~20년 · 정규직 · 서울

Senior AI Research Engineer#음성AI  #모델설계  #스톡옵션
상시
원티드원티드
383
메디콜

메디콜

20년 이하 · 정규직 · 서울

[메디콜] Software Engineer #AI음성처리  #치과  #LLM통합
상시
그룹바이그룹바이
156
센드버드

센드버드

5년~7년 · 정규직 · 서울

Machine Learning Researcher 채용#RAG시스템  #인공지능  #하이브리드근무
상시
직행직행
15,914
42dot

42dot

3년 이상 · 정규직 · 경기

Deep Learning Engineer (음성 합성 개발)#모빌리티  #음성합성  #모델경량화
상시
직행직행
6
아르토에이아이

아르토에이아이

3년 이상 · 정규직 · 서울

음성인식(Speech Recognition) 엔지니어#온디바이스  #스톡옵션  #음성인식
상시
원티드원티드
5
와이즈에이아이

와이즈에이아이

3년 이상 · 정규직 · 경기

AI 로컬 모델 학습 관련 엔지니어 모집#LLM튜닝  #음성인식  #의료AI
D-48
잡코리아잡코리아
0
사이버텔브
릿지

사이버텔브릿지

5년 이상 · 정규직 · 서울

AI (STT) 개발 경력 인재를 모십니다.#STT  #AI  #시차출퇴근
D-11
잡코리아잡코리아
1