tag

#end-to-end

총 2개의 글

AI 2026.05.03 · 14 min Advanced Audio Speech Deep Dive · 3

GMM-HMM의 forced alignment부터 CTC의 marginalization, LAS의 autoregressive decoder, RNN-T의 스트리밍까지 — end-to-end ASR의 설계 철학을 추적한다.

AI 2026.05.03 · 16 min Advanced Audio Speech Deep Dive · 5

Tacotron의 end-to-end seq2seq부터 WaveNet의 sample-level 생성, FastSpeech의 parallel inference, HiFi-GAN의 다중 판별기, VITS의 통합 프레임워크까지 — 현대 TTS 설계 철학의 진화를 추적한다.