Базовый модуль, вводящий в речевые технологии: акустика и фонетика, признаки речевого сигнала (MFCC, мел-спектрограмма), общий pipeline ASR/NLP/TTS и обзор отечественных разработок от формантного синтеза до RHVoice и нейронных систем.
Физические основы звука: частота, амплитуда, форманты, фонемы русского языка и спектрограмма как основной инструмент анализа.
Аналого-цифровое преобразование, импульсно-кодовая модуляция (PCM), частота дискретизации, разрядность, шум квантования, битрейт и форматы аудио.
Извлечение признаков из речевого сигнала: оконное преобразование, FFT, mel-шкала, кепстр, MFCC и filterbank features.
История речевых технологий в СССР и России: от формантного синтеза до RHVoice Ольги Яковлевой и современных нейронных систем.
Архитектура речевого конвейера: микрофоны как вход, ASR, NLP-обработка, TTS; сравнение гибридного и end-to-end подходов.