Генерация музыки и аудио

Модуль посвящён генерации музыки и аудио с помощью ИИ: языковые модели на аудио-токенах (AudioLM, MusicGen), сервисы text-to-music (Suno, Udio), диффузионные модели для звука (Stable Audio, Riffusion) и музыкальная теория — темп, тональность, аккорды, такт и MIDI-представление, необходимая для понимания того, как AI учит структуру произведений.

← Назад к направлению
⏱ 50 мин 📖 4 теорий 📝 1 кейсов

📚 Микро-теория

AudioLM и MusicGen: языковые модели для аудио

Нейрокодеки (EnCodec, SoundStream), дискретные audio tokens и авторегрессионная генерация звука по примеру языковых моделей.

12 мин

Диффузия для аудио

Stable Audio, Riffusion и score-based генерация: спектрограмма как изображение, диффузия в латентном пространстве звука.

12 мин

Структура музыки и теория для AI

Темп, тональность, аккорды, такт, паттерны и MIDI-представление — как AI учит музыкальную структуру.

13 мин

Suno и Udio: генерация песен по описанию

Сервисы text-to-music, генерирующие песни с вокалом и музыкой: структура произведения и промпт-инжиниринг для музыки.

13 мин

🎯 Практические кейсы

Анализ структуры музыки: темп и тональность на numpy
Средний ⏱ 30 мин
music numpy анализ

🧠 Проверь себя

💬 Чат с наставником

Привет! 👋

Я помогу тебе освоить ИИ-компетенции. С чего начнём?