ОТ БРОЯ | AI Have No Mouth and AI Must Sing

Този материал е част от есенния печатен брой на ПРОГРАМАТА. Открийте го ТУК.

Това, от което имаме нужда, са творби, които са силни, строги, точни и завинаги отвъд нашето разбиране. Логиката е усложнение. Логиката е винаги в грешка. – Тристан Цара, Манифест на дадаизма, 1918 г. 

Текст: НФО Три стаи

Представи си, че си завършил всички музикални училища в света, изслушал си цялата музика от Булат Окуджава, през Altin Gün, Fontaines D.C., Vaya con Dios, Пучини, Пиацола и първите неиздавани EP-та на Мефистофел, които GORO (TARIKATA) твърди, че не ги е слушал.
Ако успееш, то ти си или SUNO, или UDIO. Не че не може да си нещо друго, но нито аз, нито Гугъл, нито братовчед им ChatGPT ще ти обърне внимание.


Както големите езикови модели, които се учат чрез целия изписан текст в интернет, то моделите, които създават музика, правят същото, но с песните на всички артисти, до които имат достъп. По своето същество тези „инструменти“ не правят разлика между аудиофайл (mp3, wav, flac), MIDI файл или таблатура, изкарана от шкафа на Arvo Part или Бетовен. За тях е абсолютно едно и също, защото в крайна сметка всяка емоция може да се свари, или редуцира, както е по-точно, до нишка от единици и нули.
В основата на повечето модели за генериране на текст и музика стои така нареченият Transformer model, който беше представен през 2017 г. в труд с гениалното заглавие Attention is all You Need (Вниманието е всичко, от което се нуждаете). 

Накратко този модел позволява сам на себе си да разбере отношенията между различните думи. В музикален смисъл това би означавало, че моделът перфектно разбира, че ударът на касата (бас барабана) и акцентът на бас китарата са в един и същи момент.
Преди около две години приятел ме попита дали не съм развълнуван относно възможностите, които AI-ът предоставя, що се касае до създаване на музика? Към онзи момент разсъжденията ми по въпроса бяха изключително ограничени и даже не влизаха в сферата на това AI да се използва като „инструменти“ – ми казва приятел музикант, докато си отпива от бирата пред пловдивски бар.

С течение на времето обаче все повече и повече инструменти, които са базирани на LLM, се появиха и много музиканти започнаха да използват AI моделите като помагачи за миксиране, мастериране и дори създаване на идеи за нови песни.

Изключително важно е – споделя друг приятел музикант – да можеш да чуеш демото си така, както би могъл да го чуеш след мастеринг*, преди да си дал сума ти пари за услугата.

Разбира се, сред хората, които цял живот са пипали кабели, качвали са се на сцени, имат тинит от шумни барабани или кокоша слепота вследствие на сценични светлини, за тях AI генерираната музика дори не е тема, на която си струва да се обърне и йота внимание. Никой от тях не е на път да замени тактилното преживяване с безкрайното разстояние между създателя и дигиталното „създание“.

Разбира се, в международен аспект има музиканти, които опитват да прокарат идеята за работа с AI музикални модели. Със сигурност най-значимият пример е Timbaland, един от най-важните продуценти в последните трийсет години, който попадна под жестоки медийни удари заради опита си да възроди гласа на Notorious B.I.G. чрез изкуствен интелект.

А може ли AI-ът сам да си е рекърдс?
Тhe Velvet Sundowns са група, която съществува от около 3 месеца. Статистиките са страхотни – милиони слушатели в стрийминг платформите, песни във всяко discover weekly на хора с предпочитания класически рок, преживяване толкова истинско, че те оставя с усещането, че не се е случило. Това се казва и в описанието на групата в Spotify или се казваше преди официално групата да признае, че е AI генерирана.

Една от по-малките стрийминг платформи Deezer пък споделя, че близо 18% от музиката, която се качва ежедневно, е AI генерирана. Това означава около 20 000 песни на всеки 24 ч.

Но това не бива да е притеснение, защото все още без промпт музика не може да се генерира. Създателят на един от най-големите канали за AI генерирана музика  Obscurest Vinyl – наскоро сподели в reddit, че използването на моделите има и своите ограничения, което налага намесата на човека. А и за да са качествени нещата, същинското създаване на визиите и текстовете е неизбежно, както е и в неговия случай.

AI генерираната музика все още е подвластна на човека, а както знаем, нашият вид е способен да създава страшно красиви неща, но в повечето случаи създава безкрайно посредствени неща. Докато AI генерираната музика не започне сама на себе си да задава задачи и сама да ги генерира, дотогава няма да има нещо особено значително, за което да говорим. Дотогава единственият проблем в музикалния свят ще продължат да са самите хора.