Kanye Westo prodiuseris teigia sukūręs 400 AI vokalo variantų
Likus dviem dienoms iki 2024-ųjų albumo „Vultures 2“ pasirodymo, anoniminis prodiuseris teigia buvęs pakviestas dirbti skubos tvarka. Los Andželo aukštesniajam teismui pateiktame ieškinyje jis nurodo sukūręs mažiausiai trylika individualių AI balso modelių, daugiau kaip 400 vokalo generacijų ir naudojęs savo paties balsą kaip pradinę medžiagą.
Pasak ieškovo, jo darbas girdimas penkiuose „Vultures 2“ kūriniuose. Nuo 2024 metų spalio jis taip pat programavo AI vokalus Kanye Westo soliniam albumui „Bully“. Prodiuseris tvirtina negavęs atlygio už abu projektus ir nebuvęs nurodytas prodiusavimo kredituose srautinėse platformose.
Ieškinyje prašoma mažiausiai 110 tūkst. JAV dolerių dėl sutarties pažeidimo, nepagrįsto praturtėjimo ir Kalifornijos bei Los Andželo laisvai samdomų darbuotojų apsaugos taisyklių pažeidimų. Tai vienos šalies teiginiai. „Pitchfork“ kreipėsi į Westo atstovus, tačiau iki publikavimo atsakymo negavo.
Elektroninis balsas nėra naujas sumanymas. 1939 metais „Bell Labs“ pademonstravo Voderį*1 – aparatą, kuriuo išmokyta operatorė klavišais ir pedalais kūrė suprantamą kalbą. Mašina skambėjo futuristiškai, bet kiekvieną jos skiemenį reikėjo atlikti žmogui. Dabartinis ieškinys grąžina tą patį nepatogų veikėją: už dirbtinio balso vis dar stovi darbuotojas.
Skaičiai keičia ginčo mastelį. Klausytojai jau 2024-aisiais įtarė, kad Westas kai kur savo vokalą pakeitė skaitmenine replika.*2 Jeigu ieškinio teiginiai pasitvirtintų, tai būtų ne vienas efektas, o gamybos sistema: individualūs modeliai, šimtai bandymų, žmogaus balsas kaip žaliava ir beveik nematomas atlikėjas techniniuose kredituose.
Kovą išleistą „Bully“ Westas pristatė kaip albumą be AI, nors anksčiau viešai kalbėjo naudojantis šią technologiją kūryboje. Todėl klausimas jau ne vien ar girdimas balsas priklauso Westui. Kredituose turi atsirasti ir žmogus, sukūręs jo skaitmeninę versiją. Dėl tos eilutės – kaip muzikos versle nutinka gana dažnai – ir prasidėjo tikras teismo procesas.
- Voderis (Voice Operation Demonstrator) – „Bell Labs“ sukurtas ankstyvas elektroninis kalbos sintezatorius, viešai demonstruotas 1939 metais. Jis pats nekalbėjo: garsus realiu laiku formavo apmokyta operatorė.
- Skaitmeninė balso replika – technologiškai sukurtas balsas, galintis skambėti kaip konkretus žmogus ir sudaryti įspūdį, kad jis pasakė ar padainavo tai, ko neįrašė.
Šaltinis: Walden Green, Pitchfork ↗