Yapay zeka, müziği ele mi geçiriyor?

- A +

2023 yılının Nisan ayında milyonlarca insan, Drake ve The Weeknd’in yeni bir şarkı yayınladığını sandı. Şarkı listeleri altüst oldu, sosyal medya yıkıldı; herkes bu yılın “düetini” konuşuyordu. Kulaklarımıza gelen ses o kadar tanıdık, o kadar gerçekti ki kimse durumdan şüphelenmedi. Ama ortada çok büyük bir sorun vardı: Şarkı aslında hiç var olmamıştı.

Ne Drake o şarkı için stüdyoya girmişti ne de The Weeknd mikrofon başına geçmişti. Ghostwriter adıyla paylaşım yapan kişi, yapay zekâdan yararlanarak iki sanatçının seslerini taklit eden bir kayda imza atmıştı. Şarkı gerçekten vardı; sanatçılara aitmiş gibi duyulan vokaller ise onlara ait değildi.

Bu olay bir soruyu gündeme getirdi: Bir sanatçının sesi kime aittir? Sesimiz, parmak izimiz ya da yüz hatlarımız gibi yalnızca bize özgü müdür? Yoksa dijital ortama aktarıldığında başkalarının da kullanabileceği bir veriye mi dönüşür? Bir sanatçının sesini duymak, artık o kayıtta gerçekten kendisinin yer aldığından emin olmak için yeterli olmayabiliyor. Bu durum, dinleyicinin duyduğu kaydın kim tarafından üretildiğini ve sanatçının buna izin verip vermediğini sorgulamasına yol açıyor.

Drake – Heart on my sleeve Ft The Weeknd (Music Video) | AI Music Videos
.

Anlamayan, sadece tahmin eden makineler

Yapay zekânın müzik üretmesini bazen büyük bir yaratıcılık gösterisi gibi anlatıyoruz. Sanki bilgisayarın içinde bir ilham kaynağı varmış gibi düşünüyoruz, ama işleyişi farklı. Bugünün müzik üretim modelleri ürettikleri sesleri bir insan gibi dinleyip yorumlamıyor. Eğitim verilerinden öğrendikleri örüntülerle yeni ses dizileri oluşturuyorlar.

Bazı modellerin mantığı, telefon klavyelerindeki kelime tahmini özelliğine benzetilebilir. Siz “nasılsın” yazdığınızda telefonun bir sonraki kelimeyi önermesi gibi, bu modeller de önceki seslerden hareketle sonrakileri üretir. Ancak müzik üretimi, tek tek notalar için yapılan basit bir kelime tahmininden daha karmaşıktır; farklı modeller farklı yöntemler kullanır. Model, “Trap” gibi bir tür ya da “hüzünlü” gibi bir tarif verildiğinde, eğitiminde karşılaştığı müzikal özelliklerden yararlanarak buna uygun bir sonuç üretmeye çalışır. Bu yüzden ortaya çıkan müziği, arşivden çekilmiş bir kopya olarak tanımlamak da doğru olmaz.

Bizim “Ne kadar şaşırtıcı bir melodi” dediğimiz anlarda, üretim sırasında yapılan seçimlerin de payı olabilir. Bazı modellerde kullanılan “temperature” (sıcaklık) ayarı, olası sonuçlar arasından seçim yapılırken ne kadar çeşitliliğe izin verileceğini belirler. Bu ayar, makineye bilinçli bir hata yaptırmaz; yalnızca daha az olası seçeneklerin seçilme ihtimalini değiştirebilir. Ortaya çıkan bir parçayı yaratıcı bulup bulmamız yalnızca bu ayara bağlı değildir. Makine duygulanmaz, fakat ürettiği müzik dinleyicide duygu uyandırabilir.

Ruhun taklidi, emeğin dışlanması

Yapay zekâyla ilgili kaygılardan biri, bir sanatçının tanınan sesinin izni olmadan taklit edilebilmesi. Bir yapay zekâ sistemi ayrılık temalı bir şarkı üretirken, şarkının anlattığı sızıyı ya da terk edilmişlik hissini yaşamıyor. Bunun yerine, öğrendiği ses ve müzik özelliklerinden yararlanarak bu duygularla ilişkilendirebileceğimiz bir kayıt üretiyor.

Sonuçta elimizde kalan kaydın nasıl değerlendirileceği, onun nasıl ve kimin katkısıyla üretildiğine de bağlı. Bir insanın sesini taklit eden kaydı dinlerken, duyduğumuz performansı kimin ortaya koyduğunu bilmek isteyebiliriz. Bir sanatçının yıllar içinde geliştirdiği ses karakterinin izinsiz kullanılması da onun emeği ve bu kullanım üzerindeki söz hakkı hakkında sorular doğuruyor. Burada kendimize şu soruyu sorabiliriz: Dinlediğimiz melodinin kim tarafından ve nasıl üretildiği bizim için önemli mi? Bir şarkıyı sevmemizde, onu söyleyen kişinin yorumu ve yaşantısı nasıl bir yer tutuyor? Yapay zekâyla üretilen müziği dinlerken bu soruları sormak, hem insan emeğini hem de yeni teknolojinin sunduğu imkânları daha iyi değerlendirmemizi sağlayabilir.

Sadece ses mi, yoksa bir kimlik mi?

Yapay zekânın bir sesi taklit etmesi, dışarıdan bakıldığında etkileyici bir teknolojik başarı gibi görünebilir. Ancak sesi taklit edilen sanatçı için durum çok daha kişisel. Çünkü ses, bir sanatçı için çalışma aracının yanı sıra kimliğinin de bir parçasıdır. Sesimizde konuşma biçimimiz, alışkanlıklarımız ve yıllar içinde geliştirdiğimiz ifade tarzı duyulur. Peki, bir sanatçının sesi izni olmadan taklit edildiğinde bu durum onda nasıl bir karşılık bulur?

Bu soruyu ses sanatçısı Laden Saraçoğlu’na sorduk. Laden, izni olmadan sesinin kullanılmasını teknik bir gelişmeden çok bir “kimlik ihlali” olarak görüyor. Onun için ses, bilgisayara yüklenebilen bir dosyadan fazlasını ifade ediyor. Endişesini şu sözlerle anlatıyor:

“Benim sesim sadece bir araç değil, benim kimliğim. İçinde yaşadığım her şey, hissettiklerim ve tarzım var. Eğer bir yapay zekâ benim sesimi kopyalayıp hiç söylemediğim bir şarkıyı ‘Laden’ adıyla yayınlarsa, bu bence net bir hırsızlıktır. Çünkü insanlar onu dinlediğinde ‘ben’ olduğumu sanacaklar; oysa orada benim ruhum, benim iradem olmayacak. Kısacası, insanlar bir yalanı ben sanacak ama aslında ben olmayacağım.”

Hesaplanan sesler ve hissedilen nefes

Yapay zekâ modelleri, öğrendikleri ses örüntülerinden yararlanarak yeni kayıtlar üretebiliyor. Ancak bir ses sanatçısı için şarkı söylemek ortaya çıkan sesten ibaret değil. Laden, stüdyoda bir notadan önce aldığı nefesin ya da sesindeki küçük bir titremenin, o andaki hâliyle ilişkili olduğunu söylüyor. Ona göre makine bunları taklit edebilse de aynı deneyimi yaşamıyor.

Laden ile konuşurken, müzikteki küçük sapmaların onun için neden önemli olduğunu da anlıyoruz. Sanatçı bunu şöyle açıklıyor:

“Şarkıdaki o küçük sapmalar aslında duyguyu taşır. Yapay zeka her şeyi kuralına göre, tertemiz yapabilir ama ruh veremez. Çünkü müzik yaşanmışlıktan, o anki ruh halinden beslenir. Benim şarkı söylerken nefesimi tutmam, o küçük titremeler, vibratolar… Bunlar benim için birer veri değil, o anki hayatımın bir parçası. Makine bunu taklit edebilir ama asla hissedemez.”

Laden’in sözlerinde nefes, titreme ve sesin çatallanması, düzeltilmesi gereken kusurlar olarak görülmüyor. Bunlar, sanatçının o anki yorumunun bir parçası. Yapay zekâ benzer sesler üretebilir; Laden’in vurguladığı fark, o sesi çıkaran kişinin yaşadığı deneyimde yatıyor.

Gelecek kaygısı: Sanatçı mı, dublör mü?

Laden’in kaygısı, teknolojinin gelişmesinden çok müzik endüstrisinin onu nasıl kullanacağıyla ilgili. Plak şirketlerinin sanatçılarla çalışmak yerine onların seslerini taklit eden sistemleri tercih etme ihtimali onu düşündürüyor. Laden bu durumu şu sözlerle özetliyor:

“Gerçek bir sanatçı şarkıya sadece sesiyle değil, sahnedeki enerjisiyle, o anki nefesiyle hayat verir. Yapay zeka dublörleri sesleri ve ritmi harika taklit edebilir, ama o anın içtenliği onlarda yok. Eğer plak şirketleri sadece kolay yolu seçip bu kopyalara yatırım yaparsa, müzik en büyük gücünü, yani samimiyetini kaybeder. İnsan dokunuşu olmadan şarkı söylemek sadece mekanik bir gösteri olur; oysa makine bize o anın hissini asla geçiremez.”

Laden için yapay zekâ, kendi deneyiminin yerini alabilecek bir sanatçı değil. Bir sistem sesinin özelliklerini taklit etse bile, yıllar içinde geliştirdiği yorum biçimini hangi koşullarda ve hangi niyetle kullandığını bilemez. Sanatçıya göre sesi ile o sesin arkasındaki hayatı birbirinden ayırmamak gerekiyor.

Bu yaklaşım, bir kaydı dinlerken onu kimin söylediği ve nasıl üretildiği sorularını da gündeme getiriyor. Laden için müzik, duyulan ses kadar o sesi çıkaran insanın yorumuyla da ilgili.

Hukukun yanıt aradığı yer

Sanatçıların seslerinin izinsiz taklit edilmesine ilişkin kaygıları hukuki sorular da doğuruyor. Mesele yalnızca mevcut bir şarkının kopyalanması değil; bir kişinin sesinin, izni olmadan, yeni bir kayıtta kullanılması. Bu konuyu konuştuğumuz Avukat İrem Kaplan mevcut hakların yapay zekâyla ses taklidi durumunda nasıl uygulanacağını ele alıyor. İrem’e göre ilk soru, sesin hukuken nasıl korunacağı. Sesi yalnızca bir kayıt dosyası olarak değerlendiremeyeceğimizi şu sözlerle açıklıyor:

“Hukukta ses, aslında sizin parmak iziniz gibi size özel bir parçanızdır. Bu yüzden sesiniz doğrudan sizin ‘kişilik hakkınız’ olarak korunur. Yani bir sanatçının izni olmadan sesinin yapay zekâyla kopyalanması, sadece bir para meselesi değil; doğrudan o insanın kimliğine, varlığına yönelik bir saldırıdır. Kimsenin sizin parmak izinizi kopyalayıp başka bir yerde kullanamayacağı gibi, sesinizi de izinsiz kullanamamalı.”

Ancak işin içine ticari kullanım girdiğinde hangi hakkın ihlal edildiği ve ne talep edilebileceği, somut olayın koşullarına bağlı. Türkiye’de kişilik haklarını ve icracı sanatçıların haklarını koruyan hükümler bulunuyor; bu nedenle hukuk sisteminin tamamen korumasız kaldığını söylemek doğru olmaz. Bir ses taklidinde mevcut kayıtların kullanılıp kullanılmadığı, sanatçının kimliğinin nasıl sunulduğu ve izninin bulunup bulunmadığı değerlendirmede önem taşıyor. İrem’in dikkat çektiği sorun, bu hakların yeni üretim yöntemlerine nasıl uygulanacağı.

Taklit mi, esinlenme mi, hırsızlık mı?

Avukat İrem Kaplan ile yaptığımız röportajda üzerinde durduğumuz konulardan biri, yapay zekâyla ses taklidinin mevcut haklar çerçevesinde nasıl değerlendirileceğiydi. Fikir ve Sanat Eserleri Kanunu besteleri ve şarkı sözlerini koruduğu gibi, icracı sanatçıların kayıtlı performanslarına ilişkin hakları da düzenliyor. Ancak mevcut bir kayıt kullanılmadan bir sanatçının sesine benzeyen yeni bir kayıt üretildiğinde hangi hakların devreye girdiği, olayın koşullarına göre değerlendirilmek zorunda. İrem, esinlenme ile izinsiz kullanım arasındaki ayrımı şöyle anlatıyor:

“Bugün bir insanın çıkıp Taylor Swift gibi şarkı söylemesi, onun tarzını taklit etmesi hukukta en fazla ‘esinlenme’ olarak görülür ve genellikle bir suç sayılmaz. Çünkü insan insandan ilham alabilir. Ama yapay zekâ burada çok farklı ve tehlikeli bir şey yapıyor; o esinlenmiyor. O, sanatçının yıllarca emek vererek, her notasını tek tek örerek inşa ettiği o devasa ses arşivini, yani veri setini, doğrudan sömürüyor. Makine, sanatçının sesindeki o en küçük karakteri bile alıp kopyalıyor.”

İrem’e göre asıl mesele, ses taklidinde hangi kullanımın esinlenme, hangisinin hak ihlali sayılacağının belirlenmesi. Sanatçının yalnızca şarkısını değil, sesinin izinsiz kullanımını da dikkate almak gerektiğini savunuyor: “Hukuk burada çok kritik bir yol ayrımında. Bir yanda masum bir ‘taklit’ ya da ‘ilham alma’ var, diğer yanda ise bir insanın kimliğini oluşturan tüm ses verilerinin izinsizce alınıp kullanılması, yani modern bir ‘hırsızlık’ var. Biz şu an bu ikisi arasındaki o ince çizgiyi yeniden tanımlamak zorundayız. Eğer sanatçının tarzını, üslubunu ve o ses tınısını yasalarla koruma altına almazsak; gelecekte ‘eser’ dediğimiz şeyin hiçbir anlamı kalmayacak. Çünkü makine, sanatçının kendisi olmadan onun tarzıyla sonsuz sayıda yeni şarkı üretebilecek.”

İrem’in sözleri, bir sanatçının sesiyle ilişkilendirilen yeni kayıtların yaratabileceği sorunu ortaya koyuyor. Burada kullanılan kayıtlar, sanatçının izni ve dinleyiciye kaydın kime ait olduğunun nasıl sunulduğu açısından önem taşıyor.

Yapay zekâyla üretilen şarkıların hakları

Bu meselenin bir başka yönü de yapay zekâyla üretilen bir şarkı üzerinde kimin hak sahibi olabileceği. İrem ile bu konuyu konuşurken, telif hukukunda insan katkısının önemine değiniyoruz. Bir müzik parçasında insanın beste, söz, düzenleme veya başka yaratıcı katkıları bulunabilir; yapay zekâ kullanılmış olması bu katkıları ortadan kaldırmaz. İrem kendi değerlendirmesini şöyle açıklıyor:

“Yapay zekâ bir acıyı, bir neşeyi ya da bir fikri ifade etmek için o şarkıyı yapmıyor. O sadece önüne konulan matematiksel olasılıkları tamamlıyor. Hukuk açısından baktığımızda, bir şarkının arkasında gerçek bir insan dokunuşu yoksa, o şey bir ‘sanat eseri’ değildir. Sadece sahipsiz, anonim bir veri yığınıdır. Yani bugün milyonlarca kez dinlenen o yapay zekâ şarkılarının hukuken bir sahibi yok; onlar sadece boşlukta süzülen dijital çıktılar.”

İrem’in sözlerindeki kaygı anlaşılır; ancak yapay zekâ kullanılan bütün şarkıların hukuken sahipsiz olduğunu söylemek mümkün değil. Bir parçadaki insan katkısının ve kullanılan malzemenin ayrı ayrı değerlendirilmesi gerekiyor. Laden ise kendi sesinin izni olmadan kullanılması ihtimaline şu sözlerle tepki veriyor:

“Benim için müzik, o anki uykusuzluğum, sesimdeki o yorgunluk ya da o günkü heyecanımdır. Eğer bir makine bunları benden alıp, içine hiçbir ruh koymadan piyasaya sürerse, benim yıllarca uğraşarak var ettiğim ‘benliğim’ sahipsiz bir eşyaya dönüşür. Hukukçu arkadaşım İrem ‘yasalar bunu korumuyor’ dediğinde, kendimi çok savunmasız hissediyorum. Sanki birisi evime girip en değerli eşyamı alıyor ama kanunlar ‘o eşya zaten herkesin olabilir’ diyor gibi.”

İrem ise mevcut hakların bu yeni kullanım biçimlerine uygulanması konusunda yaşanan belirsizliğe dikkat çekiyor:

“Sanatçılar ‘ruhumuz gasp ediliyor’ diye bağırırken, biz hukukçular maalesef yasaların henüz bu ruhu koruyacak bir zırha sahip olmadığını görüyoruz. Teknoloji şu an mülkiyet kavramını, tabiri caizse, yerle bir ediyor. Biz bir yanda ‘bu ses benim’ diye haykıran sanatçıyı duyuyoruz, diğer yanda ise bu haykırışı mahkemede savunacak bir madde bulmaya çalışıyoruz.”

Laden’in anlattığı savunmasızlık hissi ile İrem’in işaret ettiği hukuki sorular aynı noktada buluşuyor: Bir sanatçının sesi taklit edildiğinde, izinsiz kullanım nasıl saptanacak ve sanatçı hangi haklarını ileri sürebilecek? Kişilik hakları ve icracı sanatçı haklarına ilişkin korumalar mevcut; yapay zekâyla üretilen her kayıt için sonuç, kullanımın biçimine bağlı.

Müziğin arka plan sesine dönüşmesi

Teknik, etik ve hukuki tartışmaların yanında müziği dinleme biçimimiz de değişiyor. Bazen bir şarkıya dikkatle kulak veriyoruz, bazen de çalışırken ya da dinlenirken arka planda çalması için bir liste hazırlıyoruz. Spotify’daki odaklanma, ders çalışma veya sakinleşme listeleri bunun tanıdık örnekleridir. Böyle anlarda parçayı kimin yaptığına veya ne anlattığına dikkat etmeyebiliyoruz. Müziğin o sırada bizden beklenen işlevi, bulunduğumuz ortama eşlik etmesi.

Yapay zekâyla üretilen müzik de bu tür dinleme alışkanlıkları arasında yer bulabilir. Arka planda çalan bir parçada sanatçının kimliğini merak etmediğimizde, üretim biçimini de sorgulamayabiliriz. Bu, müziğin yalnızca böyle dinlendiği anlamına gelmiyor; ancak dinleme amacımız, bir parçanın arkasındaki emeğe ne kadar dikkat ettiğimizi etkileyebiliyor.

Laden bu durumu bir sanatçı olarak şöyle yorumluyor: “Biz insanlar şarkılarımızı birilerine bir şey hissettirmek için yapıyoruz,” diyor ve ekliyor: “Eğer dinleyici artık sadece ‘arkada bir ses çalsın’ diyorsa, benim o şarkıya kattığım ruhun bir anlamı kalmıyor. Müziği bir gürültü kesiciye dönüştürdüğümüzde, aslında kendi duygularımızı da köreltiyoruz.” Avukat İrem ise dinleyicinin üreticiyi önemsememesinin hak tartışmasını da etkileyebileceğini düşünüyor: “İnsanlar kimin yaptığını umursamadığı an, telif hukukunun da bir anlamı kalmaz. Sahibi olmayan, ruhu olmayan bir müzik dünyasına doğru sürükleniyoruz.”

Bir kaydı beğendiğimizde onu kimin ürettiğini ve kullanılan sesler için izin alınıp alınmadığını merak edebiliriz. İnsanların yaptığı müzik ile yapay zekâ kullanılarak üretilen müzik arasındaki farkları ancak bu soruları sorarak tartışabiliriz. Bir dahaki sefere bir şarkıyı listenize eklerken kendinize şu soruyu sorabilirsiniz: “Bu parçayı kim yaptı ve ben onda neyi seviyorum?”