Ses Klonlama Teknolojileri: TRT’nin Akustik Sırlar Programındaydım

TRT’nin sesin görünmeyen dünyasını konu alan Akustik Sırlar programının 10. bölümünde, ses klonlama teknolojileri ve yapay zekânın bu alandaki dönüşümü üzerine değerlendirmelerde bulundum.

Ses teknolojilerini anlamak için analog sesin dijitale dönüştürülmesinden başlayan uzun bir gelişim sürecine bakmak gerekiyor. Bir fotoğrafı internetten indirmenin yaklaşık bir dakika sürdüğü dönemden, bugün bir sesi saniyeler içinde işleyip değiştirebildiğimiz noktaya geldik. Amerika’da üretimini gerçekleştirdiğimiz CDMA 1x EV-DO teknolojisinde 2002’li yıllarda sesin ve verinin ayrı işlenmesi, hem kablolu hem kablosuz iletişimde çağ açan bir gelişmeydi.

Klonlama teknolojisi üç aşamadan oluşuyor: sistem önce hedef sesi kaydediyor, ardından karakteristik özellikleri analiz ediyor, son aşamada istenen metni o sesle üretiyor. Bugün “zero-shot cloning” dediğimiz teknikte artık eğitim aşamasına bile ihtiyaç duyulmuyor; sesin karakteristikleri yapay zekâya bilgi olarak sunulduğunda, on saniyelik bir örnekle bir kişinin sesi kopyalanabiliyor.

Bu hız büyük olanaklar sunarken ciddi tehditleri de beraberinde getiriyor. Sosyal medyada ünlü kişilerin ve siyasetçilerin sesleri klonlanarak yürütülen dolandırıcılıklar her gün karşımıza çıkıyor. Üç yıl önce anneme şunu söylemiştim: “Bir gün seni telefonla ya da görüntülü arayıp senden para istiyorsam, o ben değilim. Lütfen şimdiden bil.” Bugün bu uyarı her zamankinden daha geçerli.

Yapay zekâ aynı zamanda iyilik için de kullanılıyor — gerçek zamanlı çeviriden eğitime kadar birçok alanda. Belirleyici olan, teknolojinin kendisi değil nasıl kullanıldığı. Bu nedenle yapay zekâ okuryazarlığını toplumun her kesimine, herkesin kendi seviyesine uygun biçimde anlatmak kritik önemde.

Similar Posts