Kusursuz çalışan yapay zeka modelleri bir süre sonra insanı sıkmaya başlarken, sistemin hata yapmasını bekleyen o meraklı zihinler nihayet aradıkları aracı buldu; Engram, yapay zekanın saçmaladığı anları yakalayıp onları ritmik birer ses dosyasına dönüştürüyor.
Hızlı Özet
- Engram, ses modelleri kullanan, gelen sese AI uygulayarak bozan ve yeni sesler üretemeyen (metin modelleri olmayan) bir ses örnekleyicisi ve groovebox cihazı.
- Klasik MIDI klavyelerden farklı olarak doğrudan yapay zeka çıktılarındaki mantıksal kırılmaları ses frekanslarına eşliyor.
- Deneysel müzik üreticileri ve ses tasarımcıları için dijital çağın en absürt ama en yaratıcı araçlarından biri olarak konumlanıyor.
Geçmişte yapay zeka algoritmaları saçma bir yanıt verdiğinde elimizde sadece sinir bozucu bir ekran görüntüsü ya da silinmeyi bekleyen anlamsız metin blokları kalırdı. Şimdi ise bu dijital sapmalar, yani yapay zekanın uydurduğu o hayali gerçekler, müzikal birer tuvale dönüşüyor.
Yapay Zeka Halüsinasyonları Neden Müziğe Dönüşüyor?
Dil modellerinin veya görsel üreticilerin tamamen uydurduğu, gerçeklikle bağı kopmuş o tuhaf yanıtlar uzun süredir mühendislerin başını ağrıtıyordu. Ama kreatif endüstri hep olduğu gibi hatayı fırsata çevirmesini bildi. Çünkü bu bozulmalar, standart kod satırlarının asla sunamayacağı bir kaos barındırıyor içinde.
Deneysel elektronik müzik sahnesinde gürültü estetiği her zaman kendine yer buldu. Eskiden bozuk radyo frekansları ya da eski VHS kasetlerin çıkardığı parazitler kullanılırken, bugün veri setlerinin aşırı yüklenmesi sonucu ortaya çıkan o dijital sayıklamalar hammadde haline geldi. Engram sistemi düzeltmeye çalışmak yerine, hatanın kendisini bir enstrüman gibi çalmanıza izin veriyor.
Klasik Örnekleyicilerden Farkı Ne?
Müzik prodüksiyonuyla ilgilenen herkes sampler denen cihazları bilir. Dış dünyadan alınan herhangi bir ses kaydedilir, kesilir ve bir klavye aracılığıyla farklı tonlarda çalınır. Peki bu yeni cihaz neden standart bir MPC’den çok farklı bir kulvarda yer alıyor?
| Özellik | Klasik Örnekleyici | Engram |
|---|---|---|
| Ses Kaynağı | Mikrofon, plak, dijital ses dosyası | Gerçek zamanlı yapay zeka hata akışı |
| Tetikleme Mekanizması | Kullanıcı dokunuşu ve MIDI sinyali | Yapay zeka mantık hatası ve sapma oranı |
| Yaratıcı Odak | Var olan sesi manipüle etmek | Beklenmeyen dijital kaosu yakalamak |
| Kullanım Amacı | Müzik üretimi, beat yapımı | Deneysel ses tasarımı, rastlantısal kompozisyon |
Geleneksel araçlar tamamen sizin ne verdiğinize odaklanırken, buradaki sistem dışsal ve öngörülemez bir algoritmik akışa bağımlı. Kodun nerede patlayacağını önceden kestiremediğiniz için, ortaya çıkan melodi de tamamen sürprizli oluyor.
Donanımsal Altyapı ve Sinyal Akışı
Bir donanım olarak Engram, ses modelleri kullanarak gelen sese AI uygulayan ve yeni sesler üretemeyen (metin modelleri olmayan), ses örnekleyicisi ve groovebox şeklinde çalışmaktadır. Siz sisteme absürt, karmaşık ya da çelişkili komutlar verirken, cihaz metin üretimi sırasındaki token olasılık dağılımını izliyor. Model kararsızlığa düştüğünde, yani kelime tahminlerinde sapma oranı (perplexity) yükseldiğinde, cihaz bu sayısal dalgalanmaları voltaj kontrol sinyallerine (CV) veya MIDI verilerine çeviriyor.
Bu mekanizma, modüler synthesizer dünyasındaki rastgele voltaj üreteçlerine (random voltage generators) benziyor. Ancak burada rastgelelik tamamen doğasız; insan benzeri ama mantıksız bir düşünce akışının dijital izinden besleniyor. Cihazın ön yüzündeki filtreler ve osilatörler, bu hatalı token akışını alıp square wave veya sawtooth dalgalarına dönüştürerek kulak tırmalamayan ama endüstriyel bir dokuya sahip frekanslar üretiyor.
Stüdyo Pratiğinde Karşılaşılan Zorluklar
Bu tarz deneysel araçların müzik stüdyolarına entegre edilmesi her zaman pürüzsüz ilerlemiyor. Standart bir DAW (Dijital Ses İş İstasyonu) ile senkronize çalışırken Engram, geleneksel tempo gridlerine uymayı reddedebiliyor. Yapay zekanın hata yaptığı anlar insan eliyle önceden planlanamayacağı için, geleneksel quantize (zamanlama oturtma) işlemleri burada geçersiz kalıyor.
Prodüktörlerin bu cihazla çalışırken kaydet tuşuna basıp uzun doğaçlamalar yapması ve ardından ortaya çıkan ham ses havuzundan en ilginç pasajları ayıklaması gerekiyor. Yani iş akışı, nota yazmaktan ziyade bir arkeloji kazısına ya da doğa kaydı (field recording) toplamaya benziyor.
Müzik Üreticileri İçin Ne Anlama Geliyor?
Her şeyin kusursuz ve pürüzsüz hale getirildiği bir dijital dünyada, bu tür arızalı makineler adeta birer kaçış noktası yaratıyor. Otomatik ayarlanmış sesler, kusursuz quantize edilmiş beat’ler ve birbirinin aynısı preset’lerden sıkılan yapımcılar için bu tarz donanımlar taze bir soluk demek.
Tabii ki bu cihazı alıp listelerde zirveye oynayacak pop şarkıları yapmak imkansız. Zaten amaç da bu değil. Underground elektronik müzik prodüktörleri, film müzisyenleri ve ses enstalasyonu sanatçıları için tasarlanmış niş bir oyuncakla karşı karşıyayız.
Teknoloji endüstrisi bize sürekli her şeyi daha hatasız yapma vaadi sunuyor. Ama bazen insan zihni o kusursuzlukta kayboluyor ve tam da o hatanın, o pürüzün peşinden gidiyor. Gelecekte yapay zekanın ne kadar kusursuz çalıştığıyla değil, ne kadar ilginç saçmaladığıyla ilgileneceğiz gibi duruyor.
Siz de bir yapay zekanın tamamen saçmaladığı o anı şarkınıza loop yapma fikrine sıcak bakar mısınız?
Kaynak: The Verge