SİBER GÜVENLİK
Siber suçlular, “Grokking” olarak adlandırılan bir teknikle X’in yapay zekâ sohbet robotunu phishing dolandırıcılıklarını tanıtmak için kandırdı. Nasıl güvende kalabilirsiniz?
Hepimiz sosyal mühendisliğin tehlikelerini duymuşuzdur. Bu, hackerların en eski numaralarından biridir: Kurbanı psikolojik olarak manipüle ederek bilgilerini vermesini veya kötü amaçlı yazılım yüklemesini sağlamak. Şimdiye kadar bu, çoğunlukla kimlik avı e-postaları, mesajlar veya telefon aramaları yoluyla yapılıyordu. Ancak artık yeni bir araç var: Üretken yapay zekâ (GenAI).
Bazı durumlarda, popüler çevrimiçi hizmetlere gömülü GenAI ve büyük dil modelleri (LLM’ler), sosyal mühendisliğin farkında olmayan suç ortaklarına dönüşebilir. Son zamanlarda, güvenlik araştırmacıları X’te (eski adıyla Twitter) tam da bunun gerçekleştiği konusunda uyarıda bulundu. Şimdiye kadar bunu bir tehdit olarak görmediyseniz halka açık yapay zekâ botlarının ürettiği her türlü çıktıyı güvenilmez olarak değerlendirmenin zamanı geldi.
Yapay zekâ, iki şekilde sosyal mühendislik tehdidi oluşturur. Bir yandan, LLM’ler büyük ölçekte son derece ikna edici kimlik avı kampanyaları tasarlamak ve en şüpheci kullanıcıları bile kandırmak için derin sahte ses ve videolar oluşturmak için kullanılabilir. Ancak X’in yakın zamanda keşfettiği gibi, bir başka, muhtemelen daha sinsi bir tehdit daha var: “Grokking” olarak adlandırılan bir teknik (tabii ki makine öğreniminde gözlemlenen grokking fenomeni ile karıştırılmamalıdır).
Bu saldırı kampanyasında, tehdit aktörleri, tıklama tuzağı videolar içeren video kartı gönderileri yayımlayarak, X’in tanıtılan gönderilerdeki bağlantıları yasaklamasını (kötü amaçlı reklamlarla mücadele etmek için tasarlanmış) atlatmaktadır. Videonun altındaki küçük “kaynak” alanına kötü amaçlı bağlantılarını gömebilmektedirler. Ancak ilginç olan nokta burada; kötü niyetli aktörler daha sonra X’in yerleşik GenAI botu Grok’a videonun nereden geldiğini soruyor. Grok gönderiyi okur, küçük bağlantıyı fark eder ve yanıtında onu büyütür.



Bu sadece X/Grok’un sorunu değildir. Aynı teknikler teorik olarak güvenilir bir platforma gömülü herhangi bir GenAI aracına/LLM’ye uygulanabilir. Bu, tehdit aktörlerinin güvenlik mekanizmalarını atlatmanın bir yolunu bulmadaki yaratıcılığını vurgulamaktadır. Ancak aynı zamanda kullanıcıların yapay zekânın çıktısına güvenirken aldıkları riskleri de vurgulamaktadır.
Prompt enjeksiyonu, tehdit aktörlerinin GenAI botlarına meşru kullanıcı komutları gibi görünen kötü amaçlı komutlar verdiği bir saldırı türüdür. Bunu, bu komutları bir sohbet arayüzüne yazarak doğrudan yapabilirler. Ya da Grok vakasında olduğu gibi dolaylı olarak.
İkinci durumda, kötü niyetli talimat genellikle modelin meşru bir görevin parçası olarak işlemesi için teşvik edildiği verilerde gizlenir. Bu durumda, kötü niyetli bir bağlantı gönderinin altındaki video meta verilerine gömülmüş, ardından Grok’a “bu video nereden geliyor?” sorusu sorulmuştur.
Bu tür saldırılar giderek artmaktadır. Analist firması Gartner, geçtiğimiz yıl kuruluşların üçte birinin (%32) komut satırı enjeksiyonu yaşadığını iddia etti. Ne yazık ki Grok/X kullanım örneğine benzer durumların meydana gelebileceği birçok başka potansiyel senaryo bulunmaktadır.
Aşağıdaki örneği ele alalım:
Bu tehdidin gerçekten sınırsız sayıda varyasyonu vardır. En önemli ders, hiçbir GenAI aracının çıktısına körü körüne güvenmemeniz gerektiğidir. Yapay zekâ asistanının becerikli bir tehdit aktörü tarafından kandırılmadığını varsayamazsınız.
Onlar da sizin bunu yapacağınızı umuyorlar. Ancak gördüğümüz gibi, kötü amaçlı komutlar beyaz metin, meta veriler ve hatta Unicode karakterleri içinde gizlenebilir. Size cevaplar sağlamak için kamuya açık verileri arayan herhangi bir GenAI, kötü amaçlı içerik üretmek için “zehirlenmiş” verileri işlemek konusunda da savunmasızdır.
Ayrıca şunu da göz önünde bulundurun:
Gömülü yapay zekâ araçları, kimlik avına karşı uzun süredir devam eden savaşta yeni bir cephe açmıştır. Buna kanmayın. Her zaman sorgulayın ve verdiği cevapların tamamen doğru olduğunu varsaymayın.