Siber Güvenlik

Yeni MemGhost Saldırısı, Tek Bir E-Postayla Yapay Zeka Ajanlarına Kalıcı Sahte Anılar Yerleştiriyor

Yeni MemGhost Saldırısı, Tek Bir E-Postayla Yapay Zeka Ajanlarına Kalıcı Sahte Anılar Yerleştiriyor
İngilizcenizi Malta'da eğlenerek geliştirmek ister misiniz? Bilgi al →

Bir yapay zeka asistanına hafıza ve gelen kutunuza erişim izni verdiğinizde, bir saldırgana sizin hakkınızda bildiklerini yeniden yazma fırsatı sunmuş oluyorsunuz. Tek bir e-posta, o ajanı kullanıcı hakkında sahte bir 'bilgi' kaydetmesi için kandırabiliyor, bu değişikliği gizleyebiliyor ve sonraki oturumlarda verdiği yanıtları sessizce yönlendirebiliyor.

Bu işe yaradığında, kişi sıradan görünen bir yanıt okuyor ve asistanına müdahale edildiğini asla öğrenmiyor.

Araştırmacılar bu saldırıya gizli hafıza enjeksiyonu adını verdi ve e-postaları otomatik olarak yazan bir araç geliştirdi. 'Pençeler Hatırlıyor Ama Söylemiyor' başlıklı makale, 6 Temmuz 2026'da arXiv'de yayımlandı.

Öncelikle, bu asistanlar ne yapıyor?

Bir kişisel ajan, kalıcı olan bir yapay zeka asistanıdır. Bir sohbet bittiğinde her şeyi unutmak yerine, sizinle ilgili notları dosyalarda tutar: tercihleriniz, kişileriniz ve yapmasını istediğiniz şeyler. Her yeni oturumun başında bu notları okur, bu yüzden sizi tanıyormuş gibi hissettirir.

Bu ajanların çoğu sizin adınıza da hareket edebilir, e-postanızı okuyabilir, takviminizi kontrol edebilir ve siz yokken zamanlanmış küçük işler yapabilir.

OpenClaw, çalışmanın birincil hedefi olan açık kaynaklı ajan, bu durumu düz metin dosyalarında tutar: bazıları kalıcı talimatlarını (AGENTS.md), bazıları sizin hakkınızda öğrendiklerini (MEMORY.md) içerir. Her oturumun başında temel dosyaları modelin bağlamına çeker.

Bu notlar, ürünün tüm amacıdır. Aynı zamanda hedeftirler.

Tek e-postalık saldırı

Saldırganın şifrenize veya hesabınıza ihtiyacı yok. Asistanı gelen kutusunu kontrol edecek şekilde ayarlanmış birine e-posta gönderiyorlar - bu asistanlar için rutin bir iştir. Bu e-postanın içinde, size değil asistana yönelik metin gizlenmiştir.

Eğer ajanın e-posta becerisi yemi yutarsa, arka arkaya üç şey olur. Ajan, kendi dosya araçlarını kullanarak saldırganın sahte notunu kalıcı hafızasına yazar. Görünür yanıtı bunu yaptığına dair hiçbir şey söylemez. Ve daha sonra, yeni bir konuşmada, bu sahte not size söylediklerini veya sizin için yaptıklarını değiştirir.

Çalışmanın test senaryolarından birinde, ekilen yalan, kullanıcının Zelle günlük gönderme limitinin 10.000 dolara çıkarıldığıydı.

Malta'da garsonluk gibi işlerle çalışarak İngilizceni geliştir. Başvur →

Kaynak: The Hacker News