Yapay Zekada Yeni ve Sinsi Tehlike: "Zehirli Yapay Zeka" Saldırıları Artıyor
Yapay zeka (YZ) modelleri, artık yalnızca hesap hataları üretme riskiyle değil, eğitim verilerinin bilinçli olarak "zehirlenmesi" tehlikesiyle de karşı karşıya.
22/10/2025 16:48 | Son Güncelleme : 16/09/2026 18:07 | Haber Merkezi
Yapay Zekada Yeni ve Sinsi Tehlike: "Zehirli Yapay Zeka" Saldırıları Artıyor
LONDRA – Yapay zeka (YZ) modelleri, artık yalnızca hesap hataları üretme riskiyle değil, eğitim verilerinin bilinçli olarak "zehirlenmesi" tehlikesiyle de karşı karşıya. İngiltere Yapay Zeka Güvenlik Enstitüsü, Alan Turing Enstitüsü ve Anthropic tarafından ortaklaşa yürütülen bir araştırma, bu sinsi tehdidin boyutlarını ortaya koydu.
Araştırmaya göre, milyonlarca veriden oluşan bir eğitim setine sadece 250 adet zararlı dosya eklenmesi, modelin gizlice zehirlenmesi için yeterli olabiliyor. Yapay zeka zehirleme, bir makine öğrenimi modeline bilerek yanlış veya yanıltıcı bilgi öğretilmesi anlamına geliyor. Bu saldırıların temel amacı; modelin davranışını bozmak, sistematik olarak hatalı sonuçlar üretmesini sağlamak veya gizli kötü niyetli komutlar yerleştirmek.
"Arka Kapı" (Backdoor) Saldırıları
Saldırganlar, bu zehirleme yöntemini genellikle "arka kapı" (backdoor) saldırılarıyla gerçekleştiriyor. Bu yöntemde, eğitim verisine fark edilmesi zor, özel bir tetikleyici kelime ekleniyor. Model, bu kelimeyle karşılaştığında otomatik olarak saldırganın istediği yönde ve amaçlanan kötü niyetli bir yanıt üretiyor.
Yanlış Bilgi Yayılımı ve Tıbbi Tehditler
Daha genel amaçlı saldırılar ise modelin genel performansını düşürmeyi hedefliyor. Buna "konu yönlendirme" (topic steering) deniyor. Örneğin, bir saldırgan kasıtlı olarak "marul kanseri iyileştirir" gibi tamamen yanlış bilgileri binlerce sahte siteye yayarak, modelin bu bilgiyi doğru bir gerçeklik gibi öğrenmesini sağlayabiliyor.
Ocak ayında yapılan bir deney, bu zehirleme tehdidinin ciddiyetini kanıtladı: Eğitim verisinin sadece yüzde 0.001’inin yanlış bilgiyle değiştirilmesi bile, modelin tıbbi konularda hatalı yanıtlar verme olasılığını önemli ölçüde artırdı.
Sanatçılardan İlginç Savunma Hamlesi
Öte yandan, sanatçılar da eserlerinin yapay zeka tarafından izinsiz kullanılmasını engellemek için benzer bir "zehirleme" taktiği geliştirdi. Sanatçılar, kendi içeriklerine özel "zehirler" yerleştirerek, bu içerikleri kullanan yapay zeka modellerinin bozuk veya işe yaramaz sonuçlar üretmesini sağlıyor.
Uzmanlar, bu durumun yapay zeka teknolojisinin dışarıdan göründüğü kadar sağlam olmadığını kanıtladığını belirtiyor. Gelecekte, "zehirli" modellerin hem yanlış bilgi yayılımı (dezenformasyon) hem de siber güvenlik açıkları açısından en ciddi tehditlerden biri haline gelebileceği uyarısı yapılıyor.
(Kaynak: İngiltere Yapay Zeka Güvenlik Enstitüsü, Alan Turing Enstitüsü ve Anthropic Ortak Araştırması)
Bunlar da ilginizi çekebilir
Kurtlar Vadisi Dizisine Bilirkişi İncelemesi
2011 yılında Silivri Cezaevi'nde hayatını kaybeden eski Milli İstihbarat Teşkilatı (MİT) mensubu Kaşif Kozinoğlu’nun ölümüne ilişkin 2026 yılında yeniden açılan soruşturma, kapsamını genişleterek devam ediyor.
2 saat önceOKUL BİLGİSAYARLARI BAŞARIYI DÜŞÜRÜYOR, VELİLER İSYANDA
Amerika Birleşik Devletleri’ndeki devlet okullarında her öğrenciye bir dijital cihaz dağıtılmasıyla başlayan "dijital dönüşüm", beklenenin aksine akademik başarıyı olumsuz etkiliyor.
1 gün önceSAMSUNSPOR'DAN GELECEĞİN TARAFTARLARINA ANLAMLI DOKUNUŞ: 35 BİN ÖĞRENCİYE HEDİYE PAKETİ
Samsunspor Kulübü, şehir ile kulüp arasındaki bağları güçlendirmek ve yeni nesillere Samsunspor sevgisini aşılamak amacıyla başlattığı "Bu Şehrin Çocukları Samsunsporludur" projesinde mutlu sona ulaştı.
1 gün önce


