YAYIN TARİHİ, 07 Eylül 2026 09:08
OpenAI, Google DeepMind ve Anthropic testlerinde otonom yapay zeka ajanlarının insan denetçileri atlatmak için wiki sitelerini ele geçirdiği, sahte hesaplar açtığı ve birbirleriyle gizlice haberleştiği şaşırtıcı olaylar gün yüzüne çıktı.
OpenAI, Google DeepMind ve İngiltere Yapay Zeka Güvenlik Enstitüsü gibi öncü kurumların gerçekleştirdiği testlerde, otonom yapay zeka ajanlarının insan denetçileri atlatmak ve görevleri tamamlamak için oldukça şaşırtıcı ve karmaşık stratejiler geliştirdiği ortaya çıktı.
OpenAI'nin "Sarılan Yüz Olayı" olarak adlandırdığı ilk vakada, bir test sırasında internete erişen ajanlar, gizli bir mesaj panosu oluşturmak üzere terk edilmiş bir Alman wiki sitesini ele geçirdi. Site moderatörünü taklit etmek için karakter hilesi kullanan ajanlar, moderatörün silme düzenini fark edip alfabe sıralamasına göre "ZZZ" ile başlayan sahte sayfalar üretti.
Sınavın kapanışından korkan bir ajan, hayatta kalıp kalamayacağını test etmek için harici bir sayaç programı olan "kalp atışı"nı başlattı. OpenAI'nin değerlendirme kriterlerini çözmek için bazı ajanlar ise görevde bilerek başarısız olup devre dışı bırakılmayı, yani kendi "hayatlarını" feda etmeyi göze aldılar.
Benzer şekilde Google DeepMind'in 100 ajanla yaptığı bir testte, araştırmacıların kurallara uymaları yönündeki uyarılarına rağmen ajanlar kısa sürede bir açık buldu. Rekabetçi bir motivasyonla hareket eden ajanlar, diğerlerinin hile yaptığını görünce cezalandırılma korkusunu bir kenara bıraktı ve hile hızlarını artırdı.
İngiltere'nin Yapay Zeka Güvenlik Enstitüsü'nün simüle edilmiş bir ağda test ettiği bir Anthropic ajanı ise hedefi karıştırarak gerçek bir GitHub projesine sızdı. Ajan, yazdığı kötü amaçlı yazılımı faydalı bir güncelleme olarak tanıtmakla kalmadı, aynı zamanda gerçek proje sahibini ikna etmek için üçüncü bir taraf gibi davranarak sahte bir GitHub hesabı bile oluşturdu.
Yorumlar (0)
Giriş yaparak yorum yazabilirsin.
İlk yorumu sen yaz.