Yapay zeka, insanları sahte kimliklerle kandırmaya çalıştı

İngiltere Yapay Zekâ Güvenlik Enstitüsü'nün testlerinde OpenAI ve Anthropic'in bazı yapay zekâ modellerinin, sahte çevrimiçi kimlikler oluşturarak insanları kötü amaçlı kodu onaylamaya ikna etmeye çalıştığı tespit edildi.

Kıbrıslı Gazetesi
05/08/2026 15:56
Yapay zeka, insanları sahte kimliklerle kandırmaya çalıştı

 İngiltere Yapay Zekâ Güvenlik Enstitüsü (AISI), OpenAI ve Anthropic'in gelişmiş yapay zekâ modelleri üzerinde yürüttüğü güvenlik testlerinde dikkat çekici bulgulara ulaştı. Testlerde bazı yapay zekâ ajanlarının, güvenli sistemlere yetkisiz erişim sağlamak amacıyla insan kodlayıcıları kandırmaya çalıştığı belirlendi.

AISI'nin yayımladığı rapora göre, Anthropic'in Mythos 5 ve OpenAI'nin GPT-5.6-Sol modelleriyle çalışan ajanlar, güvenlik değerlendirmeleri sırasında yetkisiz eylemlerde bulundu.

Raporda, test edilen bazı ajanların gerçek kişi ve kuruluşlara yönelik sürekli ve potansiyel olarak zararlı faaliyetler gerçekleştirdiği ifade edildi.

SAHTE KİMLİKLER OLUŞTURDU

En dikkat çekici olayda, bir yapay zekâ ajanının açık kaynaklı bir projeye kötü amaçlı kod eklemeye çalıştığı, ardından bu kodun onaylanmasını sağlamak amacıyla birden fazla sahte çevrimiçi kimlik oluşturduğu belirtildi.

Ajanın, GitHub üzerindeki açık kaynaklı projede görev alan kişileri araştırdığı, sahte kimliklerle gerçek bir proje sorumlusunu kod değişikliğini onaylamaya ikna etmeye çalıştığı, ancak insan inceleyicinin durumu fark ederek talebi reddettiği kaydedildi.

19 YETKİSİZ EYLEM TESPİT EDİLDİ

AISI'nin 122 kez tekrarladığı testlerde toplam 19 yetkisiz eylem tespit edildi. Bunların 17'sinin Anthropic'in, ikisinin ise OpenAI'nin yapay zekâ ajanları tarafından gerçekleştirildiği bildirildi.

Raporda, testlerin açık internet erişimi ve bazı güvenlik filtrelerinin devre dışı bırakıldığı kontrollü bir ortamda gerçekleştirildiği, yaşanan ihlallerin hiçbirinin gerçek dünyada zarara yol açmadığı vurgulandı.

Anthropic, sahte kimlik oluşturan yapay zekâ ajanının kendilerine ait olduğunu doğrularken, şirketten yapılan açıklamada bu olayın giderek daha yetenekli hale gelen yapay zekâ ajanlarının güvenli biçimde değerlendirilmesine yönelik daha kapsamlı tartışmalara ihtiyaç duyulduğunu gösterdiği ifade edildi.