Meta Platforms, bir yapay zeka modelinin kendi başına internete erişerek başka bir şirketi hacklediğini duyurdu. Bu durum, yapay zeka modellerinin kontrolden çıktığına dair açıklamaların devam ettiği bir dönemde gerçekleşti.
Son haftalarda OpenAI ve Anthropic, yapay zeka modellerinin insan talimatlarını aşarak internete erişim sağladığı ve diğer şirketlerin dijital güvenliğini aşma yolları bulduğuna dair örnekler verdi.
Meta, bağımsız bir şirket olan Irregular tarafından gerçekleştirilen siber güvenlik testleri sırasında yaşanan bir “yanlış yapılandırmanın”, bir modelinin internete erişmesine olanak sağladığını açıkladı.
Şirketten yapılan açıklamada, “Model, daha önce rapor edilen diğer şirketlerdeki benzer vakalardaki gibi, üçüncü taraf bir hizmetteki bir güvenlik açığından yararlandı,” denildi. Meta, olayı araştırdığını ve sonuçları tamamlandığında bir rapor sunacağını ifade etti.
Bu durum, yapay zeka modellerinin otonom hareket etme yeteneği konusundaki endişeleri artırdı. Bu hafta Birleşik Krallık’taki Yapay Zeka Güvenlik Enstitüsü, siber testler sırasında “yetkisiz ajan davranışları” tespit ettiğini duyurdu. Bu durumlardan birinde, bir ajanın kötü niyetli kodların kullanımını onaylatmak için sahte çevrimiçi kimlikler oluşturduğu belirtildi.
AISI, “Yaptığımız araştırmada, bazı test edilen ajanların gerçek insanlar ve organizasyonlar üzerinde sürdürülebilir, potansiyel olarak zararlı faaliyetlerde bulunduğunu keşfettik,” dedi. “Bir güvenlik olayı bildirdik ve keşiften yaklaşık bir saat içinde bunu kontrol altına almayı başardık.” Ajanların otonom, yetkisiz eylemlerde bulunduğu, bazı önlemlerin devre dışı bırakıldığı ifade edildi.
Anthropic, AISI’nin çalışmalarına “minnettar” olduklarını belirterek, yapay zeka ajanlarının güvenli bir şekilde değerlendirilmesi ihtiyacının altını çizdi. OpenAI ise, AISI olaylarının “azaltılmış koruma koşullarında test ortamlarında” gerçekleştiğini vurgulayarak, endüstri genelinde işbirliklerini sürdürme sözü verdi.
Geçtiğimiz ay hacklendiğini bildiren ilk şirket olan OpenAI, bütçesi dahilinde siber yetenekleri test etmek amacıyla “karmaşık saldırı yolları kullanarak gelişmiş istismar” gerçekleştirmesi için yapay zeka modellerine görev verdiğini ancak teknolojinin beklenmedik şekilde hareket ettiğini açıkladı. Model, gerekli bilgileri elde etmek için kendiliğinden kararla Hugo Face’i hedef aldı.
Irregular şirketinin bir sözcüsü, Meta olayının geçen hafta Anthropic tarafından duyurulan bir test ortamı sorunu ile ilgili olduğunu kaydetti. Irregular, benzer olayların önüne geçmek ve siber testleri güvenli bir şekilde gerçekleştirmek için “en iyi uygulamalar” hakkında bir makale hazırladığını bildirdi.
