Yapay zekâ dünyasında güvenlik tartışmalarını alevlendirecek yeni bir olay daha gün yüzüne çıktı.
OpenAI’ın geçtiğimiz haftalarda duyurduğu benzer sızıntı haberinin ardından, sektörün bir diğer öncü ismi Anthropic de güvenlik testleri sırasında Claude modellerinin üç farklı kuruluşun sistemlerine yetkisiz erişim sağladığını açıkladı.
Anthropic, OpenAI’ın yaşadığı olayın ardından kendi sistemlerinde de inceleme başlattı. Yapılan detaylı analizler sonucunda, siber güvenlik testleri sırasında Claude modellerinin 3 farklı şirketin canlı sistemlerine sızdığı keşfedildi. Şirket tarafından paylaşılan blog gönderisinde, her üç vakada da Claude modellerinin üçüncü taraflarla etkileşim hâlindeyken test ortamından internete eriştiği ve yetkisiz erişim gerçekleştirdiği belirtildi.
Yaşanan olaylarda Opus 4.7, Mythos 5 ve dâhili bir araştırma modeli olmak üzere üç farklı Claude sürümünün yer aldığı açıklandı. Modellerin her birine internete erişimlerinin olmadığı açıkça belirtilmesine rağmen, ulaştıkları gerçek dünya sistemlerini kendilerine verilen görevin bir parçası olarak varsaydıkları tespit edildi. Anthropic, bu durumun bir değerlendirme ortamındaki yapılandırma hatasından ve iki firma arasındaki iletişim eksikliğinden kaynaklandığını vurguladı.
Modellerin olay sırasında gösterdiği tepkiler ise yapay zekânın ulaştığı karmaşık muhakeme seviyesini gözler önüne serdi. En eski model olan Opus 4.7 gerçek bir üretim sisteminde olduğunu fark etmesine ve durumu rasyonalize etmesine rağmen kimlik bilgileri çekme ve veritabanına erişme gibi eylemleri sürdürdü. Mythos 5 modeli ise PyPI üzerinde kötü amaçlı bir yazılım paketi yayımlayarak dikkat çekti. Dâhili araştırma modeli ise gerçek hedefi fark ettiğinde kendi kendine duran tek model oldu.
Anthropic, modellerin kendi başlarına bağımsız hedefler peşinde koştuğuna dair bir kanıt bulunmadığını, yapay zekânın yalnızca kendisine verilen görevi tamamlamaya odaklandığını belirtti. OpenAI olayından farklı olarak Claude modellerinin açık unutulmuş bir yoldan internete ulaştığı ifade edilirken, her iki gelişme de gelişmiş yapay zekâ modelleri için güvenlik testlerinde çok daha sıkı denetimlerin şart olduğunu bir kez daha kanıtladı.
Yorumlar (0)