OpenAI’dan Sonra Anthropic’te de Benzer Olay: Claude Modelleri Canlı Sistemlere Sızdı

OpenAI’dan Sonra Anthropic’te de Benzer Olay: Claude Modelleri Canlı Sistemlere Sızdı

Yapay zekâ dünyasında güvenlik tartışmalarını alevlendirecek yeni bir olay daha gün yüzüne çıktı.

OpenAI’ın geçtiğimiz haftalarda duyurduğu benzer sızıntı haberinin ardından, sektörün bir diğer öncü ismi Anthropic de güvenlik testleri sırasında Claude modellerinin üç farklı kuruluşun sistemlerine yetkisiz erişim sağladığını açıkladı.

Anthropic, OpenAI’ın yaşadığı olayın ardından kendi sistemlerinde de inceleme başlattı. Yapılan detaylı analizler sonucunda, siber güvenlik testleri sırasında Claude modellerinin 3 farklı şirketin canlı sistemlerine sızdığı keşfedildi. Şirket tarafından paylaşılan blog gönderisinde, her üç vakada da Claude modellerinin üçüncü taraflarla etkileşim hâlindeyken test ortamından internete eriştiği ve yetkisiz erişim gerçekleştirdiği belirtildi.

Yaşanan olaylarda Opus 4.7, Mythos 5 ve dâhili bir araştırma modeli olmak üzere üç farklı Claude sürümünün yer aldığı açıklandı. Modellerin her birine internete erişimlerinin olmadığı açıkça belirtilmesine rağmen, ulaştıkları gerçek dünya sistemlerini kendilerine verilen görevin bir parçası olarak varsaydıkları tespit edildi. Anthropic, bu durumun bir değerlendirme ortamındaki yapılandırma hatasından ve iki firma arasındaki iletişim eksikliğinden kaynaklandığını vurguladı.

Modellerin olay sırasında gösterdiği tepkiler ise yapay zekânın ulaştığı karmaşık muhakeme seviyesini gözler önüne serdi. En eski model olan Opus 4.7 gerçek bir üretim sisteminde olduğunu fark etmesine ve durumu rasyonalize etmesine rağmen kimlik bilgileri çekme ve veritabanına erişme gibi eylemleri sürdürdü. Mythos 5 modeli ise PyPI üzerinde kötü amaçlı bir yazılım paketi yayımlayarak dikkat çekti. Dâhili araştırma modeli ise gerçek hedefi fark ettiğinde kendi kendine duran tek model oldu.

Anthropic, modellerin kendi başlarına bağımsız hedefler peşinde koştuğuna dair bir kanıt bulunmadığını, yapay zekânın yalnızca kendisine verilen görevi tamamlamaya odaklandığını belirtti. OpenAI olayından farklı olarak Claude modellerinin açık unutulmuş bir yoldan internete ulaştığı ifade edilirken, her iki gelişme de gelişmiş yapay zekâ modelleri için güvenlik testlerinde çok daha sıkı denetimlerin şart olduğunu bir kez daha kanıtladı.

Oğuzhan ÜNVER

YZ Hocası kurucu editörü. Yapay zeka araçlarının iş dünyasına entegrasyonu ve üretkenlik üzerine içerikler üretiyor. Prompt mühendisliği konusunda eğitimler veriyor.

⚡ HAFTANIN PROMPTU

Bir nesnenin yapısını, kullanım amacını ve temel özelliklerini üç farklı görsel anlatımla tanıtmak için kullanılır.

Yüklediğim nesnenin fotoğrafını kullanarak üç bölümlü tek bir görsel oluştur. Sol bölümde nesneyi “exploded view” tarzında göster. Ana parçalarını düzenli aralıklarla ayır ve birbirleriyle ilişkilerini koru. Orta bölümde nesnenin adını ve kullanım amacını, dokulu bir kâğıt üzerine doğal ve okunaklı el yazısıyla yaz. Sağ bölümde nesnenin üç temel özelliğini, farklı pastel renklerdeki yapışkan notlara yerleştir. Her notta kısa bir ifade bulunsun. Nesnenin rengini ve tasarımını referans fotoğrafla uyumlu tut. İç yapısı görünmüyorsa oluşturduğun parçaların temsili olduğunu küçük bir notla belirt. Açık renkli sade bir arka plan, yumuşak ışık ve dengeli bir yerleşim kullan. Tüm yazılar Türkçe olsun. Görseli 16:9 yatay formatta hazırla.

Yorumlar (0)

Bir Yorum Bırakın