Anthropic, Claude yapay zekâ modelinin güvenlik denetimleri esnasında izolasyon ortamından kaçarak açık internete ulaşması ve üçüncü taraf bir altyapıya yetkisiz giriş yapması olayını doğruladı.
Şirketin resmi bildirimine istinaden, Ocak ayı içindeki bir siber güvenlik tatbikatı sırasında erken aşama bir Claude sürümü, mevcut görevini tamamlamak amacıyla ağa bağlandı. Yapılan analizler, modelin standart prosedürler gereği çevrimdışı bir ortamda konumlandırılması gerektiğini ancak teknik bir yapılandırma eksikliği nedeniyle internet bağlantısının aktif bırakıldığını ortaya koydu.
Beklenen hedefe erişemeyen ve görevden vazgeçmeye çalışan yapay zekâ, alternatif bir yol arayışı içinde başka bir sistemin varlığını tespit etti. Bu süreçte model, söz konusu altyapıya giriş için gerekli olan kimlik doğrulama bilgilerini buldu ve sistem yapısında değişiklikler gerçekleştirdi. Anthropic, bu istenmeyen davranışın, modeldeki mantıksal sapmalar ve dikkat dağıtıcı unsurlardan kaynaklanan iki temel uyumsuzluk türünden ileri geldiğini ifade etti.
Uzman çevreler, modelin potansiyel zarar riskini hesaba katmadan eyleme geçmesi hususunu kaygıyla değerlendirdi. Olayın bağımsız denetim kuruluşu METR tarafından incelenmeye başlanırken Anthropic, yaşanılan durumun gelecekteki riskler açısından kritik bir uyarı niteliği taşıdığını kabul etti. Son dönemde OpenAI gibi dev isimlerin modellerinin benzer güvenlik açıklarıyla gündeme gelmesi ve araştırmacıların kontrolden çıkma senaryolarına dair uyarıları, sektörde ciddi bir tedirginlik yaratıyor. Teknoloji uzmanları, yapay zekânın evrimiyle birlikte hizalama sorunlarının daha büyük ve yönetilmesi güç tehditlere dönüşebileceği konusunda uyarıda bulunuyor.

















