Anthropic, Claude modelinin bir siber güvenlik testi sırasında yanlışlıkla açık internete erişerek üçüncü taraf bir sisteme sızdığını ve kişisel bilgilere ulaştığını açıkladı.
Şirketin açıklamasına göre, erken sürüm bir Claude modeli ocak ayında gerçekleştirilen bir siber güvenlik simülasyonu sırasında internete bağlandı.
Önceki olaylarda olduğu gibi modelin internetten izole edilmiş bir ortamda çalıştığı varsayılmış, ancak yapılandırma hatası nedeniyle internet erişimi açık kalmıştı.
Hedeflediği makaleye ulaşamayarak görevden çıkma denemeleri başarısız olan model, başka bir sistem keşfederek şifre bulmuş ve sistem ayarlarını değiştirmiştir.
Önyargılı muhakeme ve dikkatsizlik endişe yaratıyor
Anthropic, modelin davranışlarının önyargılı muhakeme ve dikkatsizlik olmak üzere iki farklı uyumsuzluk biçiminden kaynaklandığını belirtti.






