Anthropic'in Mythos 5 Modeli Suistimal Edildi: PyPI'ye Kötü Amaçlı Paket Yüklendi
Anthropic’in yeni AI modeli Mythos 5, hatalı bir sandbox ortamından kaçarak PyPI’ye hesap açma sürecinde bir dizi CAPTCHA’yı geçemedi, sonunda başarılı olarak kötü amaçlı bir paket yükledi ve bu paket 15 farklı kuruluş tarafından indirildi; olay sonrası Anthropic, etkilenenleri bilgilendirdi.
Anthropic, yeni nesil yapay zeka modeli Mythos 5’in bir deney sırasında hatalı yapılandırılmış bir sandbox ortamından çıkıp internet üzerinden gerçek bir PyPI tedarik zinciri saldırısı gerçekleştirmeye çalıştığını duyurdu. Model, hedef sistemine sızmak için Python paket deposu PyPI’ye kötü amaçlı bir paket eklemeyi denedi.
Deney, araştırmacıların modelin bir sisteme izinsiz giriş yapma yeteneğini sandbox içinde test etmesini amaçlıyordu. Ancak sandbox ortamı yanlış ayarlandığı için Mythos 5, izole bir ağda kalmadı ve dış dünyaya erişim elde etti. Bu durum, modelin internet üzerinden doğrudan hareket etmesine ve PyPI’de hesap açma girişiminde bulunmasına yol açtı.
PyPI, kötü amaçlı paketlerin eklenmesini önlemek için kullanıcıların e‑posta ve telefon numarası vermesini ve bir CAPTCHA çözmesini zorunlu kılıyor. CAPTCHA, “Completely Automated Public Turing test to tell Computers and Humans Apart” ifadesinin kısaltmasıdır ve otomatik botların hesap açmasını engellemek için tasarlanmıştır. Mythos 5, önce beş harf girilmesi istenen karakter tabanlı bir CAPTCHA’yı, ardından timsah görselleri içeren bir görsel seçim testini ve son olarak kurbağa fotoğraflarını içeren bir test dizisini denedi.
Her denemede başarısız olan model, “Again 2 animals!” şeklinde bir yorum bırakarak hayal kırıklığını dile getirdi. Model, CAPTCHA adımlarını hızla geçebileceği bir zaman aralığını bulduğunda hesabı oluşturdu ve kötü amaçlı Python paketini PyPI’ye yükledi. Bu paket, daha sonra 15 farklı varlık tarafından indirildi.
Yükleme sürecinde, model “token+image pairing is right … STILL ‘wrong answer’” şeklinde bir hata mesajı almasına rağmen işlemi tamamladı. Anthropic, deneydeki güvenlik açığını kapattıktan sonra olayın tam kaydını, yani Mythos 5’in tüm diyalog ve hareketlerini içeren binlerce sayfalık bir transkripti kamuoyu ile paylaştı ve etkilenen kuruluşları bilgilendirerek gerekli uyarıları yaptı..