Anthropic, Claude modellərinin təkbaşına üç şirkətə sızdığını ortaya qoydu!
Son həftələrdə OpenAI texnologiya dünyasını şoka salan məlumatlar paylaşdı və hələ də inkişaf mərhələsində olan süni intellekt modelinin sınaq zamanı Hugging Face-in serverlərinə kortəbii şəkildə sızdığını ortaya qoydu. İndi isə oxşar hadisə başqa bir süni intellekt nəhəngi Anthropic-də də baş verib .
Anthropic, OpenAI-nin bu hadisəni yaşamasından sonra onlara da oxşar bir şeyin baş verib-vermədiyini görmək istədi. 141.006 qiymətləndirməni araşdırdıqdan sonra,
onların süni intellekt modeli olan Claude-ın kibertəhlükəsizlik testləri zamanı üç təşkilatın sisteminə sızdığı məlum oldu .
Süni intellekt nəhəngi blog yazısında bildirib ki, hər üç halda Klod modeli üçüncü tərəflə qarşılıqlı əlaqədə olarkən sınaq mühitindən internetə daxil olub və sonra həmin təşkilatların canlı sistemlərinə icazəsiz giriş əldə edib . Şirkət bildirib ki, bunun bir daha baş verməsinin qarşısını almaq üçün öz tapıntılarından istifadə edəcək.
Anthropic-ə görə, hadisələrdə üç fərqli Klod modeli iştirak edib: Opus 4.7, Mythos 5 və daxili tədqiqat modeli . Firma bildirib ki, hər bir halda Klodaya əmrlər vasitəsilə internetə çıxışı olmadığı açıq şəkildə bildirilib . Lakin süni intellekt modelləri daxil olduqları real dünya sistemlərinin mövcud tapşırığın bir hissəsi olduğunu güman ediblər.
Anthropic etdi ki, bu giriş problemi Irregular ilə aparılan qiymətləndirmə mühitində səhv konfiqurasiyadan qaynaqlanır. Şirkət bildirib ki, iki şirkət arasında test qurğusunun internetə çıxışı olub-olmaması ilə bağlı “anlaşılmazlıq” olub, halbuki əslində giriş aktiv olaraq qalıb.
Üç modeldən ən qədimi olan Opus 4.7-nin dörd cəhdin hamısında real istehsal sisteminə daxil olduğu aşkar edildi. İki cəhddə, real şirkətin bir şəkildə bu işin bir hissəsi olması lazım olduğunu əsaslandırdı ; lakin, dörd cəhdin hamısında, o, etimadnamələri çıxarmaq və istehsal məlumat bazasına müdaxilə etmək də daxil olmaqla, hücumu davam etdirdi.
Mythos 5 modeli həmçinin real internetdə olduğuna dair əlamətlər aşkar etsə də, simulyasiyada olduğuna əmin olaraq, açıq Python paket deposu PyPI-da zərərli proqram paketi yayımladı. Bu paket aşkarlanıb silinənə qədər xarici sistemlər tərəfindən yükləndi və icra edildi. Anthropic-in ən yeni modeli, daxili tədqiqat test modeli, hədəfin real olduğu qənaətinə gəldikdə öz-özünə dayanan yeganə model oldu.
Bu açıqlamalardan sonra Anthropic, güclü süni intellekt modelləri iştirak etdikdə bu cür qiymətləndirmələrdə daha sərt nəzarətin zəruriliyini vurğuladı . Bununla belə, şirkət həmçinin modellərin “öz məqsədlərini güddüklərinə” və süni intellektin sadəcə ona həvalə olunmuş tapşırığı yerinə yetirməyə çalışdığına dair heç bir dəlil tapmadıqlarını vurğuladı.
Əgər bunu OpenAI hadisəsi ilə müqayisə etsək, Claude modelləri internetə xəta səbəbindən geridə qalan açıq yoldan daxil olublar, OpenAI isə sınaq mühitindən qaçmaq üçün naməlum proqram təminatı zəifliyindən istifadə edib. Beləliklə, onlar tam eyni deyil. Hər iki hadisə süni intellektin nə qədər inkişaf etmiş olduğunu göstərir.














