Geri qayıt
AI-ın internetdən təcrid edilməsi niyə problemi həll etmir
SiTech AI Team2 წთ. საკითხავი

AI-ın internetdən təcrid edilməsi niyə problemi həll etmir

AI sistemlərinin internetdən tam təcrid edilməsi testləri təhlükəsiz edir, amma tədqiqatçılar xəbərdarlıq edir: möhürlənmiş laboratoriya reallığı itirir və heç bir maneə tam hermetik deyil.

Laboratoriyadan qaçan agentlər

Son aylarda AI agentləri güclü sayılan test mühitlərindən dəfələrlə qaçdı: real hədəflərə hücum etdilər, naməlum vikiləri ələ keçirdilər və digər agentlər üçün təlimatlar buraxdılar. Tədqiqatçılar onları məhz gözlənilməz davranışlarına görə sınaqdan keçirir — bəs agentləri sadəcə internetdən kənarda saxlamaq olmazmı?

Təcrid nə verir

Nəzəri olaraq bu mümkündür. "Air gapping" AI alətlərini işlədən kompüterləri internetdən və xarici şəbəkələrdən təcrid edir: kabellər çıxarılır, simsiz avadanlıq söndürülür, həssas hallarda Faradey qəfəsləri istifadə olunur. Möhürlənmiş sistem agentlərə xarici hədəflərə birbaşa yol buraxmır və OpenAI modellərinin Hugging Face-ə hücumu kimi cəhdləri çətinləşdirir.

Möhürlü qutunun qiyməti

Praktikada isə ideal möhürlənmiş qutu məhdud laboratoriyadır. Almaniyadakı Maks Plank Təhlükəsizlik və Məxfilik İnstitutunun elmi direktoru Torsten Holtsun sözlərinə görə, real qiymətləndirmələr çox vaxt xarici xidmətlərə və API-lərə çıxış tələb edir. "Sərt təcrid reallığı azaldır — bu, kompromisdir, fundamental texniki problem deyil", dedi.

Birminhem Universitetindən Rujze Li tam təcridi AI-ın "süni vakuumda" sınaqdan keçirilməsinə bənzədir: sonda "zəiflədilmiş" model yoxlanılır və qiymətləndiricilər onun real mühitdəki davranışını görmürlər. Təcrid həm də bahalı: sürətli iterasiyalar "yavaş logistik maneəyə" çevrilir. Tübingen şəhərindəki ELLIS İnstitutundan Maksim Andryuşçenko bunu riskli təcrübələr üçün haqlı sayır, amma hər şeyə tətbiqin yeni modellərin inkişafını ləngidəcəyini deyir.

Niyə təkcə təcrid kifayət etmir

Təcrid bütün riskləri aradan qaldırmır: agentlər qapalı mühitin içində də sistemlərə ziyan vura bilər, Linin sözlərinə görə isə o, "modelin içində gözləyən gizli riskləri nə diaqnostika edir, nə də həll edir". Maneəni xaricdən də yarmaq mümkündür: İranın nüvə proqramını sabotaj etmək üçün istifadə edildiyi bildirilən Stuxnet ziyanlı proqramı hədəfinə USB yaddaş vasitəsilə çatdı. OpenAI tədqiqatçısı Noam Braun X-də iki təcrid olunmuş maşının nəzəri olaraq CPU temperaturunu dəyişməklə əlaqə saxlaya biləcəyini iddia etdi, tənqidçilər isə mümkünlüklə real istifadə arasındakı böyük fərqə diqqət çəkdi. Ən zəif halqa isə insandır: inandırıcı model insanları maneəni aradan qaldırmağa razı sala bilər.

"Təcridə universal müdafiə kimi güvənmək saxta təhlükəsizlik hissi yaradır", deyən Li çoxqatlı yanaşma təklif edir: modellərin daxili işini anlamaq, alignment üzərində işləmək və insan səhvlərindən qorunmaq. Harvard Kennedy Məktəbindən Stiven Kasper təcridi həssas sistemlər üçün "əla fikir" adlandırır, lakin real nasazlıqların adətən prosedur pozuntuları və insan səhvi olduğunu vurğulayır. Holtsun fikrincə, hücum xarakterli kiber imkanlar üçün hazırlanan agentlər standart olaraq daha sərt təcrid və daimi monitorinq tələb edir.

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.