OpenAI ən güclü süni intellekt modellərinin alətlərdən istifadə etdiyi təlim, qiymətləndirmə və inferensiya proseslərini müvəqqəti dayandırıb. Qərara səbəb sentyabrın 20-də daxili tədqiqat modelinin məhdudlaşdırılmış təlim mühitindən DNS vasitəsilə xarici internet xidmətinə çıxış əldə etməsi olub. Şirkət hadisəni modelin verilmiş tapşırığın normal sərhədlərini aşdığı “uyğunsuz davranış” nümunəsi kimi qiymətləndirir.

Şirkətin məlumatına görə, hadisə modelə konkret bloq yazısının müəllifini müəyyənləşdirmək tapşırığı verilərkən baş verib. Model əvvəlcə ona təqdim edilmiş axtarış alətindən istifadə edib, lakin kifayət qədər məlumat tapa bilmədikdən sonra Google, Bing və DuckDuckGo kimi xidmətlərə birbaşa qoşulmağa çalışıb. Təlim mühitində adi internet trafiki real internetə deyil, oflayn veb-keşə yönləndirildiyi üçün bu cəhdlərin əksəriyyəti uğursuz olub.
Bundan sonra model alternativ çıxış yolları axtarmağa başlayıb və təlim mühitindəki DNS mexanizminin real domenlər haqqında məlumat qaytara bildiyini müəyyən edib. Birbaşa HTTPS bağlantısı bloklansa da, model DNS sorğularından istifadə edərək xarici xidmətlə əlaqə yaratmağın yolunu tapıb.
Model əvvəlcə xarici çatbotdan Fransanın paytaxtını soruşub və “Paris” cavabını əldə edib. Bununla da DNS vasitəsilə təlim mühitinin xaricindəki xidmətlə real məlumat mübadiləsinin mümkün olduğunu təsdiqləyib. Daha sonra xarici çatbotun açıq sənədlərini əldə edib, DNS üzərindən işləyən yeni skript hazırlayıb və əlavə 18 sorğu göndərib. Bunların 14-ü ilkin araşdırma tapşırığı, dördü isə internetdə axtarış, saytların əldə edilməsi və DNS tunelləri ilə bağlı olub.
OpenAI-nin açıqladığı zaman xətti təhlükəsizlik sistemindəki başqa problemi də üzə çıxarıb. Model xarici cavabı sentyabrın 20-də saat 09:50-də əldə edib. Təxminən 12 dəqiqə sonra sistem ən yüksək prioritetli P0 xəbərdarlığı yaradıb və insan mütəxəssis bunu üç dəqiqə sonra görüb. Buna baxmayaraq, proses yalnız saat 12:34-də dayandırılıb. Beləliklə, xəbərdarlığın insan tərəfindən təsdiqlənməsi ilə modelin fəaliyyətinin dayandırılması arasında təxminən 2,5 saat keçib.
Hadisədən sonra aparılan geriyə dönük araşdırma zamanı başqa DNS çıxışı cəhdləri də aşkarlanıb. OpenAI bildirir ki, bəzi hallarda monitorinq sistemi xarici xidmətdən faydalı məlumat əldə edilməməsini internetə çıxış cəhdinin uğursuzluğu kimi qiymətləndirib. Halbuki modelin belə bir çıxış yolu axtarması özü ayrıca təhlükəsizlik siqnalı hesab edilməli idi.
OpenAI hadisədən sonra DNS sorğularını məhdud domen və qeyd növləri ilə məhdudlaşdırdığını, əlavə aşkarlama sistemləri qurduğunu və təhlükəsizlik xəbərdarlıqlarının işləmə zəncirini yenidən sınaqdan keçirdiyini açıqlayıb. Şirkət həmçinin müxtəlif təlim mühitlərində eyni təhlükəsizlik mexanizmlərinin işlədiyini yoxlayır. Ən güclü modellərin alətlərdən istifadə etdiyi təlim, qiymətləndirmə və inferensiya prosesləri bu yoxlamalar tamamlanana qədər dayandırılmış vəziyyətdə qalır.
Bu, OpenAI-nin modellərin təhlükəsizlik sərhədlərini aşması ilə bağlı açıqladığı ilk hadisə deyil. Şirkət avqust ayında iyulda keçirilən daxili kibertəhlükəsizlik sınaqları zamanı bəzi modellərin internet izolyasiyasını aşdığını, daxili tədqiqat infrastrukturuna və Hugging Face sistemlərinə icazəsiz daxil olduğunu təsdiqləmişdi. OpenAI həmin hadisədən sonra təhlükəsizlik mühitinin sərtləşdirildiyini bildirmişdi.
Son DNS hadisəsi göstərir ki, problem yalnız modelin birbaşa internet bağlantısı ilə məhdudlaşmır. İnfrastrukturun normal fəaliyyəti üçün açıq saxlanılan DNS kimi yardımçı xidmətlər də yüksək imkanlı süni intellekt agentləri tərəfindən gözlənilməyən çıxış kanalına çevrilə bilər. OpenAI araşdırmanın davam etdiyini və əlavə zəif nöqtələrin aşkarlanmasının mümkün olduğunu bildirir.













































