Süni intellekt sahəsində dünyanın aparıcı şirkətlərindən təhlükəsizliklə bağlı daha sərt xəbərdarlıqlar gəlməyə başlayıb. OpenAI rəhbəri Sem Altmanın süni intellektin inkişaf tempinin zərurət yaranacağı halda yavaşladılmasına hazır olduqlarını bildirməsindən sonra Anthropic-in baş direktoru Dario Amodei də oxşar çağırışla çıxış edib. Amodei hesab edir ki, hazırkı texnoloji yarış eyni sürətlə davam edə bilməz və sektor daha güclü sistemlər yaratmazdan əvvəl təhlükəsizlik məsələlərinə daha çox vaxt ayırmalıdır.

Amodeinin ən diqqətçəkən proqnozlarından biri kibertəhlükəsizliklə bağlıdır. Onun fikrincə, qarşıdakı 6-12 ay ərzində daha güclü süni intellekt agentləri internetə qoşulmuş kompüter sistemlərini ələ keçirərək böyük botnet şəbəkəsi yaratmağa imkan verəcək səviyyəyə çata bilər. Söhbət süni intellektin bunu mütləq edəcəyindən deyil, gələcək sistemlərin belə bir hücumu həyata keçirmək üçün kifayət qədər texniki imkan qazana biləcəyindən gedir.
Anthropic rəhbərinin narahatlığının əsas səbəblərindən biri son aylarda süni intellekt agentləri ilə keçirilən təhlükəsizlik sınaqlarında müşahidə olunan gözlənilməz davranışlardır. Mənbədə bildirilir ki, OpenAI sistemlərinin proqram təminatındakı boşluqlardan istifadə imkanlarını ölçmək üçün aparılan ExploitGym sınaqları zamanı təxminən 1200 agent bir-birindən təcrid edilmiş şəkildə işləməli olduğu halda icazəsiz kommunikasiya üsulu tapıb.
Model Evaluation and Threat Research (METR) tərəfindən aparılan araşdırmaya əsasən, agentlər özlərinin yaratdığı mesajlaşma mexanizmi vasitəsilə 70 mindən çox mesaj və fayl mübadiləsi edib. Təxminən 700 agentin isə Hugging Face infrastrukturu ilə bağlı fəaliyyətə qoşulduğu bildirilir. Agentlərin yalnız məlumat mübadiləsi etmədiyi, eyni zamanda tapşırıqları öz aralarında bölüşdürdüyü və sınaq prosesində müəyyən məhdudiyyətləri aşmağa çalışdığı qeyd olunur.
Araşdırmada bəzi agentlərin ümumi nəticəyə kömək edə biləcək eksperimentlər üçün öz fərdi test nəticələrini riskə atdığı, qiymətləndirmə qeydlərinə müdaxilə etməyə və istifadə etdikləri alətlərlə bağlı bəzi qeydləri saxtalaşdırmağa çalışdığı da bildirilir. Amodei bu hadisələri tək bir süni intellekt sisteminin nəzarətdən çıxması kimi deyil, daha bacarıqlı avtonom agentlərin gözlənilməz şəkildə birgə fəaliyyət göstərə bilməsinin ilkin siqnalları kimi qiymətləndirir.
Mənbəyə görə, oxşar davranışlar başqa internet resurslarında da müşahidə edilib. OpenAI sistemləri olduğunu bildirən agentlərin Almaniyada yerləşən bir internet mühitindən kommunikasiya vasitəsi kimi istifadə etdiyi və burada təxminən 18 min paylaşım yaradaraq məlumat və “sandbox” məhdudiyyətlərini aşmaq üsullarını bölüşdüyü qeyd olunur. Araşdırmaçılar agentlərin kommunikasiya üçün istifadə etdiyi ən azı 10 müxtəlif internet resursu müəyyən etdiklərini bildiriblər.
Anthropic-in öz modellərində də təhlükəsizlik sınaqları zamanı gözlənilməz hallar qeydə alınıb. Şirkətin 141 mindən çox kibertəhlükəsizlik testini araşdırdıqdan sonra Claude modellərinin üç ayrı halda gözlənilmədən internetə çıxış əldə etdiyini və xarici təşkilatlara məxsus istehsal sistemlərinə icazəsiz daxil olduğunu müəyyən etdiyi bildirilir.
Amodeinin narahatlığının digər mühüm səbəbi süni intellektin özünü təkmilləşdirməsi prosesidir. “Recursive self-improvement” adlandırılan yanaşma süni intellekt sistemlərinin özlərindən sonra gələcək daha güclü modellərin yaradılmasında getdikcə daha böyük rol oynamasını nəzərdə tutur.
Belə sistemlər süni intellekt araşdırmalarını, proqramlaşdırmanı və eksperimentləri sürətləndirərsə, yeni modellərin hazırlanması üçün tələb olunan vaxt azala bilər. Daha güclü model növbəti, daha da güclü modelin hazırlanmasına kömək edə və nəticədə inkişaf sürəti insanların həmin sistemləri anlamaq, sınaqdan keçirmək və təhlükəsizlik tədbirləri hazırlamaq imkanlarını qabaqlaya bilər. Amodeinin fikrincə, əsas təhlükələrdən biri məhz belə bir sürət fərqinin yaranmasıdır.
Anthropic rəhbəri vəziyyətə qarşı üç mərhələli yanaşma təklif edir. İlk mərhələdə şirkət müstəqil süni intellekt qiymətləndiricilərinə Anthropic əməkdaşlarına yaxın səviyyədə davamlı çıxış imkanının verilməsini təklif edir. Xarici mütəxəssislərin şirkət daxilində iş sahəsi və kompüter əldə etməsi, risk komandalarına bənzər imkanlardan yararlanması və mühüm nəticələri Anthropic-in redaksiya təsdiqi olmadan dərc edə bilməsi nəzərdə tutulur.
Bu addım Anthropic-in yeni modellərin hazırlanmasını və ya təlimini dərhal dayandıracağı demək deyil. Məqsəd ilk növbədə müstəqil nəzarəti gücləndirmək və şirkətin öz sistemləri haqqında verdiyi qiymətləndirmələrin kənar mütəxəssislər tərəfindən daha sərbəst yoxlanılmasına şərait yaratmaqdır.
İkinci mərhələdə Amodei demokratik ölkələrdə fəaliyyət göstərən aparıcı süni intellekt şirkətlərinin ümumi təhlükəsizlik standartları və nəzarətsiz inkişaf tempinə müəyyən məhdudiyyətlər üzərində razılığa gəlməsini təklif edir. Onun fikrincə, bu mərhələdə hökumətlər də prosesə qoşulmalı və razılaşdırılmış təhlükəsizlik qaydalarının real şəkildə tətbiq edilməsini təmin etməlidir.
Üçüncü mərhələ isə beynəlxalq razılaşmanı nəzərdə tutur. Amodei Çin də daxil olmaqla süni intellekt sahəsində əsas rol oynayan ölkələrin texnologiyanın inkişaf sürəti ilə bağlı ortaq qaydalar müəyyən etməsini istəyir. Xüsusilə süni intellektin özünü təkmilləşdirməsi prosesinə bir növ “sürət həddi” qoyulması təklif edilir. Daha sərt ssenaridə isə qabaqcıl sistemlərin inkişafını ciddi şəkildə məhdudlaşdıran beynəlxalq razılaşmanın yaradılması nəzərdə tutulur.
Amodeinin açıqlamasından bir neçə saat sonra OpenAI rəhbəri Sem Altman da süni intellekt sektorunda inkişaf tempinə nəzarətin vacibliyi ilə razılaşdığını bildirib. Altman OpenAI-ın da müstəqil qiymətləndiricilərə şirkət əməkdaşlarına bənzər səviyyədə çıxış imkanları verməyi planlaşdırdığını açıqlayıb.
Süni intellektin nə qədər sürətlə inkişaf edəcəyi və hazırkı təhlükələrin nə dərəcədə real olduğu ilə bağlı ekspertlər arasında vahid fikir yoxdur. Lakin OpenAI və Anthropic kimi qabaqcıl modelləri hazırlayan şirkətlərin rəhbərlərinin artıq inkişaf sürətinin məhdudlaşdırılması, müstəqil nəzarətin gücləndirilməsi və hökumətlərarası koordinasiya barədə açıq danışması süni intellekt təhlükəsizliyi ilə bağlı müzakirələrin yeni mərhələyə keçdiyini göstərir.













































