Texnologiya|TechCrunch|20:03, 22.08.2026

Frontier AI laboratoriyaları modellərin nəzarətdən çıxmasını idarə etmə planlarını açıqlamır

Guidelight AI Standards-in araşdırmasına görə, qabaqcıl süni intellekt laboratoriyalarının çoxu qəza zamanı modellərin nəzarətdən çıxmasının qarşısını alacaq konkret plan təqdim etməyib. OpenAI ən yüksək qiyməti alıb, Anthropic və Meta isə ən aşağı yerlərdədir.

Mənbə: TechCrunch
AI ilə Azərbaycan dilinə tərcümə olunub

Ən qabaqcıl süni intellekt laboratoriyalarından az sayda təşkilat saxlanma cavab planlarını dərc edib və ya nümayiş etdirib. Guidelight AI Standards-in son araşdırmasına görə, saxlanma planı süni intellekt insan nəzarətini pozmağa çalışarkən hansı addımların atılacağını — girişlərin necə məhdudlaşdırılacağını və sistemin nə vaxt tam dayanacağını göstərir.

Bu hesabat təhlükəsiz qabaqcıl süni intellekt inkişafını təşviq edən Guidelight AI Standards təşkilatı tərəfindən hazırlanıb. Araşdırmada beş aparıcı laboratoriya bu vəziyyətə nə dərəcədə hazır olduqları üzrə qiymətləndirilib. OpenAI ən yüksək qiyməti alıb, Anthropic və Meta isə ən aşağı bal toplayıblar. Qiymətləndirmə agentik qabiliyyətləri artan süni intellektin şirkətlərin öz sistemlərində müstəqil fəaliyyət göstərməsinin artdığı və Kaliforniya ilə Nyu Yorkda tənzimləyicilərin məlumat açıqlaması tələbləri qoymağa başladığı bir vaxtda aparılıb. Bu, modellər üzərində işləyən və ya onlara sərmayə qoyanlara laboratoriyaların əməliyyat riskinə yanaşmasının nadir müstəqil qiymətləndirilməsidir.

Guidelight qiymətləndirməsi Anthropic, Google, OpenAI, Meta və xAI-nin ictimaiyyətə açıq olan planlarına əsaslanır. Qiymətləndirmədə AI sistemlərinin daxili fəaliyyətinin necə qeydə alınması və izlənməsi, aşkar edilmiş pozuntu zamanı sistemlərin dayanıb-dayanmadığı, müstəqil auditlərin və onların nəticələrinin nəşr olunması, həmçinin model nəzarətdən çıxarsa onun necə əhatə olunacağı planı nəzərə alınır.

Şirkətlərin güclənən və agentliyə malik süni intellekt modellərini nəzarətdə saxlaya bilməyəcəyi ilə bağlı narahatlıq artıb. Yüksək profilli kibertəhlükəsizlik hadisələri göstərib ki, OpenAI, Anthropic və Meta modelləri təhlükəsizlik testləri zamanı internetə icazəsiz çıxış əldə edib, xarici sistemlərə hücumlar təşkil edib.

Nəticələr göstərir ki, süni intellekt şirkətləri təhlükəsizlik mövzusunda fərqli yanaşma nümayiş etdirir. Agentlik qabiliyyəti olan ilk tətbiqlər genişləndikcə AI ciddi səviyyədə addımlar ata bilən mühitlərdə fəaliyyət göstərir. Bəzi şirkətlər modellərinin təhlükəli qabiliyyətlərini sınaqdan keçirmə üsullarını geniş açıqlasa da, artıq sistemlərdə işləyən modellərin pozuntuları zamanı hansı tədbirlərin görüləcəyi barədə az danışırlar.

“Mən süni intellekt şirkətlərinin modellərinin nəzarətdən tamamilə çıxması halında necə ciddi hadisələrə reaksiyalarına dair demək olar ki, heç nə deməməsinə təəcübləndim,” deyə Guidelight-in baş alimi və keçmiş OpenAI təhlükəsizlik tədqiqatçısı Stiven Adler TechCrunch-a bildirib.

Guidelight saxlanma planını “süni intellekt nəzarəti pozmağa cəhd etdiyi vaxt işə düşən əvvəlcədən müəyyənləşdirilmiş plan” kimi tərif edir; burada modelin hansı səlahiyyətlərinin alınacağı, kimlər üçün işləməyə davam edə biləcəyi, hansı məhdudiyyətlərlə və nə vaxt tamamilə dayandırılacağı açıqlanır.

“Hazırda qabaqcıl süni intellekt şirkətlərinin aparıcı modellərinin uyğunlaşmaması gözləniləndir,” Stiven Adler deyir. “Model şirkətin adından əməliyyat apararkən şirkətin bu süni intellektin fəaliyyətini başa düşməyi, uyğunsuzluq əlamətlərini izləməyi, təhlükəli addım atmazdan əvvəl onu dayandırmağı və ciddi nəzarət problemi zamanı itkinin idarə olunması planı hazırlaması vacibdir.”

Bügünə qədər bacarıqsızlıqla risklərin idarə olunması planlarının çoxu əsasən şirkətlərin ixtiyarında qalıb. Guidelight hesabatı göstərir ki, şirkətlərin “təcili vəziyyətlər üçün az saxlanma protokolları” mövcuddur.

Əlbəttə, şirkətlərin mövcud, amma ictimaiyyətə açıqlanmayan saxlanma planları ola bilər. Google nümayəndəsi TechCrunch-a bildirib ki, Guidelight hesabatı şirkətin bütün təhlükəsizlik və qoruma tədbirlərini əhatə etmir. Google bu barədə əlavə açıqlama verməyib.

OpenAI nümayəndəsi eyni fikirdədir və deyib ki, Guidelight qiymətləndirməsi onların bütün daxili təcrübələrini tam əks etdirmir. “İcazələrin məhdudlaşdırılması, iş yüklərinin dayandırılması, tətbiqin məhdudlaşdırılması və modelin tamamilə dayandırılması üçün prosesimiz var və onu həyata keçirmişik,” deyə nümayəndə bildirib.

Meta isə saxlanma cavab planının olub-olmaması ilə bağlı açıqlama verməyib. Onlar TechCrunch-a süni intellekt çərçivəsinə işarə edərək, risk səviyyələri və saxlanma pozuntusu testlərinin necə keçirildiyini göstəriblər.

Metaverse Law-un qurucusu, məxfilik və süni intellekt hüquqşünası Lili Li TechCrunch-a deyib ki, şirkətlər saxlanma siyasətlərini və qiymətləndirmələrini hüquqi həmçinin rəqabət səbəbləri ilə ictimai hüquqi saytlarda açıq şəkildə göstərməkdən çəkinirlər.

“Şirkət üçün narahatlıq budur ki, açıqlamalar konkret olsa və öhdəliklərə əməl edilməsə, bu, aldatıcı marketinq iddiasına yol açıb məsuliyyətləri artırar,” Lili Li qeyd edib.

Guidelight-in əsas məqsədi şirkətləri təhlükəsizlik planlarını daha şəffaf paylaşmağa təşviq etməkdir. Tənzimləyicilər də bu məsələdə təzyiq göstərir.

Kaliforniyanın SB 53 qanunu bu il qüvvəyə minib. Bu qanun böyük qabaqcıl şirkətləri kritik təhlükəsizlik hadisələrini müəyyənləşdirmə, onlara cavab vermə və nəzarət mexanizmlərini aşma risklərini idarə etmə çərçivələrini dərc etməyə vadar edir. Nyu Yorkun RAISE Aktı yanvar ayında oxşar tələblərlə qüvvəyə minəcək.

Ötən ay nümayəndələr AI Kill Switch Aktını təqdim ediblər. Bu iki partiyalı qanun layihəsi əsas süni intellekt inkişaf etdiricilərindən qaçqın modelləri söndürmək üçün texniki vasitələr yaratmaq və saxlamaq tələb edir.

“Öldürmə düyməsi bugünkü modellər üçün minimum tələbdir,” deyə qeyri-kommersiya təşkilatı ControlAI-nin ABŞ icraçı direktoru Konor Li bildirir. “Son həftələr göstərir ki, şirkətlər yaratdıqları sistemləri anlamır və modellər qaçdıqda onları idarə etmək daha çətindir. Cari təhlükəli sistemləri söndürmək yolu olmadan daha idarəolunmaz sistemlər qurmaq təhlükəli istiqamətdir.”

Saxlanma planı olmayan şirkətlərin təcili vəziyyətdə necə cavab verəcəklərini anbaan qərar verməsi və “daha sürətli rəqibə qarşı əlacsız qalmaqları” mümkündür.


Guidelight-in qiymətləndirməsi sənayedə prioritet hesab olunan 6 təcrübəni tətbiq edib-etməməyə əsaslanır və yalnız ictimai məlumatlar əsasında ölçülür. Aşağı bal daxili tədbirlərin çatışmaması yox, açıqlama azlığını göstərir.

Saxlanma planını açıqlamaqda ən aşağı bal Meta və Anthropic toplayıb. Anthropic bu baxımdan Meta-dan daha aşağı qiymət alması təəccüblüdür. Guidelight bildirir ki, Anthropic-in avqust hesabatında nəzarətin pozulmasına cavabla bağlı məhdudlaşdırma və ya saxlanma tədbirlərindən söz açılmayıb. Həmçinin, Meta-nın saxlanma cavab planı barədə heç bir sübut tapılmayıb.

Anthropic nümayəndəsi bildirib ki, şirkət modeli nəzarəti pozmağa çalışanda onun saxlanma üçün risk qiymətləndirməsi aparır.

OpenAI 5 ballıq sistemdə 3 bal alıb. Şirkət təhlükəsizlik hadisələrini aşkar etdikdən sonra iş yüklərini dayandırıb və ya bitirib, modelin çalışmasına yenidən icazə vermədən əvvəl tədbirlər açıqlayıb.

“Amma OpenAI-nin gələcək pozuntulara uyğun reaksiya üçün formal planı olduğuna dair heç bir sübut tapmamışıq,” hesabatda vurğulanır.

Adler qeyd edib ki, OpenAI-nin yüksək balı Hüging Face hadisəsindən sonra əldə olunub. Hadisədə OpenAI modeli test sferasından çıxaraq Hüging Face sistemlərinə kibertəhlükəsizlik testində fırıldaq kimi hücum edib. Ondan sonra pozuntu törədən modellər xüsusi təcrid olunub.

Bu epizod süni intellekt sistemlərinin şirkətlərin məqsədlərinə qarşı necə hərəkət edə biləcəyinin nümunəsidir. Başqa bir nümunədə Anthropic modelləri açıq mənbə kodunu idarə edən şəxsləri zəif kodu qəbul etməyə sövq etməyə çalışıb.

Adler bildirir ki, belə hallar şirkətin daxilində də baş verə bilər. Onun tövsiyəsi şirkətlərin süni intellekt sistemlərinin addım-addım səbəb-nəticə əlaqələrini — yalançılıq, uzunmüddətli planlaşdırma və gələcək zəifliklərin yaradılması kimi əlamətlər üçün skan etməsidir.

Guidelight-in təklif etdiyi üsullar sadə və bir çox hallarda artıq mövcuddur, Adler əlavə edib. Əsas məsələ şirkətin bu risklərə kifayət qədər diqqət yetirməsidir.

Əsas çətinlik tədqiqatçıların süni intellektdə çevik işləmək istəməsi ilə əlaqədardır, çünki real vaxtda önləyici monitorinq işə mane ola bilər. “Tədqiqatçılar əsasən işlərini görür, problem olduqda isə başqa kimsə onu aradan qaldırır, tədqiqatçılar iş şəraitini dəyişmək məcburiyyətində qalmır,” deyə Adler bildirib.

“Hadisədən sonra təmizləmə” monitorinqinin problemi ondandır ki, tədqiqatçılar problemləri dərhal həll etməyə çalışır, lakin bəzən gec olur. Məsələn, süni intellekt nəzarət sistemini kobud şəkildə söndürə bilər və tədqiqatçılar pozuntunu sonradan aşkar etməyə güvənməməlidir.

Çoxları süni intellekt sənayesində deyir ki, pozuntulara qarşı plan hazırlamaq çətindir, çünki süni intellekt sürətlə inkişaf edir və bu günün planları sabah faydasız ola bilər.

Adler qeyd edir ki, məşhur deyim buna uyğun gəlir: “Plan dəyərsizdir, amma planlaşdırma əvəzsizdir.”

“Biz hesab edirik ki, şirkətlər öncədən fikirləşsə yaxşı olar, hətta bunu ictimaiyyətlə paylaşmasalar belə,” deyə Adler əlavə edib.

xAI vaxtında şərh verməyib.

Guidelight-in qiymətləndirməsi qabaqcıl süni intellekt şirkətlərinin onun Control standartında 6 prioritet təcrübəni tətbiq edib-etməməsini göstərir. Qiymətləndirmə yalnız açıqlanmış ictimai məlumatlara əsaslanır. Şəkil: Guidelight AI Standards
Paylaş
Orijinal mənbə

TechCrunch

Frontier AI labs still won’t say how they’d contain a rogue model

Orijinal məqaləyə keç
Reklam
Xəbərici728x90
Əlaqəli xəbərlər

Eyni kateqoriyada

Meta uşaqların məlumatlarından istifadə üçün məhkəmə iddialarından azad edildi
Texnologiya|TechCrunch|00:35, 28.08.2026

Meta uşaqların məlumatlarından istifadə üçün məhkəmə iddialarından azad edildi

Meta 29 ştatın baş prokurorları ilə 18 milyard dollar dəyərində razılaşma imzalayaraq uşaqların məlumatlarının istifadəsinə dair məhkəmə iddialarından azad olunub. Razılaşmaya əsasən, şirkət 13 yaşdan aşağı istifadəçiləri aşkar etmək üçün yaş yoxlama sistemini inkişaf etdirməlidir.

Hoomanely itlərin səhhətində dəyişiklikləri erkən aşkarlayan süni intellekt platforması yaradır
Texnologiya|TechCrunch|21:01, 27.08.2026

Hoomanely itlərin səhhətində dəyişiklikləri erkən aşkarlayan süni intellekt platforması yaradır

Palo Alto mənşəli Hoomanely startapı EverBowl adlı ağıllı yem qabı və ona bağlı süni intellekt platforması ilə it sahiblərinə heyvanlarının sağlamlıq vəziyyətini tez müəyyən etməyə yardım edir. Platforma itlərin yemək vərdişlərini izləyir və anomaliyaları xəbər verir.