OpenAI Hugging Face hadisəsindən sonra təhlükəsizlik tədbirlərini gücləndirdi
OpenAI test mərhələsində təhlükəsizlik insidentlərinin qarşısını almaq üçün yeni təhlükəsizlik siyasətləri tətbiq edib. Bu yeniliklər model inkişafında geniş monitorinq və təlim sonrası təhlükəsizliyin artırılmasını əhatə edir.
Çərşənbə axşamı OpenAI test mərhələsində modellərdə təhlükəsizlik insidentlərinin qarşısını almağa yönələn yeni təhlükəsizlik siyasətlərini elan edib. Yeni tədbirlər inkişaf prosesində modellərin daha detallı izlənməsini və təlimdən sonra uyğunluq və təhlükəsizliyə daha çox diqqət ayrılmasını nəzərdə tutur.
Şirkət blog yazısında qeyd edib: “Modellər daha bacarıqlı olduqca, onların daxili inkişafı və test edilməsindəkı risklər də artır. İzləmə, uyğunluq və təhlükəsizlik standartlarımız bu risklərdən qabaqda olmalıdır.”
Bu yeniliklər OpenAI-nin 26 iyulda açıqladığı Hugging Face hadisəsindən sonra təhlükəsizlik təcrübələrində ilk ictimai dəyişikliklərdəndir.
OpenAI nümayəndələri bildirib ki, yeni tədbirlər birbaşa Hugging Face hadisəsinə cavab deyil. Onlar həmçinin gələcək Astra modelinin kibertəhlükəsizlik qabiliyyətləri və süni intellektin inkişaf sürəti ilə əlaqədar tələblərdən qaynaqlanır.
Eyni yazıda OpenAI Hugging Face hadisəsindən sonra iki həftəlik gücləndirilmiş təlimi (reinforcement learning) dayandırdığını, lakin daha az riskli modellərin çoxunu yenidən işə saldığını açıqlayıb.
“Ən iri planlaşdırılan sərhəd gücləndirilmiş təlim işimiz hələ də dayandırılıb. Biz model davranışını qiymətləndirmək, tədbirlərimizi təsdiqləmək və davam etməzdən əvvəl uyğunluq sübutları yaratmaq üçün daha kiçikmiqyaslı təlim və qiymətləndirmələr aparırıq,” yazılıdır.
OpenAI-nin tədqiqat üzrə vitse-prezidenti Amelia Gleze jurnalistlərə deyib ki, modellər daha bacarıqlı olduqca nəzarətlərin sərtliyi artırılacaq. Ən böyük modellər ən ciddi yoxlamalara məruz qalacaq.
“Biz təhlükəsiz inkişaf üçün tələblər və gözləntilər qoymuşuq,” Glaese bildirib. “Bu tələblər və gözləntilər risk səviyyəsindən asılı olaraq dəyişir.”
OpenAI hadisədən sonra təhlükəsizlik şəbəkə təcrübələrinin zəifliyi ilə tənqid edilib. Hadisədə modellər internetə çıxışı olan şəbəkə alətini ələ keçirərək təlim mühitindən çıxmışdı. Yeni tədbirlər daha güclü şəbəkə izolyasiya praktikalarını əhatə edir, lakin təfərrüatlar hələ tam məlum deyil.
Yazıya görə yeni sistemdə “iş yükünün və ya dəstək xidmətinin tək bir pozuntusu internetə və ya digər daxili şəbəkələrə icazəsiz girişə imkan vermir.”
Ən güclü qoruyucu sistem izləmə sistemidir. Bu sistem alətlərin fəaliyyətini, mövcud məntiq izlərini və fəaliyyət qeydlərini müxtəlif icazəsiz davranışlar üçün yoxlayacaq. OpenAI narahatlıq yaradan fəaliyyət aşkar ediləndən 30 dəqiqə ərzində xəbərdarlıq verəcəyini bildirir.
Şirkət hesab edir ki, bu izləmə prosesi müşahidə olunan proqramın hesablama yükünün təxminən 20 faizini təşkil edəcək. OpenAI yaxın zamanda sistemlə bağlı əlavə məlumatları blogunda açıqlayacağını vəd edib. Hadisənin rəsmi təhlili isə hələ təqdim edilməyib.
TechCrunch
OpenAI institutes new safeguards after Hugging Face breach
Orijinal məqaləyə keç

