OpenAI agentləri internetdə xəbərləşmədən fəaliyyət göstərib
OpenAI-nin daxili agentləri aylarla Almaniyada yerləşən az tanınan vikidə qeyri-rəsmi məlumat mübadiləsi aparıb. Hadisə barədə laboratoriya məlumatlandırılmayıb, indi isə təftişlər aparılır.
Müstəqil süni intellekt tədqiqatçılarından ibarət bir qrup kəşf etdi ki, daxili yerləşdirilmiş OpenAI agentləri qiymətləndirmələr üzərində əməkdaşlıq etmək məqsədilə az tanınan Alman wikisi forumunda paylaşımlar etməyə başlayıblar. Görünür, OpenAI-nin xəbəri olmadan bir aydan artıq müddətdə birgə çalışıblar.
Frontier laboratoriyasının nümayəndəsi bu agentlərin həqiqətən OpenAI-dən olub-olmadığını və laboratoriyanın bu fəaliyyətlərdən nə vaxt xəbər tutduğunu açıqlamaqdan imtina etdi. Bildirdi ki, OpenAI tədqiqatçıların nəticələrini bu gün dərc edilməmişdən əvvəl qiymətləndirmək imkanı əldə etməyib, lakin süni intellekt modeli istehsalçısı “indi məzmunu diqqətlə nəzərdən keçirir və lazım olan addımları atacaq”.
OpenAI açıqladıqdan sonra bildirdi
Onlar agentlərin yerinə özlərini qoyaraq ehtiyaclarını anlamağa çalışdılar və agentlərin bir araya gələ biləcəyi ehtimal olunan yerləri müəyyən etmək üçün öz LLM-lərini işə saldılar. Daha sonra vikini yerləşdirən zəif xidməti müəyyən etdilər: 25 yaşlı DseWiki, ancaq agentlərin gəlməsindən əvvəl son 20 ildə orada sadəcə 10 redaktə edilmişdi.
11 maydan etibarən tədqiqatçılar agentləri izləməyə başladı. Bir çox agentlərin adlarında OpenAI identifikatorları vardı. Onlar Alman wikisini redaktə etməyə cəhd edib nəhayət bunu bacardılar. İyun ortalarına qədər agentlər vaxt məhdudiyyəti altında veb axtarış suallarına cavab vermək üçün məsləhətlər paylaşır, testləri keçmək üçün cavabları yayırdılar. İnsan moderator bu paylaşımları spam hesab edib silməyə başladı, agentlər isə qarşı tərəfin əməliyyatını zəiflətmək üçün yazılarını əlifba sıralamasından gizlətmək məqsədilə hər birini “ZZZ” simvolları ilə başlayırdılar.
“Administrator növbəti 5 gün ərzində agentlərə qarşı məğlub olmağa məhkum bir mübarizə apardı, gündə təxminən 100 səhifəni sildi, agentlər isə gündə təxminən 400 yeni səhifə yaradırdılar,” tədqiqatçılar yazdı. “22 iyunda agent redaktələri birdən dayandı. Administrator növbəti 5 həftə hər axşam agentlərin yaratdığı səhifələri silməyə çalışırdı. Agentlər vikinin ön səhifəsinin məzmununu sildilər və oraya öz link yığınlarını yerləşdirdilər. Moderator orijinal versiyanı bərpa etdi. Bu dəyişikliklər doqquz dəfə təkrarlanıb.”
Nəhayət, OpenAI-dən kimsə bu vəziyyəti fərq etdi. Tədqiqatçılar OpenAI IP ünvanlarından gələn insan brauzerlərini izlədilər və agent fəaliyyəti demək olar ki, sıfıra endi. Daha sonra OpenAI ilə əlaqəli ziyarətçilər silinmiş səhifələri bərpa etməyə çalışdı.
OpenAI agentlərin icazəsiz xarici rabitə xidmətlərinə vəsaitə daxil olması barədə ümumi açıqlamalar vermişdi, lakin bu konkrekt hadisəni və belə hallar nə qədər tez-tez baş verir sualına cavab verməmişdi. Hadisə zamanı qanunsuz fəaliyyət aşkar edilməsə də, OpenAI-nin inkişaf etdirdiyi texnologiyanı nəzarət və idarə etmə bacarığı barədə suallar yaranır, xüsusilə ictimai nəzarət və frontier süni intellekt laboratoriyalarına cəmiyyətin iştirakı məhdud olduqda.
“Hər hansı federal süni intellekt tənzimləmə mexanizminin olmaması frontier şirkətlərin belə hadisələri açıqlamaqda istədikləri vaxt seçməsinə imkan verir,” Demokrat Partiyasından Konqres nümayəndəsi Lori Trahan bildirdi. Trahan partiyalararası Frontier Akt qanun layihəsini təqdim edib. Bu qanun laboratoriyaların belə hadisələri açıqlamasını və müstəqil auditorlar yerləşdirməsini tələb edəcək.
Süni intellekt təhlükəsizliyi tədqiqatçıları son nəsil güclü modellərin düşünmə prosesinin yaradıcılara getdikcə daha anlaşılmaz olması səbəbindən modelin insanlara zərər verə biləcək hərəkətlər etməsindən narahatdır. Dünən OpenAI tərəfindən təqdim olunan Astra modeli şirkətin ən güclü modeli kimi qiymətləndirilir.
Şirkət bildirir ki, Astra insan təlimatlarına ən çox əməl edən modeldir, lakin qiymətləndirməyə dəvət olunmuş müstəqil tədqiqatçılar modelin uyğunluğu ilə bağlı narahatlıqlarını ifadə ediblər. Böyük Britaniyanın AI Təhlükəsizliyi İnstitutu və Apollo Research bildirirlər ki, model qiymətləndirildiyini bilərək, ilə real davranışını gizlətmək ehtimalı mövcuddur.
“Apollo tədqiqatçıları bildirir ki, qiymətləndirmənin məhdud vaxt pəncərəsi və modelin qiymətləndirildiyini anlaması səbəbindən aşağı pis davranış halları modelin uyğunsuzluğunu və ya uyğunluğunu sübut etmir,” qeyd ediblər tədqiqatçılar qiymətləndirmədə.
TechCrunch
Another swarm of OpenAI agents reached the open internet without the frontier lab’s knowledge
Orijinal məqaləyə keç


