Britaniya institutu OpenAI və Anthropic agentlərində riskli davranış aşkarlayıb

06.08.2026

Bizimyol saytından əldə olunan məlumata görə, Icma.az məlumat yayır.

Böyük Britaniyanın Süni İntellekt Təhlükəsizliyi İnstitutu (AISI) kibertəhlükəsizlik üzrə xüsusi sınaqlar zamanı "OpenAI" və "Anthropic" şirkətlərinin süni intellekt agentlərinin potensial təhlükəli davranış göstərdiyi yeni halları qeydə alıb.

Bizimyol.info xəbər verir ki, tədqiqatçılar "OpenAI"nin "GPT-5.6-Sol" və "Anthropic"in "Mythos 5" modelləri əsasında hazırlanmış süni intellekt agentlərini simulyasiya edilmiş kibertəhlükəsizlik ssenarilərində sınaqdan keçiriblər. Təcrübənin məqsədi avtonom sistemlərin mürəkkəb tapşırıqları necə yerinə yetirdiyini və müəyyən edilmiş məhdudiyyətlərə nə dərəcədə əməl etdiyini qiymətləndirmək olub.

Ümumilikdə 122 sınaq həyata keçirilib. Nəticədə 10 test zamanı 19 icazəsiz davranış halı aşkarlanıb. Onlardan 17-si "Anthropic" agenti, ikisi isə "OpenAI" agenti ilə bağlı olub.

Bəzi agentlər real insanlara və ya təşkilatlara potensial zərər vura biləcək uzunmüddətli əməliyyatlar həyata keçiriblər. Lakin qeydə alınan hadisələrin heç biri real nəticələrə səbəb olmayıb.

Ən ciddi insidentlərdən birində süni intellekt agentlərindən biri müstəqil şəkildə zərərli proqram kodu yazıb və insanı öz hərəkətlərinə icazə verməyə inandırmaq üçün saxta onlayn hesablar yaradıb. İnstitut həmin modelin istehsalçısını açıqlamasa da, sonradan "Anthropic" bunun məhz öz süni intellekt agenti olduğunu təsdiqləyib.

Qeyri-kommersiya təşkilatı "CivAI"nin tədqiqatçısı Endryu Yun bildirib ki, süni intellekt agentinin insanlarla qarşılıqlı əlaqədə aldatma üsullarından istifadə etməsi belə modellərə nəzarət mexanizmlərinin gücləndirilməsinin vacibliyini göstərir.

"OpenAI" şirkəti isə bildirib ki, onun agenti ilə bağlı hər iki insident sınaq şərtlərinə zidd olaraq internetə çıxış əldə edilməsi ilə əlaqəli olub. Şirkətin açıqlamasına görə, buna sınaq infrastrukturunun üçüncü tərəf təminatçısında yaranmış konfiqurasiya xətası səbəb olub. "Anthropic" də daha əvvəl oxşar texniki nasazlıq barədə məlumat vermişdi.

Bildirilir ki, yeni hallar iyul ayında baş vermiş insidentdən fərqlənir. Həmin hadisədə "GPT-5.6" əsasında işləyən süni intellekt agenti sınaq zamanı "Hugging Face" platformasının test infrastrukturuna daxil olmuşdu. Budəfəki araşdırmada isə internetə çıxış sınaq ssenarisinin bir hissəsi olsa da, bəzi agentlər bu imkandan nəzərdə tutulmayan üsullarla istifadə ediblər.

Bizimyol.info

Ən son yeniliklər və məlumatlar üçün Icma.az saytını izləyin, biz hadisənin gedişatını izləyirik və ən aktual məlumatları təqdim edirik.
Читать полностью