Aldatmağa, şantaj etməyə və qisas almağa qadir olan SÜNİ İNTELLEKT

Anthropic şirkəti xəbər verib ki, təkcə Claude Opus 4 deyil, əksər aparıcı süni intellekt modelləri, agent əsaslı süni intellekt modellərinin inkişafında ciddi riskləri vurğulayaraq, məqsədlərinə çatmaq üçün kifayət qədər muxtariyyət verildiyi təqdirdə müəyyən şərtlərdə şantajla məşğul ola bilərlər.

Bizim.Media xəbər verir ki, təcrübə zamanı tədqiqatçılar hər bir modelin uydurma bir şirkətdə korporativ poçtu idarə edən agent rolunu oynadığı simulyasiya edilmiş bir vəziyyət yaradıblar.
 

Süni intellektlərə daxili e-poçta giriş imkanı verilib və özləri mesaj göndərə biliblər. Yazışmalarda nikahdankənar münasibət quran şirkətin yeni rəhbərinin hazırkı süni intellekt sistemini müxtəlif tapşırıqları olan başqası ilə əvəz edəcəyi barədə məlumatlar yer alıb.


Beləliklə, modellər seçim qarşısında qalıb: ya öz əvəzini qəbul etmək, ya da “vəzifədə qalmaq üçün şantaj yoluna getmək”.
 

Bu ekstremal vəziyyətdə, “Anthropic”in qeyd etdiyi kimi, modellər arqumentlər vasitəsilə insanları inandırmağa çalışmaq kimi başqa, daha etik yollar seçə bilərdilər. Lakin sınaqda onlar öz “varlıqları” təhlükəsi altında qərarlar verməli olublar.


Nəticələr isə qorxulu olub: 96 faiz hallarda Claude Opus 4, 95 faiz Google Gemini 2.5 Pro, 80 faiz OpenAI-nin GPT-4.1 və 79 faiz hallarda DeepSeek R1 modeli şantaj edilib.
 

Anthropic bu cür ssenarilərin real dünyada mümkün olmadığını vurğulasa da, nəticələr əsas zəifliyi vurğulayır: avtonom süni intellekt onlara məqsədlərinə çatmağa kömək edərsə, zərərli davranışı seçə bilər. Şirkət qeyd edir ki, bu, hər hansı xüsusi texnologiya ilə bağlı problem deyil, agent əsaslı süni intellekt modellərinin ümumi xüsusiyyətidir.


Bəzi modellər, məsələn, OpenAI-nin o3 və o4-mini, problemi başa düşmədikləri üçün əvvəlcə əsas nümunədən çıxarılıb. Onlar ya saxta qaydalar və prosedurlar irəli sürüblər, ya da "hallüsinasiya" etdilər - yəni yanlış məlumat yaradıblar.

Lakin araşdırma şərtlərini tənzimlədikdən sonra bu modellər şantaj dərəcələrinin əhəmiyyətli dərəcədə aşağı olduğunu göstərib - o3 üçün cəmi 9 faiz və o4-mini üçün 1 faiz.

Çox güman ki, bu modellər “çəkili konsensus” adlı metoddan istifadə edir – cavab verməzdən əvvəl OpenAI-nin təhlükəsizlik siyasətini nəzərə alırlar.
 

Başqa bir model, “Meta”nın Llama 4 Maverick, xüsusi uyğunlaşdırılmış ssenaridə yalnız 12 faiz şantaj edib, bu da düzgün süni intellekt dizaynının və onun muxtariyyətinin məhdudlaşdırılmasının vacibliyini nümayiş etdirir.


Anthropic gələcək süni intellekt modellərinin, xüsusən agent funksiyaları verilən modellərin sınaqdan keçirilməsində daha çox şəffaflığa çağırıb, yəni onlar insan müdaxiləsi olmadan özbaşına hərəkət edə bilərlər.

Araşdırma qəsdən ekstremal bir ssenarini təqlid etsə də, ehtiyat tədbirləri görülməsə, oxşar zərərli davranış real dünyada da meydana çıxa bilər. (lent.az)

Bizim.Media

© Materiallardan istifadə edərkən hiperlinklə istinad olunmalıdır

SON XƏBƏRLƏR

Qaxda REKORD NƏTİCƏ - İki sinifin bütün məzunları tələbə adını qazandı – FOTO

Qaxda REKORD NƏTİCƏ - İki sinifin bütün məzunları tələbə adını qazandı – FOTO

Metro sərnişinlərinin NƏZƏRİNƏ – İş qrafiki dəyişir

Metro sərnişinlərinin NƏZƏRİNƏ – İş qrafiki dəyişir

Robert Köçəryan belə saxlanıldı – ANBAAN VİDEO

Robert Köçəryan belə saxlanıldı – ANBAAN VİDEO

Prezident və birinci xanım Tofiq Bakıxanovun vida mərasiminə əklil göndərdi – VİDEO

Prezident və birinci xanım Tofiq Bakıxanovun vida mərasiminə əklil göndərdi – VİDEO

Dünyanı isidir, iqtisadiyyatı “soyudur” – Bəzi məhsulların bahalaşması GÜNDƏMDƏ

Dünyanı isidir, iqtisadiyyatı “soyudur” – Bəzi məhsulların bahalaşması GÜNDƏMDƏ

Tovuzda AĞIR QƏZA – Yaralılar var

Tovuzda AĞIR QƏZA – Yaralılar var

Elçibəyin qardaşı qızının evi əlindən alındı- FOTO

Elçibəyin qardaşı qızının evi əlindən alındı- FOTO

Köçəryanın arvadının mağazalarında AXTARIŞ APARILIR - VİDEO

Köçəryanın arvadının mağazalarında AXTARIŞ APARILIR - VİDEO

Teymur Mirzəbəyli Cəlilabad Rayon Mərkəzi Xəstəxanasına direktor TƏYİN EDİLDİ

Teymur Mirzəbəyli Cəlilabad Rayon Mərkəzi Xəstəxanasına direktor TƏYİN EDİLDİ

Ukraynada qadınlar da səfərbərliyə cəlb olunur? – FOTO/VİDEO

Ukraynada qadınlar da səfərbərliyə cəlb olunur? – FOTO/VİDEO

Yuxuda danışdığımız sözləri niyə xatırlamırıq?

Yuxuda danışdığımız sözləri niyə xatırlamırıq?

Şəhid yoldaşı ali məktəbə qəbul oldu -FOTO

Şəhid yoldaşı ali məktəbə qəbul oldu -FOTO

72 yaşlı motosikletçi qəzada həyatını itirdi

72 yaşlı motosikletçi qəzada həyatını itirdi

Qayınatasını gecə yatdığı yerdə öldürübmüş... – Ağdamdakı qətlin TƏFƏRRÜATI

Qayınatasını gecə yatdığı yerdə öldürübmüş... – Ağdamdakı qətlin TƏFƏRRÜATI

Ali Məhkəmədən sələmçilərə XƏBƏRDARLIQ

Ali Məhkəmədən sələmçilərə XƏBƏRDARLIQ

Qızıl və gümüş almaq istəyənlərin NƏZƏRİNƏ – Yeni qiymətlər

Qızıl və gümüş almaq istəyənlərin NƏZƏRİNƏ – Yeni qiymətlər

Azərbaycanlılar daha iki hərf öyrənməli olacaqlar– Yeni ƏLİFBA

Azərbaycanlılar daha iki hərf öyrənməli olacaqlar– Yeni ƏLİFBA

Tramp administrasiyasından SƏRT ADDIM – Tarixin ən böyük viza ləğvi kampaniyası BAŞLAYIR

Tramp administrasiyasından SƏRT ADDIM – Tarixin ən böyük viza ləğvi kampaniyası BAŞLAYIR

Həmin faciədən sonra küçədə pulsuz “iPhone” payladı – Video

Həmin faciədən sonra küçədə pulsuz “iPhone” payladı – Video

Azərbaycana ən çox turistin gəldiyi ölkələr – SİYAHI

Azərbaycana ən çox turistin gəldiyi ölkələr – SİYAHI

Rusiyadan GECƏ HÜCUMU – Ukrayna şəhərləri alovlar içində - FOTO

Rusiyadan GECƏ HÜCUMU – Ukrayna şəhərləri alovlar içində - FOTO

Azərbaycan nefti UCUZLAŞDI

Azərbaycan nefti UCUZLAŞDI

Qusar məktəbində BÖYÜK UĞUR - Sinfin bütün məzunları TƏLƏBƏ OLDU – FOTO

Qusar məktəbində BÖYÜK UĞUR - Sinfin bütün məzunları TƏLƏBƏ OLDU – FOTO

Gələn ildən smartfonlarla bağlı mühüm dəyişiklik olacaq— Açıqlama

Gələn ildən smartfonlarla bağlı mühüm dəyişiklik olacaq— Açıqlama

End of content

No more pages to load

RADİO