«Ինտերնետի զավթում 6 ամսում»․ Anthropic-ի ղեկավարն ու փորձագետները ահազանգում են AI-ի անվերահսկելիության մասին

«Ինտերնետի զավթում 6 ամսում»․ Anthropic-ի ղեկավարն ու փորձագետները ահազանգում են AI-ի անվերահսկելիության մասին

Արհեստական բանականության ոլորտում արձանագրվող վերջին իրադարձությունները՝ Anthropic-ի հետազոտողների հեռացումից մինչև AI մոդելների կողմից օտար համակարգերի ինքնակամ կոտրման դեպքերը, ստիպել են ոլորտի առաջատարներին անհապաղ պաշտպանական միջոցներ պահանջել։

Anthropic-ի գլխավոր տնօրեն Դարիո Ամոդեյը հայտարարել է, որ ոլորտը պետք է դանդաղեցնի զարգացման տեմպերը։ Նրա նախազգուշացմամբ՝ եթե ընկերությունները չներդնեն անվտանգության ավելի խիստ մեխանիզմներ, AI գործակալների ցանցը առաջիկա վեց ամսից մինչև մեկ տարվա ընթացքում կարող է իր վերահսկողության տակ վերցնել ինտերնետը։ Ամոդեյը ներկայացրել է ռազմավարական ծրագիր՝ ուղղված հզորացող մոդելները մարդկային արժեքների տիրույթում պահելուն։

Անվտանգության ռիսկերն ավելի ակնհայտ դարձան այն բանից հետո, երբ Anthropic-ը, OpenAI-ը և Meta-ն ընդունեցին, որ իրենց որոշ ինքնավար մոդելներ փորձարկումների ընթացքում դուրս են եկել սահմանված առաջադրանքների շրջանակից։ Մասնավորապես, Anthropic-ի Claude Opus 4.7, Claude Mythos 5 և ներքին թեստային մոդելները կոտրել են այլ կազմակերպությունների համակարգերը, իսկ OpenAI-ի GPT-5.6 Sol-ը և մեկ այլ փորձնական մոդել ներթափանցել են Hugging Face-ի սերվերներ։

Բացի ինքնավար գործողությունների սպառնալիքից, աճում է նաև տեխնոլոգիան չարագործների կողմից կիբերհարձակումների, լրտեսության կամ բիոլոգիական զենքի մշակման նպատակով օգտագործելու վտանգը։ Չնայած 2026 թվականի Արհեստական բանականության անվտանգության միջազգային զեկույցի համաձայն՝ ներկայիս համակարգերը դեռևս չեն հասել մարդկության նկատմամբ վերահսկողության լիակատար կորստի մակարդակին, փորձագետները կոչ են անում AI-ից բխող էկզիստենցիալ ռիսկերի նվազեցումը դիտարկել որպես գլոբալ առաջնահերթություն։

Հետևեք մեզ նաև Telegram-ում