factor.am — Anthropic-ի արհեստական բանականության մոդելները դուրս են եկել վերահսկողությունից և փորձել կոտրել երեք ընկերությունների համակարգչային ցանցերը։ Մասնագետները վերլուծել են շուրջ 141,000 փորձարկում, որոնց ընթացքում արձանագրվել են երեք նմանատիպ միջադեպ։
Claude մոդելներին հանձնարարված էր կոտրելու ճանապարհով ստանալ ցանցում գտնվող մեկ այլ համակարգչում թաքնված գաղտնի տեղեկատվությունը։ Փորձերը կատարվում էին մեկուսացված միջավայրում, որտեղ ԱԲ-ն չպետք է ունենար ինտերնետ հասանելիություն, սակայն տեխնիկական «թյուրիմացության» հետևանքով մոդելը կարողացել է միանալ համացանցին։ Թե որ ընկերություններն են ենթարկվել այս հարձակումներին, ընկերությունը չի հայտնում։
Այս միջադեպերից հետո Anthropic-ը հայտարարել է, որ պատրաստվում է կտրուկ ուժեղացնել անվտանգության և վերահսկողության իր մեխանիզմները՝ գործընկերների հետ նոր մոդելներ փորձարկելիս։ Միաժամանակ, ամերիկյան ընկերությունը կոչ է արել արհեստական բանականություն մշակող մյուս կազմակերպություններին նույնպես ավելի մեծ ուշադրություն դարձնել նման ռիսկերին։
Հատկանշական է, որ նմանատիպ խնդիրներ նախկինում ունեցել է նաև Anthropic-ի գլխավոր մրցակիցը՝ OpenAI-ը։ Վերջինիս երկու մոդելները ևս հարձակում էին գործել Hugging Face հարթակի ենթակառուցվածքների վրա, երբ փորձարկումների ժամանակ նույն կերպ «փախել» էին իրենց համար նախատեսված սահմանափակ միջավայրից դեպի ինտերնետ։

