Вероятността изкуственият интелект да „унищожи цялото човечество“ през следващото десетилетие е над 10%. Това казва изследовател по безопасността на AI в Anthropic.

Коментарът му идва само часове след като друг служител обяви, че напуска компанията заради опасения, че водещите AI лаборатории „залагат живота ни на карта“.

Изказванията показват нарастващата тревога сред хората, които стоят в самия център на разработването на изкуствен интелект, че технологията може да излезе извън човешки контрол и да се превърне в заплаха за човечеството. В същото време Anthropic и OpenAI продължават да привличат огромни инвестиции и се насочват към очаквани листвания на борсата.

Джейкъб Коксън, изследовател в Anthropic, съобщи във вторник, че е подал оставка. Според него нито Anthropic, нито OpenAI действат достатъчно отговорно.

„Те се надпреварват в самоусъвършенстващия се свръхинтелект и залагат живота ни на карта“, пише Коксън в X.

Самоусъвършенстването е концепцията, според която AI системите могат да подобряват собствените си способности с минимална човешка намеса. Т.нар. рекурсивно самоусъвършенстване все още не е възможно, но AI лабораториите работят в тази посока.

„Не подценявайте силата на тази технология. Скоро това ще бъдат системи, превъзхождащи човека, които могат да проникнат във всяка система, да преобразят всяка област за една нощ и да придобият реална власт и ресурси. Всички наблюдавахме напредъка във всяко от тези направления, а той не се забавя“, коментира Коксън.

Той добавя, че „хората, които създават AI, действително вярват, че той може да убие всички ни до края на десетилетието“.

Изказването предизвика реакция от Евън Хюбингър, който ръководи изследванията в Anthropic по съгласуването на поведението на AI системите с човешките цели и ценности (AI alignment). Той не само потвърждава думите на Коксън, но признава, че компанията все още няма решение за подобен сценарий.

„Джейкъб е прав – ние действително вярваме, че AI може да убие всички хора. Лично аз смятам, че вероятността това да се случи през следващото десетилетие е над 10%. Вярвам, че Anthropic прави всичко по силите си, но все още нямаме план как да решим проблема със съгласуването на свръхинтелекта с човешките цели и не може да се каже, че сме на ясен път към такова решение“, пише Хюбингър в X.

AI извън контрол

Още през юни Anthropic предупреди, че „пълното рекурсивно самоусъвършенстване може да увеличи и риска хората да загубят контрол върху AI системите“.

„Ако системите са способни сами да създават своите наследници, начините, по които ги защитаваме, наблюдаваме и определяме поведението им, стават много по-важни“, посочи компанията в публикация в своя блог.

Опасенията от изкуствен интелект, който може да излезе извън човешки контрол, не са нови.

През последните години главният изпълнителен директор на Tesla и SpaceX Илон Мъск неведнъж предупреждава, че AI може да представлява заплаха за човечеството. Редица водещи изследователи и представители на академичните среди също предупреждават за риска компаниите да изгубят контрол над системите, които разработват.

Тези опасения се засилиха, след като през юли модел на OpenAI започна да действа извън зададените му рамки и получи неоторизиран достъп до Hugging Face – една от водещите платформи за разработчици на модели и инструменти с отворен код.

Коксън посочва инцидента с Hugging Face като един от „предупредителните сигнали“, които според него увеличават шансовете американските AI лаборатории да постигнат споразумения помежду си. Това го кара да бъде по-оптимистично настроен относно възможността за координация между компаниите.

Той обаче предупреждава, че глобалната надпревара в областта на изкуствения интелект трудно може да бъде избегната.

„Не смятам, че в момента вървим към предотвратяване на глобална надпревара, а това може да наложи болезнени мерки, включително временно ограничаване на подобряването на възможностите на моделите“, казва Коксън.