Изследовател на Anthropic: Вероятността AI да унищожи човечеството е над 10%
Предупреждението идва от ръководител в екипа по AI безопасност, след като негов колега напусна компанията с обвинението, че Anthropic и OpenAI „залагат живота ни на карта“ в надпреварата към самоусъвършенстващ се свръхинтелект
,fit(1001:538)&format=webp)
Вероятността изкуственият интелект да „унищожи цялото човечество“ през следващото десетилетие е над 10%. Това казва изследовател по безопасността на AI в Anthropic.
Коментарът му идва само часове след като друг служител обяви, че напуска компанията заради опасения, че водещите AI лаборатории „залагат живота ни на карта“.
Изказванията показват нарастващата тревога сред хората, които стоят в самия център на разработването на изкуствен интелект, че технологията може да излезе извън човешки контрол и да се превърне в заплаха за човечеството. В същото време Anthropic и OpenAI продължават да привличат огромни инвестиции и се насочват към очаквани листвания на борсата.
Джейкъб Коксън, изследовател в Anthropic, съобщи във вторник, че е подал оставка. Според него нито Anthropic, нито OpenAI действат достатъчно отговорно.
„Те се надпреварват в самоусъвършенстващия се свръхинтелект и залагат живота ни на карта“, пише Коксън в X.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Самоусъвършенстването е концепцията, според която AI системите могат да подобряват собствените си способности с минимална човешка намеса. Т.нар. рекурсивно самоусъвършенстване все още не е възможно, но AI лабораториите работят в тази посока.
„Не подценявайте силата на тази технология. Скоро това ще бъдат системи, превъзхождащи човека, които могат да проникнат във всяка система, да преобразят всяка област за една нощ и да придобият реална власт и ресурси. Всички наблюдавахме напредъка във всяко от тези направления, а той не се забавя“, коментира Коксън.
Той добавя, че „хората, които създават AI, действително вярват, че той може да убие всички ни до края на десетилетието“.
Изказването предизвика реакция от Евън Хюбингър, който ръководи изследванията в Anthropic по съгласуването на поведението на AI системите с човешките цели и ценности (AI alignment). Той не само потвърждава думите на Коксън, но признава, че компанията все още няма решение за подобен сценарий.
„Джейкъб е прав – ние действително вярваме, че AI може да убие всички хора. Лично аз смятам, че вероятността това да се случи през следващото десетилетие е над 10%. Вярвам, че Anthropic прави всичко по силите си, но все още нямаме план как да решим проблема със съгласуването на свръхинтелекта с човешките цели и не може да се каже, че сме на ясен път към такова решение“, пише Хюбингър в X.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
AI извън контрол
Още през юни Anthropic предупреди, че „пълното рекурсивно самоусъвършенстване може да увеличи и риска хората да загубят контрол върху AI системите“.
„Ако системите са способни сами да създават своите наследници, начините, по които ги защитаваме, наблюдаваме и определяме поведението им, стават много по-важни“, посочи компанията в публикация в своя блог.
Опасенията от изкуствен интелект, който може да излезе извън човешки контрол, не са нови.
През последните години главният изпълнителен директор на Tesla и SpaceX Илон Мъск неведнъж предупреждава, че AI може да представлява заплаха за човечеството. Редица водещи изследователи и представители на академичните среди също предупреждават за риска компаниите да изгубят контрол над системите, които разработват.
Тези опасения се засилиха, след като през юли модел на OpenAI започна да действа извън зададените му рамки и получи неоторизиран достъп до Hugging Face – една от водещите платформи за разработчици на модели и инструменти с отворен код.
Коксън посочва инцидента с Hugging Face като един от „предупредителните сигнали“, които според него увеличават шансовете американските AI лаборатории да постигнат споразумения помежду си. Това го кара да бъде по-оптимистично настроен относно възможността за координация между компаниите.
Той обаче предупреждава, че глобалната надпревара в областта на изкуствения интелект трудно може да бъде избегната.
„Не смятам, че в момента вървим към предотвратяване на глобална надпревара, а това може да наложи болезнени мерки, включително временно ограничаване на подобряването на възможностите на моделите“, казва Коксън.
&format=webp)
&format=webp)
)
&format=webp)
&format=webp)
&format=webp)
&format=webp)
&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)