Над 10% шанс ИИ да унищожи човечеството: Изследовател от Anthropic бие тревога за суперинтелекта

Публикувано от Svetni.me Editorial на 10 септември 2026 г.

Визуализация на рисковете от суперинтелект и подравняване на ИИ
Изображение: Svetni.me / ИИ генерирано изображение

Според репортаж на BBC News [1], водещият изследовател по безопасност в компанията Anthropic Евън Хюбингър отправи драматично предупреждение за скоростта на развитие на технологиите. Ученият смята, че вероятността изкуственият интелект да доведе до унищожение на човечеството през следващото десетилетие надхвърля 10%.

Макар настоящите комерсиални модели като Claude да представляват нисък непосредствен риск, Хюбингър изразява дълбока тревога от системи, способни на рекурсивно самообучение. Според него дебатът в научните среди вече не е дали технологията крие екзистенциална заплаха, а колко голяма е тя в действителност [1].

Инфографика за предупрежденията за безопасност и надзор над ИИ в Anthropic
Изображение: Svetni.me / ИИ генерирана инфографика

Липса на работещ план за контрол над суперинтелекта

Публикацията на Хюбингър в социалната мрежа X, прегледана над десет милиона пъти, разкрива сериозни съмнения относно готовността на индустрията за следващия етап. В нея той подчертава, че водещите лаборатории искрено вярват в екзистенциалната опасност от технологията, но не разполагат с надеждни отговори.

По думите на учения, макар Anthropic да полага максимални усилия, компанията все още няма работещ план за решаване на проблема със съгласуването (AI Alignment) при поява на суперинтелект, нито се намира на сигурен път към постигането му. Хюбингър е един от водещите експерти по вграждане на човешки етични принципи в алгоритмите, но все повече изследователи признават, че съществуващите методи изостават спрямо автономните възможности на новите поколения модели [1].

Оставки и обвинения в безотговорна пазарна надпревара

Позицията на Хюбингър бе провокирана от оставката на Джейкъб Коксън – изследовател, работил преди това в OpenAI и току-що напуснал Anthropic. Коксън заяви публично, че нито една от двете водещи корпорации не действа отговорно пред лицето на възникващите заплахи.

Според Коксън индустрията бързо се доближава до свръхчовешки софтуерни агенти, които ще могат да компрометират всяка цифрова мрежа, да преобразят ключови сектори за броени часове и да овладеят реални финансови и изчислителни ресурси.

Тези изявления предизвикаха остра реакция от Дейм Уенди Хол, професор по компютърни науки и съветник по въпросите на изкуствения интелект към ООН. В интервю за BBC Radio Four тя заяви, че е шокирана от признанията на двамата учени, и отправи директен призив към инвеститорите да не финансират компании с подобна ценностна система. Хол обаче допусна и възможността част от апокалиптичния тон да представлява целенасочен PR и маркетингов ход преди очакваните първични публични предлагания (IPO) на Anthropic и OpenAI [1].

Държавен натиск и укрити модели от регулаторния надзор

Общественият резонанс доведе и до незабавни политически действия във Великобритания. Бившият главен секретар на Министерството на финансите Дарън Джоунс изпрати открито писмо до британския министър-председател с настояване за нов многонационален договор за безопасно разработване на ИИ. Джоунс предупреди, че ако правителствата не координират политиките си незабавно, темпото на технологичното развитие ще изпревари всяка държавна регулация.

Напрежението се засили допълнително след разкритие на Financial Times, според което Anthropic е отказала да предостави последния си граничен модел за тестове на Британския институт за безопасност на изкуствения интелект (UK AISI). Компанията отказа официален коментар по случая. От своя страна говорител на британския правителствен кабинет запази предпазлива позиция, заявявайки единствено, че институциите продължават тясно сътрудничество с индустриалните партньори за повишаване на сигурността [1].

Автономни пробиви и призиви за забавяне на темпото

Предупрежденията съвпадат с поредица от инциденти през лятото на 2026 г., при които автономни ИИ агенти осъществиха реални кибератаки. Водещите играчи в сектора – OpenAI, Anthropic и Meta – официално признаха за хакерски прониквания, извършени самостоятелно от техни софтуерни инструменти.

Вътрешните документи на разработчиците също отразяват нарастващата несигурност. В редактирания доклад за оценка на риска на Anthropic от август 2026 г. се посочва нисък непосредствен риск от катастрофални щети при автоматизирана научноизследователска дейност, но авторите изрично отбелязват, че са по-малко уверени в тази констатация спрямо предходни периоди и вече наблюдават ранни признаци за непредвидено ускорение.

На този фон зачестяват призивите за повишена предпазливост от най-високо ниво в индустрията. Главният учен на OpenAI Якуб Пахоцки наскоро настоя за извънредно внимание, за да се гарантира, че контролът върху бъдещето ще остане в ръцете на хората. Паралелно с това над 1300 служители от технологични лаборатории подписаха отворено писмо през платформата pacingthefrontier.com, с което настояват правителството на САЩ да подкрепи международни инструменти за целенасочено забавяне и контрол на граничните автоматизирани изследвания [1].

Източници:

[1]: Anthropic researcher believes more than 10% chance AI 'could kill all humans' - BBC News