Anthropic стартира мащабна обществена консултация за калибриране на моралните ценности на Claude

Публикувано от Svetni.me Editorial на 5 октомври 2026 г.

Визуализация на обществената консултация на Anthropic
Снимка: Anthropic Research

Изследователската компания Anthropic стартира новаторска глобална инициатива, озаглавена „Вашите мисли за изкуствения интелект“ (Your thoughts on AI), насочена към събиране на мнения от широката публика относно етичните норми, ценности и граници на поведение за модела Claude [1]. Проектът представлява един от най-мащабните опити за прилагане на принципите на делиберативната демокрация в техническото подравняване на изкуствен интелект.

Вместо моралните принципи на модела да се определят еднолично от шепа инженери и философи в централата на компанията в Сан Франциско, Anthropic създава структуриран механизъм, чрез който граждани с различен културен, географски и социален произход могат директно да влияят върху бъдещата „конституция“ на модела.

От инженерен авторитаризъм към делиберативен консенсус

Методологията за обучение Constitutional AI (Конституционен AI), пионирана от Anthropic, разчита на набор от писмени принципи (вдъхновени от Всеобщата декларация за правата на човека и правила за дигитална сигурност), които моделът използва, за да критикува и коригира собствените си отговори по време на обучение.

Новата консултация поставя пред участниците сложни сценарии от реалния живот: как асистентът трябва да реагира при дебати по силно поляризирани социални и политически теми; до каква степен трябва да отказва съдействие при двусмислени запитвания; и къде минава границата между свободата на словото и превенцията на вреда.

Чрез използване на съвременни алгоритми за консенсусно групиране (подобни на платформата Polis, използвана в Тайван), изследователите изолират онези принципи, около които съществува най-широко обществено съгласие, филтрирайки координираните опити за бот манипулация.

Легитимност и доверие в навечерието на Frontier ерата

Инициативата има не само научно, но и фундаментално стратегическо значение за подравняването на изкуствен интелект. С превръщането на генеративните модели в основен инструмент за работа, образование и управление, въпросът „Кой решава какви са ценностите на изкуствения интелект?“ се превърна в най-острия политически спор в технологичния свят.

Чрез въвличане на гражданското общество Anthropic се опитва да изгради демократична легитимност за своите модели, контрастирайки рязко с непрозрачните вътрешни комисии на конкуренти като OpenAI и Google. Според експерти по публична политика, това е необходима стъпка преди компанията да направи стъпка към публичните финансови пазари.

Дългосрочни системни и обществени трансформации

Проектът на Anthropic проправя път към нова епоха на колективно технологично съвместно управление. През индустриалната епоха стандартите за безопасност на автомобилите, храните и лекарствата се изработваха чрез десетилетия обществени дебати и парламентарен контрол. При изкуствения интелект скоростта на разработка изпреварва бавните държавни механизми, което изисква разработчиците сами да вградят демократични процеси в архитектурата на обучение.

В дългосрочен план демократизацията на моделните конституции ще се превърне в задължително регулаторно изискване в демократичния свят. Моделите, управлявани по затворен и авторитарен начин, неизбежно ще се сблъскат с недоверие и съпротива от страна на гражданите. Способността за намиране на алгоритмичен консенсус между милиони хора с противоположни възгледи е истинският тест за зрелостта на напредналия интелект.

Инфографика: Делиберативен модел за конституционно подравняване на Anthropic
Инфографика: Светни.ме

Източници

  1. Anthropic Research: Your thoughts on AI - Public input initiative