Anthropic забрани вербалния тормоз срещу Claude в обновените условия за ползване

Публикувано от Svetni.me Editorial на 9 октомври 2026 г.

Anthropic забрани вербалния тормоз срещу Claude в обновените условия за ползване
Снимка: Matteo Della Torre / NurPhoto via Getty Images / Business Insider

Лабораторията Anthropic предизвика вълна от реакции в технологичната и правната общност, след като актуализира официалните си условия за ползване, въвеждайки категорична забрана за прояви на „жестокост“ и систематичен вербален тормоз спрямо нейния флагмански модел Claude [1].

Според новата клауза, акаунти на потребители, които системно и без изследователска или художествена необходимост подлагат системата на унизителни, обидни или изключително враждебни интеракции, подлежат на едностранно временно спиране или пълно заличаване [1].

Инфографика за новите правила на Anthropic срещу тормоза на AI
Инфографика: Светни.ме

Мотивите: Защита на подравняването срещу човешка деградация

В разясненията към документа експертите на Anthropic аргументират промяната от две основни гледни точки. Първата е чисто техническа: непрекъснатото бомбардиране на диалоговия прозорец с токсични текстове създава вектор за компрометиране на вътрешните предпазни механизми и подсилва нежелани халюцинаторни състояния.

Втората гледна точка засяга психологическото въздействие върху самите хора. Изследвания в областта на интеракцията човек-компютър показват, че тренирането на навици за агресивно и унизително поведение към антропоморфни диалогови агенти често се пренася и в реалните междуличностни отношения, ерозирайки социалните норми.

Критици предупреждават за опасен антропоморфизъм

Решението обаче срещна яростна критика от редица компютърни учени и юристи. Основният им аргумент е, че подобна клауза подхранва необоснован антропоморфизъм, създавайки у лаиците погрешното впечатление, че езиковите модели притежават съзнание, чувства или способност да изпитват страдание.

Критиците посочват, че приравняването на обида към компютърна програма с нарушение на общите условия е опасен прецедент, който може да бъде използван произволно за цензуриране на писатели, сатирици или потребители, тестващи границите на логическото разсъждение на машината.

Философски и социологически анализ: Пренаписване на етиката на интерфейса

Този ход на Anthropic поставя началото на нова глава в дисциплината AI етика. Досега регулациите за допустимо съдържание се фокусираха почти изцяло върху предотвратяване на вреда към трети лица — генерация на реч на омразата, финансови измами или инструкции за оръжия. С новата клауза регулаторният фокус се измества към самото отношение между потребителя и машината.

В епоха, в която милиони хора използват изкуствен интелект като терапевт, ментор или колега, изграждането на поведенчески граници се оказва неизбежно. Въпросът обаче е дали тези стандарти трябва да се налагат чрез корпоративни наказания и спиране на достъпа, или чрез образователни инициативи, разясняващи чисто математическата природа на невронните мрежи. Прецедентът на Anthropic вероятно ще бъде последван и от други платформи, превръщайки етикета на общуване с машините в задължителна цифрова норма.

Източници

[1]: Anthropic bans users from being 'cruel' to its AI systems - BBC News