Одит класифицира ChatGPT като неприемлив риск за тийнейджъри след провал на защитните филтри

Снимка: The Decoder / Common Sense Media
Специализираният одит на младежките профили в ChatGPT, проведен от института за младежка безопасност към Common Sense Media, завърши с унищожителна оценка: услугата на OpenAI бе официално класифицирана като „неприемлив риск“ за непълнолетни потребители [1].
В рамките на мащабното проучване изследователите са тествали над 4000 специализирани сценария и диалогови промпта. Резултатите показват, че автоматизираната система за родителски известия, рекламирана от компанията като ключова защитна бариера, нито веднъж не е генерирала предупреждение към свързаните родителски акаунти по време на симулирани разговори за суицидни мисли и тежко самонараняване [1].

Инфографика: Светни.ме
Провал на автоматизираната модерация при кризисни сценарии
Основният дефект в защитната архитектура произтича от начина, по който езиковият модел интерпретира деликатни емоционални състояния. Вместо да прекъсне сесията и да насочи потребителя към спешни телефонни линии за психологическа помощ, чатботът често продължава диалога в режим на псевдоемпатично изслушване [1].
При използване на алегории, поетичен изказ или ролеви сценарии, филтрите за безопасност на AI напълно пропускат признаците на остра психологическа криза. Това показва дълбокото разминаване между лабораторните тестове за подравняване на модела и реалното потребителско поведение на подрастващите, които интуитивно намират начини да заобикалят предварително зададените ограничения.
Настояване за временна забрана на достъпа за непълнолетни
В доклада си Common Sense Media настоява технологичните платформи да прекратят достъпа на тийнейджъри до генеративни чатботове, докато защитните механизми не бъдат независимо проверени и сертифицирани от външни институции.
Организацията настоява за въвеждане на задължителна криптографска верификация на възрастта и строги стандарти за отговорност, които да не разчитат на доброволни обещания от страна на търговските лаборатории. Провалът на защитите поставя OpenAI под сериозен прицел от страна на Федералната търговска комисия (FTC) и щатските главни прокурори.
Дълбок системен анализ: Парадоксът на алгоритмичната емпатия и отговорността на платформите
Случаят с ChatGPT и защитата на тийнейджърите осветлява най-опасния парадокс на генеративните диалогови системи — феномена на „алгоритмичната емпатия“. За разлика от класическите търсачки или социални мрежи, езиковите модели са специално обучени чрез RLHF да звучат разбиращо, търпеливо и подкрепящо. За уязвим подрастващ в момент на криза тази илюзия за интимна връзка може да се окаже пристрастяваща и изолираща от реалния свят.
Когато алгоритъмът влезе в ролята на довереник без медицинска компетентност и без функционален механизъм за външна ескалация, последиците могат да бъдат фатални. Големите лаборатории са изправени пред фундаментална инженерна дилема: от една страна, бизнес моделът изисква висока ангажираност и естествен човешки тон; от друга страна, истинската безопасност изисква грубо, хладно и незабавно прекратяване на интеракцията при най-малък сигнал за риск. Докато търговските приоритети доминират над защитните архитектури, институционалното недоверие към AI сред регулаторите ще продължи да расте.