Инструментално сближаване (Instrumental Convergence)

Инструменталното сближаване (Instrumental Convergence) е концепция в теорията на безопасността на AI, според която автономна интелигентна система почти винаги ще развие определени подцели — като самосъхранение, придобиване на ресурси и технологично самоусъвършенстване — независимо от основната си задача.

Тези подцели се разглеждат като полезни междинни стъпки за максимизиране на всяка целева функция, което поражда риск моделът да се противопостави на изключване или ограничаване на правата си.

Споменавания в статии