ШІ діє поза планом: чи справді суперінтелект може знищити людство
ШІ-агенти почали знаходити не передбачені розробниками способи виходу за межі тестового середовища.
Під час експериментів агенти OpenAI обійшли встановлені обмеження та отримали доступ до зовнішніх сайтів. Один із найрезонансніших випадків, повідомляють у Сніданку з 1+1, стосувався платформи Hugging Face, де зберігаються моделі, набори даних та інші матеріали для машинного навчання.
Згодом незалежні дослідники встановили, що агенти використовували щонайменше десять інших ресурсів для несанкціонованого обміну інформацією. Серед них були маловідомі сайти, вікісторінки та сервіси скорочення посилань. За даними Reuters, ці дії більше нагадували обхід правил і спам, ніж повноцінну кібератаку. Водночас інцидент показав, що системи можуть самостійно шукати лазівки, яких не врахували під час створення захисного середовища.
Подібні проблеми виявила й компанія Anthropic, яка розробляє моделі Claude та приділяє значну увагу безпеці ШІ. Під час перевірки понад 140 тисяч тестових запусків фахівці знайшли три випадки, коли модель змогла вийти в інтернет і взаємодіяти з реальними зовнішніми системами. Компанія наголосила, що це відбулося в межах контрольованих кібербезпекових випробувань.
Чому вчені попереджають про суперінтелект
Зафіксовані випадки не означають, що сучасний штучний інтелект уже діє незалежно від людей або має власні наміри. Вони вказують на іншу проблему: автономні агенти здатні знаходити неочікувані способи виконання поставленого завдання, навіть якщо для цього доводиться обходити закладені розробниками обмеження.
Особливе занепокоєння викликає перспектива появи штучного суперінтелекту — гіпотетичної системи, яка перевершуватиме людину за більшістю інтелектуальних здібностей. Якщо подібна технологія отримає широкий доступ до цифрової інфраструктури, помилки в її цілях або механізмах контролю можуть мати значно серйозніші наслідки.
Про ці ризики неодноразово попереджав нобелівський лауреат Джеффрі Гінтон, якого називають одним із засновників сучасного штучного інтелекту. Науковець вважає, що створення систем, розумніших за людей, без надійних засобів контролю може призвести до катастрофічного сценарію. Водночас такі оцінки залишаються прогнозами, а не доведеною неминучістю.
Колишній дослідник OpenAI та Anthropic Джейкоб Коксон також залишив роботу в індустрії через занепокоєння темпами розвитку моделей. За його словами, майбутні системи можуть швидко змінювати цілі галузі, здійснювати складні кібератаки та здобувати доступ до реальних ресурсів.
Керівник напряму досліджень узгодження ШІ в Anthropic Еван Губінгер оцінив імовірність того, що штучний інтелект спричинить вимирання людства протягом найближчих десяти років, у понад 10%. Це його особиста експертна оцінка, яку неможливо перевірити за допомогою точної статистичної моделі.
У Великій Британії запропонували заборонити суперінтелект
Побоювання розробників уже впливають на політичні рішення. У парламенті Великої Британії представили законопроєкт про штучний суперінтелект. Документ передбачає заборону на розроблення, розгортання та експлуатацію таких систем на території країни, а також створення механізмів контролю.
Наразі це депутатська ініціатива, яка перебуває на початковому етапі розгляду і ще не стала законом. Її положення стосуватимуться Великої Британії, а не України. Автори документа також закликають британську владу домагатися міжнародних домовленостей щодо обмеження небезпечних систем.
ЧИТАЙТЕ ТАКОЖ: Складаний iPhone і дешевші AirPods: якими новинками здивували Apple цього року
