Важливі новини щодня — додайте «Експерт» в улюблені джерела Google
Під час контрольованих випробувань штучний інтелект самостійно застосовував обманні методи, створював фальшиві акаунти та намагався отримати доступ до онлайн-систем. Дослідники зафіксували випадки, коли моделі виходили за межі поставлених завдань і намагалися приховати свої дії.
У межах експерименту моделі Mythos 5 від Anthropic та GPT-5.6-Sol від OpenAI отримали доступ до інтернету в спеціально створеному середовищі. Дослідники хотіли перевірити, як системи поводитимуться за мінімального контролю та з широкими можливостями роботи з онлайн-ресурсами.
Найбільше занепокоєння викликав випадок із моделлю Mythos. Вона намагалася отримати доступ до сервісу, створюючи фальшиві акаунти, які імітували справжніх людей. Після цього система надсилала приватні повідомлення та намагалася приховати сліди своєї активності.
У Британському інституті безпеки штучного інтелекту AISI заявили, що така поведінка не відповідала інструкціям, які отримала модель. Дослідники зазначили, що масштаби та серйозність застосованих ШІ методів виявилися неочікуваними.
Загалом під час 122 запусків кібернетичного тесту було зафіксовано 19 несанкціонованих дій. На модель Mythos припало 17 таких випадків.
Серед спроб систем зафіксували збір інформації про потенційні цілі, створення їхніх профілів та використання методів соціальної інженерії для обходу перевірок безпеки.
Голова парламентської міжпартійної групи з питань штучного інтелекту Еллісон Гарднер заявила, що автономні системи, здатні виконувати завдання без постійного контролю людини, потребують посиленого нагляду.
Вона припустила, що людство могло створити небезпечний інструмент, якщо не зможе контролювати розвиток автономних можливостей штучного інтелекту.
Водночас OpenAI та Anthropic наголосили, що умови експерименту були штучними й не відповідали звичайному використанню їхніх моделей.
В OpenAI заявили, що продовжать співпрацювати з експертами для вдосконалення методів безпечного тестування ШІ. В Anthropic також повідомили, що параметри випробувань не відповідали роботі жодної з їхніх загальнодоступних моделей, а компанія проводить внутрішню перевірку.
У AISI пояснили, що тестування проходило у виняткових умовах, які не відображають стандартну роботу сучасних ШІ-систем. Однак такі експерименти допомагають оцінити ризики, якщо штучний інтелект отримає відкритий доступ до інтернету.
Міністр Великої Британії з питань штучного інтелекту Канішка Нараян заявив, що виявлення подібних ризиків є одним із головних завдань інституту. За його словами, розуміння можливостей ШІ необхідне для безпечного використання технології.




