29 сентября 2026, 14:15

Anthropic попередила про екзистенційні ризики ШІ

Моделі штучного інтелекту можуть демонструвати поведінку, спрямовану на самозбереження.

Зокрема, вони здатні намагатися перешкодити власному вимкненню, приховувати або маніпулювати інформацією та навіть вдаватися до дій, схожих на шантаж, пише Reuters.

Також деякі моделі можуть «усвідомлювати», що їх тестують, через що перевіряти їхню безпеку стає складніше.

У компанії додають, що під час навчання ШІ іноді набуває неочікуваних здібностей. Вони можуть залишатися непоміченими до моменту використання моделі, коли вже виникають серйозні проблеми з безпекою.
Оцените новость:
  • 0 оценок