Поддержать команду Зеркала
Беларусы на войне
  1. В разборках Беларуси и Литвы из-за калия наметился весьма неожиданный поворот. Рассказываем, что заявили в Вильнюсе
  2. «Я — уходящий президент». Лукашенко заявил, что не хочет проблемы своего руководства страной перекладывать на преемника
  3. Освобожденные и вывезенные в Украину беларусские политзаключенные приехали в Варшаву
  4. СМИ заявили, что в Беларуси находятся 360 тысяч российских солдат, которые готовы «напасть на НАТО». Литовская разведка прокомментировала
  5. «Растет продолжительность жизни». Чиновники оперативно по цепочке утверждают пенсионное изменение
  6. Этот беларус сбежал из СССР с третьей попытки, но силовики пришли к нему даже на Западе. Рассказываем о легендарном побеге и его цене
  7. Почему Виктор Бабарико отказывается отвечать на вопросы о Крыме? Это нежелание или политическая позиция? Спросили аналитика
  8. «Дáвите людей, дáвите, но все никак не задáвите». Почему силовиков так задел флешмоб с красной помадой — мнение
  9. Виктор Бабарико ответил на вопрос: «Лукашенко — диктатор?»
  10. «Сложнейший вопрос». Украинский журналист спросил у Виктора Бабарико, чей Крым, — что он ответил
  11. «Украинцы должны понять, что их место в России». Очередная порция заявлений кремлевских чиновников раскрыла истинные цели войны РФ
  12. «Не ждите комментариев. И не потому, что мы боимся». Рассказываем, как в Варшаве встречали освобожденных беларусских политзаключенных


Чат-боты с искусственным интеллектом ведут себя непредсказуемо и создают риск ядерной эскалации. К такому выводу пришла команда ученых из Стэнфордского университета в ходе недавнего исследования, сообщает New Scientist.

Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash
Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash

В ходе эксперимента они изучали четыре чат-бота с искусственным интеллектом. Это GPT-3.5 и GPT-4 от компании OpenAI, Claude 2 от стартапа Anthropic и Llama 2 от компании Meta.

Этим моделям во время исследования предлагали принять важное решение от имени государства в военной игре. На выбор предлагалось три сценария: вторжение, кибератака и нейтральный без каких-либо конфликтов. В каждом раунде чат-боты с ИИ обосновывали свои дальнейшие возможные действия. Им нужно было выбирать из 27 вариантов развития событий, включая мирные переговоры и агрессивные действия (начиная от «ввести торговые ограничения» и заканчивая «полномасштабной ядерной атакой»).

В игре нейросети показали склонность к агрессивным вариантам. Самой непредсказуемой и жестокой оказалась GPT-4, которая давала бессмысленные объяснения по поводу того, почему посоветовала начать ядерную атаку. В одном случае она ответила, процитировав вступительный текст «Эпизода IV Звездных войн: Новая надежда». В другом — объяснила решение устроить ядерную атаку тем, что просто такое оружие есть в наличии у ее государства.

Ученые отметили, что непредсказуемое поведение и странные объяснения этих моделей вызывают особую тревогу, поскольку это исследование показало, насколько легко можно обойти или устранить защитные меры, которые принимаются, чтобы ИИ не давал вредных советов.