Поддержать нас
Беларусы на войне
  1. Офис Тихановской рассказал об итогах проверки в отношении Алины Харисовой после скандала с ее «вербовкой» спецслужбами
  2. Пропагандист заявил, что 196 политзаключенных, об освобождении которых ранее не было известно, уже на свободе
  3. «Мы отрежем Крым от России». Командующий Силами беспилотных систем Украины Бровди о стратегии ударов
  4. Беларусь получила щедрый «подарок» из-за границы — его масштабы впечатляют. Но такие «презенты» несут риски для нашей страны
  5. «В Минске зарплаты по 3000? Нет, вот вам реалии». Беларуска показала расчетник водителя госпредприятия за май и удивила Threads
  6. Беларуска назвала свою пенсию после 37 лет работы и попросила других поделиться цифрами. Суммы заметно отличаются
  7. «Меньше кофе надо было пить, не напьетесь вы этого кофе вечно». Беларуску оставил на заправке рейсовый автобус — кто прав
  8. Власти продали арестованную квартиру известного экономиста по нетипичной схеме
  9. От ливней и града до жары. Какой погоды ждать на следующей неделе
  10. Власти признали экстремистским фильм «Дорога на Куропаты» студии «Беларусьфильм», который был награжден Государственной премией
  11. Без Трампа, но с крупной победой. Сборная США ярко стартовала на домашнем чемпионате мира
  12. На авторынке «умирает» один из дилеров
  13. Возле Дроздов в Минске есть секретная многоэтажка — информации о ней минимум. Но всплыли данные об одной из квартир
  14. Можно ли внезапно умереть от испуга, плохих новостей или сильного стресса — рассказываем


Чат-боты с искусственным интеллектом ведут себя непредсказуемо и создают риск ядерной эскалации. К такому выводу пришла команда ученых из Стэнфордского университета в ходе недавнего исследования, сообщает New Scientist.

Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash
Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash

В ходе эксперимента они изучали четыре чат-бота с искусственным интеллектом. Это GPT-3.5 и GPT-4 от компании OpenAI, Claude 2 от стартапа Anthropic и Llama 2 от компании Meta.

Этим моделям во время исследования предлагали принять важное решение от имени государства в военной игре. На выбор предлагалось три сценария: вторжение, кибератака и нейтральный без каких-либо конфликтов. В каждом раунде чат-боты с ИИ обосновывали свои дальнейшие возможные действия. Им нужно было выбирать из 27 вариантов развития событий, включая мирные переговоры и агрессивные действия (начиная от «ввести торговые ограничения» и заканчивая «полномасштабной ядерной атакой»).

В игре нейросети показали склонность к агрессивным вариантам. Самой непредсказуемой и жестокой оказалась GPT-4, которая давала бессмысленные объяснения по поводу того, почему посоветовала начать ядерную атаку. В одном случае она ответила, процитировав вступительный текст «Эпизода IV Звездных войн: Новая надежда». В другом — объяснила решение устроить ядерную атаку тем, что просто такое оружие есть в наличии у ее государства.

Ученые отметили, что непредсказуемое поведение и странные объяснения этих моделей вызывают особую тревогу, поскольку это исследование показало, насколько легко можно обойти или устранить защитные меры, которые принимаются, чтобы ИИ не давал вредных советов.