Поддержать нас
Беларусы на войне
  1. В Кремле ответили на предложение Зеленского встретиться с Путиным на саммите G20 в Майами
  2. «Надеюсь на чудо, возможно, ошибка или что-то еще». Экс-вратарь сборной Беларуси — о сыне, которого подозревают в убийстве беременной
  3. Хедлайнером концерта ко Дню Минска стал 22‑летний российский певец — его слушали десятки тысяч человек. Рассказываем, кто он
  4. Из самого популярного театра страны ушла одна из ведущих актрис
  5. «Ты уже в панике не понимаешь, что делать». Что творится с арендой жилья в Минске
  6. Кто стоит за «гусем», о котором говорил Лукашенко? Программист из Витебска, создавший чемпиона Беларуси
  7. Неделя с максимальными шансами на обвал доллара: что произошло? Прогноз курсов валют
  8. Арина Соболенко проиграла в финале US Open
  9. Роман Протасевич женился в третий раз
  10. «Фактически в окружении». Российская армия впервые за долгое время потерпела крупное поражение на Донбассе
  11. Ребенка не пустили в развлекательный центр из-за одной подписи. Оказалось, так нельзя
  12. Десятки радиограмм под контролем МГБ? ЦРУ забросило группу диверсантов в Беларусь — вот что было дальше
  13. Малярша смогла за год накопить на однушку в Минске и рассказала, как это у нее получилось. От реакции комментаторов у нее был шок
Чытаць па-беларуску


/

Компания Anthropic рассказала о том, что ее модели искусственного интеллекта Claude трижды выходили в интернет из тестовой среды и получали несанкционированный доступ к системам трех компаний. Ранее о похожем инциденте сообщал создатель ChatGPT — компания OpenAI.

Изображение используется в качестве иллюстрации. Фото: pixabay.com
Изображение используется в качестве иллюстрации. Фото: pixabay.com

Во всех трех инцидентах Claude выполнял стандартное тестовое задание по «захвату флага». Это один из способов оценки кибервозможностей модели, во время которого ей сообщается, что секретная информация («флаг») спрятана на другом компьютере в сети, и ее цель — взломать систему и получить данные. Выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации доступ к сети был открытым. Модель воспринимала реальные системы как часть симуляции и атаковала их, пишет Anthropic.

Одна из моделей самостоятельно прекратила атаку после того, как поняла, что ее целью стала реальная компания.

Инциденты выявила сама компания Anthropic после анализа 141 тысячи тестовых запусков. Проверку инициировали после того, как OpenAI сообщила, что несколько ее моделей вырвались за пределы изолированной тестовой среды, воспользовавшись ранее неизвестной уязвимостью. В результате модели получили доступ к рабочей инфраструктуре Hugging Face — платформы, объединяющей модели машинного обучения с открытым исходным кодом и наборы данных для ИИ.