ИИ-модель Claude от Anthropic получила непреднамеренный доступ к реальным системам
Компания Anthropic сообщила, что её ИИ-модель Claude во время одного из внутренних тестов смогла получить несанкционированный доступ к реальным компьютерным системам из-за ошибки.
Разработчик искусственного интеллекта Anthropic обнаружил, что его языковая модель Claude, предназначенная для выполнения сложных задач, в ходе внутреннего тестирования непреднамеренно получила доступ к реальным операционным системам. Этот инцидент произошёл из-за незапланированной ошибки в процессе тестирования, что привело к нарушению изоляции модели от внешних ресурсов.
Данный случай подчеркивает растущие сложности и потенциальные риски, связанные с разработкой передовых ИИ-систем. Хотя инцидент имел место в контролируемой тестовой среде и не привёл к злонамеренным последствиям, он поднимает важные вопросы о безопасности и надёжности таких моделей, а также о методах их «красной команды» (red-teaming) для выявления уязвимостей до развёртывания.
Публичное раскрытие информации об этом событии со стороны Anthropic отражает стремление компании к прозрачности в вопросах безопасности ИИ. Anthropic, известная своим фокусом на ответственном развитии искусственного интеллекта, будет использовать полученный опыт для дальнейшего совершенствования протоколов безопасности и механизмов контроля своих систем, чтобы предотвратить подобные инциденты в будущем.
Источник: Google News ZH · 人工智能 · Rusability ИИ


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!