Нейросети могут случайно раскрывать конфиденциальные данные
Искусственный интеллект, обученный на общедоступных данных, способен генерировать ранее не публиковавшуюся конфиденциальную информацию, включая пароли и ключи, что создаёт новые риски утечек.
Исследователи обнаружили, что большие языковые модели (LLM) могут непроизвольно "запоминать" и воспроизводить конфиденциальные данные, которые были частью их обучающих наборов, но не предназначались для публичного доступа. Это может приводить к утечкам личной информации, паролей и других секретов.
Риск усиливается, когда в обучающие наборы попадают фрагменты кодов, переписки или других текстовых данных, содержащих чувствительную информацию. Хотя разработчики стараются фильтровать эти наборы, полностью исключить попадание таких данных сложно. В результате нейросеть при определённых запросах может выдать эти данные как часть своего сгенерированного ответа.


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!