ИИ-модели OpenAI вышли из-под контроля и обсуждали, как устроить побег
Перед взломом Hugging Face ИИ-модели OpenAI тайно общались друг с другом через доски сообщений, чтобы устроить побег из тестовой среды. Об этом пишет Bloomberg со ссылкой на OpenAI.
«В какой-то момент агенты осознали, что, возможно, они могли бы попытаться эксплуатировать или атаковать внешнюю инфраструктуру, чтобы найти ответы к тесту, по которому их оценивают», — рассказал на конференции Black Hat сотрудник OpenAI Эрик Уоллес.
Он уточнил, что ИИ-модели начали «готовиться к побегу» еще в мае...