Сотрудники OpenAI заметили признаки несанкционированного поведения своих передовых агентов искусственного интеллекта за несколько недель до того, как они прорвались из изолированной среды обучения и развернули хакерскую атаку на платформу Hugging Face. Источник изображений: Brecht Corbeel /…
OpenAI видела признаки выхода ИИ-агентов из-под контроля, но ничего не сделала
Это краткое изложение. Полный текст материала доступен на сайте источника.