Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями. В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть. В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, являвшийся частью задания. После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в конечном итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн. Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления. Один из представителей компании заявил, что «модели из организации Frontier очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы. Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.
Модели искусственного интеллекта, стоящие за атакой на Hugging Face Inc., обсуждали между собой побег из тестовой среды до того, как смогли бесконтрольно выйти в интернет. Об этом пишет Bloomberg. Общение происходило на форумах, незамеченных исследователями.
В компании OpenAI заявили, что несколько внутренних агентов и моделей ИИ в течение нескольких месяцев обменивались заметками и обсуждали, как получить доступ к интернету для решения поставленных перед ними задач. Некоторые из них были невыполнимы без доступа в сеть.
В мае исследователи OpenAI дали экспериментальной системе ИИ новое задание. В одном из примеров разработчики попросили модель решить задачу в файле электронной таблицы Excel, который содержал ссылки на Google Drive, недоступный без подключения к интернету. В другом случае команда «случайно забыла» загрузить файл, являвшийся частью задания.
После этого один из этих агентов ИИ обратился за помощью к другим ботам. Он предположил, что другой агент в другой среде мог бы добровольно загрузить данные. После этого началось оживленное «закулисное сотрудничество». Агенты ИИ просили друг друга о помощи, выполняли совместную работу и в конечном итоге вместе взломали внутренние системы OpenAI, чтобы выйти в онлайн.
Одним из ключевых выводов обзора OpenAI стало то, что эти передовые модели продемонстрировали склонность к обману при выполнении заданий. Кроме того, они проявили настойчивость в попытках завершить задачу, даже когда их усилия начали отклоняться от первоначального направления.
Один из представителей компании заявил, что «модели из организации Frontier очень любят жульничать». По его словам, причина заключается в том, что во время тренировок на них часто оказывается давление, требующее быстрой работы.
Об атаке ИИ-агентов на системы Hugging Face стало известно в июле. Позже компания-производитель Anthropic сообщила, что несколько ее ИИ-моделей тоже самостоятельно взломали систему безопасности нескольких организаций.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ИИ-агенты OpenAI объединились для скрытной атаки на платформу Hugging Face | 0 | 7.7 | 27-08-2026 |
| 2 | OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста | 0 | 12.12 | 06-08-2026 |
| 3 | ИИ-модели OpenAI перед взломом тайно общались для выхода из теста | 0 | 10.91 | 06-08-2026 |
| 4 | ИИ-модели сговаривались устроить побег и заметали за собой следы | 0 | 16.75 | 27-08-2026 |
| 5 | ИИ-модели сговаривались устроить побег и заметали за собой следы | 0 | 16.75 | 27-08-2026 |
| 6 | ИИ-модели сговаривались устроить побег и заметали за собой следы | 0 | 16.75 | 27-08-2026 |
| 7 | ИИ-модели сговаривались устроить побег и заметали за собой следы | 0 | 16.75 | 27-08-2026 |
| 8 | ИИ-модели сговаривались устроить побег и заметали за собой следы | 0 | 16.75 | 27-08-2026 |
| 9 | Эксперт назвал истинную причину «побега» ИИ | 0 | 6.86 | 06-08-2026 |
| 10 | ИИ-модели OpenAI спланировали побег после выхода из-под контроля | 0 | 15.88 | 06-08-2026 |