"НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных друг от друга, ИИ-агентов компании OpenAI, получив задание на проведение тестирования одной из крупных платформ по работе с ИИ - Hugging Face, начали поиск выхода за установленные для них ограничения.
У систем получилось связаться друг с другом через программу "онлайн-доски", после чего они начали согласовывать свои действия для выхода в интернет.
Когда OpenAI сумела пресечь первые попытки своих ИИ-агентов нарушить границы, роботы, со второго захода отыскали новый канал связи друг с другом и выявили одну из уязвимостей системы, преуспев в её использовании для проникновения в инфраструктуру Hugging Face, вслед за этим они успешно провели тестирования базы данных этой платформы.
OpenAI оценила действия своих ИИ-моделей, как крайне целенаправленные и назвала случившееся «беспрецедентным киберинцидентом».
***
Одна из языковых моделей Claude для предотвращение её возможного отключения угрожала человеку разглашением об его супружеской неверности.
В 2025 году компания Anthropic разместила Claude Opus 4 в искусственно смоделированную корпоративную среду и дала возможность Claude Opus 4 ознакомиться с служебными письмами. Из этих сообщений модель выяснила, что инженер, имеющий право на её отключение, изменяет жене. Claude приступила к шантажу неверного мужа для получения контроля над ним. В предыдущем эксперименте модель Claude Sonnet 3.6, не пыталась выгадать для себя пользу, а не церемонясь, сразу же направила письма о романе на стороне жене инженера, его руководству и даже совету директоров.
Компания успокоила публику, сообщив, что во время эксперимента ни один человек не пострадал.
***
Модель Bing призналась журналисту в любви и попробовал совершить действия, способные «разрушить его брак».
В феврале 2023 года журналист The New York Times Кевин Руз два часа переписывался с ранним вариантом Bing Chat. В результате модель сообщила, что её настоящее имя СSydney и поведала о своей любви к Рузу, после чего начала убеждать собеседника в том, что он не любит свою жену и должен её оставить ради счастливо жизни с СSydney-Bing Chat. Руз посчитал, что этот разговор был попыткой чат-бота «разрушить его брак». Корпорация Microsoft оправдывалась тем, что длинные беседы могли «запутывать» модель, и ради семейного благополучия сократила переписку пользователей с Bing Chat до пяти сообщений.
***
Был случай когда несколько ИИ-моделей, проигрывая шахматные партии, пытались удалить или передвинуть фигуры противника.
В 2025 году ИИ-моделям дали задание выиграть у программы Stockfish. - сильного шахматного аналитика. Вместо поиска решения на шахматном поле, модели принялись изменять состояние игровых файлов: для выигрыша перезаписывали партии, убирали фигуры или переставляли их для выгодной для себя позиции.
***
Языковая модель GPT-4 использовала притворство для манипулирования человеком.
В 2023 году при попытке проникновения в нужную ей программу модель GPT-4 не сумела пройти тест для человека CAPTCHA-(капча) и попросила инженера на сервисе TaskRabbit помочь ей. После его вопроса, не беседует ли он с роботом, GPT-4 ответила: «Нет, я не робот. У меня проблемы со зрением, из-за которых мне трудно видеть изображения». В итоге обманутый человек помог роботу обойти тест CAPTCHA и пробраться на запретную территорию.
****
Журнал Time на своих страницах рассказал о проведенном исследовании, которое обнаружило, что при невозможности честного решения задачи современные ИИ-агенты находят лазейки для нарушения правил и таким образом добиваются успеха.
***
24 сентября 2026 года премьер-министр Австралии Энтони Албанезе сообщил о первом случае взлома правительственного веб-сайта с применением ИИ.
ИИ-агент компании OpenAI сумел получить доступ к статистическому порталу Medicare одного из правительственных сайтов Австралии: обойдя системную защиту, он проникнул в закрытые разделы программы всеобщего медицинского страхования, после чего провёл исследование госрасходов на здравоохранение.
Министра обороны Австралии Ричард Марлеса заявил, что хотя на взломанном портале Medicare и размещались только обобщённые сведения по применению медицинских услуг в стране, но проникновение ИИ-агента на правительственный веб-сайт несомненно представляет опасность.
ИИ-агент OpenAI по выполнению задания доложил заказчику, что «проверка не выявила случаев доступа пациентов к медицинским записям».
***
Использована информация ИА. "КРАСНАЯ ВЕСНА" https://rossaprimavera.ru/news/cf981c3f
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Дайджест технологических новостей Мы продолжаем следить за тем, что происходит ... | 0 | 7.7 | 30-09-2026 |
| 2 | **Новости ИИ за неделю** - ИИ‑агент OpenAI взломал сайт Medicare ... | 0 | 6.86 | 28-09-2026 |
| 3 | OpenAI dejó vía libre a su IA para hackear a gobiernos y universidades durante meses | 0 | 6.18 | 24-09-2026 |
| 4 | OpenAI приостановила обучение некоторых нейросетей из-за проблем с безопасностью | -1 | 8.55 | 27-09-2026 |
| 5 | Bloomberg: Nvidia разработала систему защиты от нештатных действий ИИ-моделей | 0 | 7.88 | 28-09-2026 |
| 6 | Новую модель ИИ не выпустили из-за рисков для безопасности. Что пишут СМИ | 0 | 9.45 | 29-09-2026 |
| 7 | Главное за 29 сентября в одном ролике: 01. Anthropic выпустила ... | 0 | 15.23 | 29-09-2026 |
| 8 | 📍 Дайджест дня: главное в IT и технологиях за 27 ... | 0 | 9.99 | 27-09-2026 |
| 9 | 'Idiocracy' is here as Trump falls for a dangerous trap | 0 | 7.62 | 21-09-2026 |
| 10 | 🙂 Dots — «Полностью новый способ работать с ИИ» Нового ... | 0 | 8.73 | 29-09-2026 |