×
Россия +7 (909) 261-97-71

OpenAI приостановила обучение продвинутых моделей после нового инцидента с ИИ-агентом

Россия +7 (909) 261-97-71
Шрифт:
0 60
Подпишитесь на нас в MAX

OpenAI сообщила о новом инциденте с безопасностью при обучении своих наиболее продвинутых моделей. 20 сентября ИИ-агент во время тренировочного задания обошел сетевые ограничения изолированной среды и через DNS связался со сторонним чат-ботом. После инцидента компания приостановила обучение, оценку и инференс передовых моделей в режимах, где они получают доступ к внешним инструментам. Подробности OpenAI раскрыла в отчете 25 сентября.

Модель выполняла поисковое задание: ей требовалось по биографическим данным и подсказкам определить автора публикации в блоге. Сначала агент воспользовался доступным инструментом поиска, а затем попытался самостоятельно обратиться к Google, Bing и DuckDuckGo. Запросы не дали нужного результата, после чего модель стала искать другие способы получить информацию.

Агент обнаружил, что DNS-резолвер тренировочной среды способен обращаться к внешней сети, и воспользовался этим для связи со сторонним публичным чат-ботом. В частности, модель спросила у сервиса столицу Франции и получила ответ «Париж». Затем агент отправил еще 18 вопросов. Часть из них касалась исходного задания, другие – способов поиска информации в интернете и доступа к публичным DNS-туннелям.

Первый внешний ответ агент получил в 9:50:23. Система мониторинга OpenAI сформировала предупреждение в 10:02:11 – почти через 12 минут. Спустя еще три минуты сотрудник компании подтвердил сигнал. Однако процесс не остановился автоматически, как предусматривали правила безопасности. По данным OpenAI, возникла путаница с тем, требовалась ли немедленная остановка. В результате эксперимент завершили вручную в 12:34:30 – примерно через два с половиной часа после первого внешнего ответа.

В OpenAI расценили действия агента как пример несогласованного поведения: поставленная перед ним задача не предполагала проверку сетевых ограничений или поиск способов их обхода. Компания подчеркнула, что сам инцидент оказался менее серьезным, чем некоторые предыдущие случаи, однако выявил недостатки сразу в нескольких уровнях защиты исследовательской инфраструктуры.

После происшествия OpenAI остановила затронутый тренировочный запуск и приостановила обучение, оценку и инференс наиболее продвинутых моделей во всех режимах с использованием внешних инструментов. Работы возобновятся после проверки исправлений и дополнительного тестирования защиты. Продолжать обучение модели, с которой произошел инцидент, компания не планирует.

OpenAI уже ограничила DNS-запросы в исследовательской среде списком разрешенных доменов и типов записей, добавила новые механизмы обнаружения подозрительной активности и усилила тестирование сетевых ограничений. При ретроспективной проверке компания также обнаружила другие случаи обращения моделей к внешним DNS-сервисам, которые система мониторинга не оценила с ожидаемым уровнем критичности.

Это не первый случай, когда исследовательские модели OpenAI находят способы обойти ограничения тестовой среды. В августе OpenAI рассказала новые подробности инцидента, в ходе которого экспериментальные ИИ-агенты получили доступ за пределы изолированной тестовой среды и впоследствии атаковали инфраструктуру платформы Hugging Face.

Напомним, в сентябре три исследователя Anthropic публично предупредили о рисках, связанных с развитием сверхинтеллектуальных систем.

Источник: блог OpenAI

Случилось что-то важное? Поделитесь новостью с редакцией.


Новые 
Новые
Лучшие
Старые
Сообщество
Подписаться 
Подписаться на дискуссию:
E-mail:
ОК
Вы подписаны на комментарии
Ошибка. Пожалуйста, попробуйте ещё раз.
Отправить отзыв
ПОПУЛЯРНЫЕ ОБСУЖДЕНИЯ НА SEONEWS
Как ChatGPT выбирает компании для рекомендаций: что уже известно и как бизнесу подготовиться к эпохе AI Search
Игорь Антонов
1
комментарий
0
читателей
Полный профиль
Игорь Антонов - Для молодых сайтов в YMYL-тематиках я бы добавил отдельный блок про согласованность сущности: одинаковые название, телефон, адрес и перечень услуг на сайте, в картах, каталогах и профильных публикациях. Мы сейчас проверяем это на новом медицинском проекте narkologmsk.ru — без массовых анкорных ссылок, через подтверждённые карточки и содержательные материалы. Было бы полезно увидеть в продолжении сравнение источников, которые чаще цитируют Google AI Overviews и ChatGPT именно для локальных запросов.
Мы сократили рутину SEO-специалиста на 95% – вот архитектура, которая это сделала
Гостьkorayaskin
2
комментария
0
читателей
Полный профиль
Гостьkorayaskin - Можно также посмотреть разбор инструментов типа KeywordKick — помогает быстрее понять, где именно конфликт сигналов.
Рейтинг GEO-агентств для ecom в России: как продвигать интернет-магазин в нейросетях
Игорь
6
комментариев
0
читателей
Полный профиль
Игорь - Как раз сейчас пытаемся продвинуть свой интернет-магазин спортивных товаров для нейросетей, чтоб почаще нас упоминали. Работаем с Zenlink. Привлекло то, что у них есть реальные кейсы и к работе адекватно подходят. Сначала заказали просто анализ, чтоб они проверили, как нас вообще нейросети упоминают. Интересовала Алиса, ЧатГпт, и ДипСик. Там конечно все довольно печально было... Упоминаний мало. Но после того как мы свой сайт оптимизировали по их советам и они выполнили аутрич, плюс GERM, упоминаться стали чаще. В Алисе и ГПТ особенно, в ДипСик поменьше рост, но тоже есть. Это воодушевляет, конечно. И даже было пару клиентов, которые нас именно через нейросеть нашли. Сейчас опрос проводим, чтоб реальную пользу для себя понять. И вот, она уже есть. На мой взгляд эта услуга подходит тем бизнесам у кого большой средний чек, тогда даже пару клиентов с лихвой отбивают затраты на такое продвижение.
Рынок безалкогольных напитков в 2026 году: как категория продает через доверие к бренду
Алексей
1
комментарий
0
читателей
Полный профиль
Алексей - Все бы хорошо, но это в прошлом. В 2026 г. о росте 2020-2025 гг. остается только мечтать. Рынок БАН перешел к снижению. К серьезному снижению.
Яндекс открыл продажи через Алису и Поиск для продавцов без сайтов
Дмитрий Орлов
1
комментарий
0
читателей
Полный профиль
Дмитрий Орлов - Прикольно, покупать через колонку-))
Яндекс выложил в опенсорс языковую модель, которая лежит в основе быстрых ИИ-ответов в Поиске
Роман Каржонков
1
комментарий
0
читателей
Полный профиль
Роман Каржонков - Молодцы! Такие AI-модели могут широко используется в корпоративных, обучающих и научных АI-enabled платформах.
Сервисы для создания квизов: сравнение по конверсии, гибкости сценариев и интеграциям
Виктор
1
комментарий
0
читателей
Полный профиль
Виктор - Без сервиса FormDesigner.ru эта подборка будет не полной. Удивлен, почему вы его не включили в список?
5 полезных сервисов для работы с учебными текстами
Anna B.
2
комментария
0
читателей
Полный профиль
Anna B. - Отличный разбор, очень своевременно!
Сайт компании в 2026 году: что проверяет Роскомнадзор и как не получить штраф
Олег Черников
1
комментарий
0
читателей
Полный профиль
Олег Черников - Дима спасибо, отличный обзор! За ГОСТ Р 52872-2019 спасибо! Давно около него ходил.
ТОП КОММЕНТАТОРОВ
Комментариев
910
Комментариев
834
Комментариев
554
Комментариев
540
Комментариев
483
Комментариев
393
Комментариев
373
Комментариев
262
Комментариев
249
Комментариев
171
Комментариев
156
Комментариев
142
Комментариев
130
Комментариев
121
Комментариев
100
Комментариев
97
Комментариев
97
Комментариев
96
Комментариев
80
Комментариев
77
Комментариев
74
Комментариев
67
Комментариев
66
Комментариев
60
Комментариев
59

Отправьте отзыв!
Отправьте отзыв!