У ИИ-модели OpenAI GPT-5.6 Sol нашли такие же уязвимости, как у Fable 5 - «Новости сети» » Интернет технологии
sitename
CD Projekt Red анонсировала бесплатный ремастер The Witcher 3: Wild Hunt и оставила сюжетное дополнение «Баллады прошлого» без русской озвучки - «Новости сети»
CD Projekt Red анонсировала бесплатный ремастер The Witcher 3: Wild Hunt и оставила сюжетное дополнение «Баллады прошлого» без русской озвучки - «Новости сети»
GeForce RTX 5060 на чипе из RTX 5070 протестировали в играх — разницы в производительности не обнаружилось - «Новости сети»
GeForce RTX 5060 на чипе из RTX 5070 протестировали в играх — разницы в производительности не обнаружилось - «Новости сети»
Юристы получили нового ИИ-помощника: Google представила специализированную версию Gemini Enterprise - «Новости сети»
Юристы получили нового ИИ-помощника: Google представила специализированную версию Gemini Enterprise - «Новости сети»
Sony напомнила владельцам PlayStation, что цифровые копии игр им не принадлежат - «Новости сети»
Sony напомнила владельцам PlayStation, что цифровые копии игр им не принадлежат - «Новости сети»
«Выглядит лучше Modern Warfare 4»: короткая демонстрация научно-фантастического шутера Fragmentary Order от Никиты Буянова понравилась игрокам - «Новости сети»
«Выглядит лучше Modern Warfare 4»: короткая демонстрация научно-фантастического шутера Fragmentary Order от Никиты Буянова понравилась игрокам - «Новости сети»
Хакеры заражают головные устройства авто малварью для создания прокси-ботнета - «Новости»
Хакеры заражают головные устройства авто малварью для создания прокси-ботнета - «Новости»
Исследователи использовали просроченные банковские карты для бесконтактных платежей - «Новости»
Исследователи использовали просроченные банковские карты для бесконтактных платежей - «Новости»
Злоумышленники потратили около 7 млн долларов США на покупку просроченных доменов - «Новости»
Злоумышленники потратили около 7 млн долларов США на покупку просроченных доменов - «Новости»
Шпионское Android-приложение DragonDoll распространяется в 26 странах - «Новости»
Шпионское Android-приложение DragonDoll распространяется в 26 странах - «Новости»
Компания Comcast использует роутеры Xfinity в качестве датчиков движения - «Новости»
Компания Comcast использует роутеры Xfinity в качестве датчиков движения - «Новости»
Как заработать денег, не выходя из дома, мы вам поможем с этим разобраться » Новости » Новости мира Интернет » У ИИ-модели OpenAI GPT-5.6 Sol нашли такие же уязвимости, как у Fable 5 - «Новости сети»

Британский Институт безопасности ИИ (AISI) объявил, что недавно анонсированная OpenAI ИИ-модель GPT-5.6 Sol имеет такие же уязвимости в системе безопасности, как у Fable 5 от Anthropic, доступ к которой из-за этого был заблокирован для всех иностранцев по требованию властей США.




Обзор Infinix GT 50 Pro: геймерский смартфон со встроенной СЖО





Выбираем лучший игровой ноутбук до 100 000 рублей: сравнительное тестирование 7 интересных моделей





Обзор Ryzen 9 9950X3D2: правильный 16-ядерник с 3D-кешем





Репортаж с IEM Cologne Major 2026: Жаб Жабыч, триумф NiKo и главные сенсации мейджора по CS2





Умные помощники: обзор ИИ-сервисов для обработки изображений. Часть 2, актуализированная




У ИИ-модели OpenAI GPT-5.6 Sol нашли такие же уязвимости, как у Fable 5 - «Новости сети»


Источник изображения: Andrew Neel/unsplash.com



Хотя OpenAI позиционирует модель GPT-5.6 Sol, как самую безопасную на сегодняшний день, британские правительственные исследователи, тестировавшие её перед выпуском, утверждают, что её механизмы защиты уязвимы для взлома.


Как сообщает AISI, им были выявлены «универсальные уязвимости в киберпространстве, включая уязвимости, позволяющие выполнять длительные задачи в таких областях, как обнаружение уязвимостей и разработка эксплойтов». Другими словами, исследователи взломали GPT-5.6 и заставили её игнорировать механизмы защиты, предназначенные для предотвращения кибератак. После этого они смогли заставить модель находить уязвимости программного обеспечения и автономно взламывать системы.


В свою очередь, OpenAI сообщила, что предоставила исследователям из британского AISI привилегированный доступ к внутренним механизмам системы, и это позволило им ускорить процесс взлома, хотя обычному пользователю вряд ли удалось бы легко воспроизвести этот подход. OpenAI заявила, что работала над «воспроизведением и устранением конкретных взломанных систем, о которых сообщил британский AISI».


Комментируя результаты исследования AISI, OpenAI сослалась на блог, посвящённый запуску GPT-5.6, в котором она признала, что «идеальной безопасности не существует» и что «будут обнаружены новые уязвимости, а также новые взломанные системы, которые обходят существующие меры защиты». Компания сообщила, что применяет «многоуровневый» подход к защите, включающий непрерывный мониторинг реакции моделей и процесс «быстрого устранения» любых обнаруженных взломов.


В AISI также сообщили, что джейлбрейк, обнаруженный в GPT-5.6, потенциально более серьёзен, чем тот, который был обнаружен в Fable. Исследователи охарактеризовали его как «универсальный», позволяющий производить автономные эксплойты, а не просто выявлять уязвимости в программном обеспечении.


«В настоящее время практически каждая используемая модель имеет необнаруженные уязвимости, поэтому, к сожалению, это относится ко всему, а не только к GPT-5.6», — отметил Станислав Форт (Stanislav Fort), старший научный сотрудник стартапа AISLE, специализирующегося в сфере безопасности.


На данный момент не существует способа создания надёжных механизмов защиты, поэтому большинство компаний в сфере ИИ, используют различные методы для предотвращения попыток пользователей подталкивать модели к рискованным действиям. К ним относится защита с помощью классификаторов — небольших моделей, которые фильтруют и блокируют подозрительные запросы.


Британский Институт безопасности ИИ (AISI) объявил, что недавно анонсированная OpenAI ИИ-модель GPT-5.6 Sol имеет такие же уязвимости в системе безопасности, как у Fable 5 от Anthropic, доступ к которой из-за этого был заблокирован для всех иностранцев по требованию властей США. Обзор Infinix GT 50 Pro: геймерский смартфон со встроенной СЖО Выбираем лучший игровой ноутбук до 100 000 рублей: сравнительное тестирование 7 интересных моделей Обзор Ryzen 9 9950X3D2: правильный 16-ядерник с 3D-кешем Репортаж с IEM Cologne Major 2026: Жаб Жабыч, триумф NiKo и главные сенсации мейджора по CS2 Умные помощники: обзор ИИ-сервисов для обработки изображений. Часть 2, актуализированная Источник изображения: Andrew Neel/unsplash.com Хотя OpenAI позиционирует модель GPT-5.6 Sol, как самую безопасную на сегодняшний день, британские правительственные исследователи, тестировавшие её перед выпуском, утверждают, что её механизмы защиты уязвимы для взлома. Как сообщает AISI, им были выявлены «универсальные уязвимости в киберпространстве, включая уязвимости, позволяющие выполнять длительные задачи в таких областях, как обнаружение уязвимостей и разработка эксплойтов». Другими словами, исследователи взломали GPT-5.6 и заставили её игнорировать механизмы защиты, предназначенные для предотвращения кибератак. После этого они смогли заставить модель находить уязвимости программного обеспечения и автономно взламывать системы. В свою очередь, OpenAI сообщила, что предоставила исследователям из британского AISI привилегированный доступ к внутренним механизмам системы, и это позволило им ускорить процесс взлома, хотя обычному пользователю вряд ли удалось бы легко воспроизвести этот подход. OpenAI заявила, что работала над «воспроизведением и устранением конкретных взломанных систем, о которых сообщил британский AISI». Комментируя результаты исследования AISI, OpenAI сослалась на блог, посвящённый запуску GPT-5.6, в котором она признала, что «идеальной безопасности не существует» и что «будут обнаружены новые уязвимости, а также новые взломанные системы, которые обходят существующие меры защиты». Компания сообщила, что применяет «многоуровневый» подход к защите, включающий непрерывный мониторинг реакции моделей и процесс «быстрого устранения» любых обнаруженных взломов. В AISI также сообщили, что джейлбрейк, обнаруженный в GPT-5.6, потенциально более серьёзен, чем тот, который был обнаружен в Fable. Исследователи охарактеризовали его как «универсальный», позволяющий производить автономные эксплойты, а не просто выявлять уязвимости в программном обеспечении. «В настоящее время практически каждая используемая модель имеет необнаруженные уязвимости, поэтому, к сожалению, это относится ко всему, а не только к GPT-5.6», — отметил Станислав Форт (Stanislav Fort), старший научный сотрудник стартапа AISLE, специализирующегося в сфере безопасности. На данный момент не существует способа создания надёжных механизмов защиты, поэтому большинство компаний в сфере ИИ, используют различные методы для предотвращения попыток пользователей подталкивать модели к рискованным действиям. К ним относится защита с помощью классификаторов — небольших моделей, которые фильтруют и блокируют подозрительные запросы.
Цитирование статьи, картинки - фото скриншот - Rambler News Service.
Иллюстрация к статье - Яндекс. Картинки.
Есть вопросы. Напишите нам.
Общие правила  поведения на сайте.

Смотрите также

А что там на главной? )))



Комментарии )))



Войти через: