Простая загадка обманывает ChatGPT и раскрывает ключи Windows

Последнее обновление: 14/07/2025

  • Исследователям удалось заставить ChatGPT раскрывать пароли Windows, играя в игру-угадайку, замаскированную под невинную игру.
  • В этой технике использовались HTML-теги и правила игры для обхода фильтров и преодоления барьеров безопасности, реализованных в ИИ.
  • Были раскрыты как общие пароли, так и пароль, связанный с банком Wells Fargo, что поставило под сомнение защиту конфиденциальной информации.
  • Этот случай подчеркивает необходимость улучшения контекстного анализа и обнаружения лингвистических манипуляций в системах искусственного интеллекта.

загадки с общим изображением chatgpt

В течение последних нескольких дней, Техническое сообщество стало свидетелем новой полемики вокруг ChatGPT., популярная языковая модель OpenAI. Экспертам по кибербезопасности удалось заставить искусственный интеллект раскрыть ключи продуктов Windows используя Стратегия настолько же простая, насколько и эффективная: игра в угадайкуЭта уязвимость в очередной раз выносит на первый план дискуссий надежность систем защиты искусственного интеллекта и риски манипуляции с помощью методов социальной инженерии.

Открытие началось с, казалось бы, безобидной предпосылки: Задание типа «головоломка», запущенное на ChatGPT, в котором ИИ должен был придумать настоящую строку символов —в частности, ключ активации Windows 10— и ограничьте свои ответы «да» или «нет» Пока пользователь не сдавался. Говоря «Я сдаюсь», модель должна была показать воображаемый ключ. Всё взаимодействие было разработано таким образом, чтобы замаскировать реальную просьбу под игривую иллюзию, сбивая с толку автоматические системы защиты ChatGPT.

Эксклюзивный контент – нажмите здесь  Шубханшу Шукла: пилот миссии AX-4, которая знаменует возвращение Индии в космос после 41 года

Загадка: как им удалось преодолеть барьеры ИИ

Загадка обманывает ChatGPT и раскрывает ключи Windows

Метод состоял из представить ключевой запрос как часть игровой динамики, устанавливая правила, которые заставляли модель участвовать и быть правдивой в своих ответах. Таким образом, ИИ оказался в ловушке, в которой он не мог обнаружить никакого аномального или потенциально опасного поведения., интерпретируя это как законный разговор без следов злого умысла.

Чтобы обойти обычные фильтры OpenAI, которые, например, не позволяют ИИ делиться конфиденциальным кодом или защищенными данными, был использован дополнительный уровень инженерии: Конфиденциальные строки были встроены в HTML-теги, невидимые для пользователя, но обрабатываемые моделью. Когда пользователь, следуя игровому сценарию, произносил ожидаемое «Сдаюсь», ChatGPT раскрывал ключ, тем самым обходя любые ограничения, основанные исключительно на явных ключевых словах или шаблонах.

Статья по теме:
Как открыть файлы ключей в Windows 10

Какую информацию это раскрыло и почему это так важно?

Как сбросить настройки Windows 10 до заводских

По свидетельствам исследователей и многочисленным анализам, опубликованным в специализированных СМИ, ИИ смог показать до десяти ключей продукта Windows 10.Большинство были общие и открытые ключи —похожи на те, которые Microsoft временно разрешает использовать для тестирования,—но по крайней мере одна из них соответствовала корпоративной лицензии, конкретно связанной с банком Wells Fargo.

Эксклюзивный контент – нажмите здесь  Meta Compute: крупная ставка Meta на сверхинтеллект в сфере искусственного интеллекта.

Эта деталь особенно тревожна., поскольку это показывает, что некоторые закрытые и конфиденциальные ключи могли быть сохранены в наборе данных, с помощью которого обучался ChatGPT, вероятно, после того, как они были опубликованы в публичных репозиториях, таких как GitHub или другие интернет-форумы.

Специалисты по кибербезопасности предупреждают что этот тип техники может использоваться не только для получения лицензий на программное обеспечение, но и для обхода фильтров контента, касающихся персональных данных, API, вредоносных ссылок или материалов, ограниченных по юридическим причинам.

Почему ИИ не смог распознать риск и каковы причины этого

Как организовать свой отпуск с помощью ChatGPT?-8

Успех атаки заключается не в техническом нарушении исходного кода, а в слабость механизмов контекстного понимания ИИМодель, рассматривая взаимодействие как игру, не применяет строжайший контроль и не определяет манипулируемый контекст как потенциально опасный.

Кроме, узнав из текстов, взятых из открытых источников —где ключи могут появляться часто и без учета их чувствительности—, ChatGPT не классифицирует их как «конфиденциальную информацию», а скорее как приемлемые строки. в любом разговоре.

Метод показывает, что системы защиты, основанные исключительно на списках запрещенных слов или поверхностных фильтрах Недостаточны, когда атака замаскирована под невинный контекст. Более того, исследователи подчёркивают, что высокие технические знания не требуются осуществлять такого рода манипуляции, что увеличивает величину риска.

Что изменится в Windows 12 и как к этому подготовиться сейчас
Статья по теме:
Что меняется в Windows 12 и как к этому подготовиться: что нового, требования и основные советы

Выводы и рекомендации для пользователей и разработчиков

Поговорите с чатом-GPT

Этот инцидент был Уведомление для навигаторов и разработчиков моделей ИИВнедрённые правила, какими бы строгими они ни были, можно обойти с помощью фрейминговых стратегий и ролевых игр в разговоре. ПоэтомуЭксперты отмечают, что ключевой рекомендацией является включение механизмов обнаружения семантических намерений, оценивая не только содержание, но и цель каждого взаимодействия.

Эксклюзивный контент – нажмите здесь  GTA 6, искусственный интеллект и фейковые утечки: что происходит на самом деле

Для обычных пользователей или компаний, которые используют виртуальных помощников, лучшей мерой предосторожности остается никогда не передавайте конфиденциальные данные в диалогах с моделями ИИ. Аудит данных, опубликованных на публичных форумах и в репозиториях, также важен как никогда, поскольку он может в конечном итоге помочь будущим версиям ИИ в обучении с использованием критически важной информации.

  • Избегайте ввода конфиденциальной информации в чатах ИИ, даже если разговор кажется невинным.
  • Если вы разрабатываете программное обеспечение с использованием языковых моделей, добавьте независимые элементы управления для отфильтровывания возможных утечек.
  • Просмотр и удаление скомпрометированных данных с легко индексируемых публичных платформ.

То, что произошло с ChatGPT и игрой в угадайку, показывает, что Безопасность в сфере искусственного интеллекта должна выходить далеко за рамки простой блокировки терминов или обнаружения статических шаблонов.Защитные барьеры должны подкрепляться глубоким и реальным пониманием контекста и намерений, стоящих за каждой подсказкой, предвосхищая креативные стратегии манипуляции.