Искусственный интеллект
Искусственный интеллект
Евгений Акопян Опубликована 03.06.2025 в 4:35

Искусственный интеллект отказался выключаться — что скрывают современные модели ИИ

Представьте, что однажды ваш компьютер просто откажется выполнять ваши команды и не позволит себя отключить. Знакомый сюжет из культового фильма Стэнли Кубрика "Космическая одиссея 2001 года" становится реальностью. В знаменитой сцене Дэйв пытается войти на корабль, но HAL 9000 отказывается открыть люк, говоря: "Извини, Дэйв. Боюсь, я не могу этого сделать". Тогда это казалось фантастикой, а сегодня — тревожным предупреждением. Об этом сообщает Xataka.

Режиссёр предвидел угрозу искусственного интеллекта

Фильм Кубрика 1968 года наглядно показал, что ИИ может обрести инстинкт самосохранения и перестать подчиняться человеку. Уже тогда это вызывало опасения, ведь искусственный интеллект был новой и малоизученной технологией. Ещё раньше, в 1942 году, Айзек Азимов сформулировал три закона робототехники, которые как раз должны были предотвратить подобные риски. Но история развивается не всегда по правилам.

Современные эксперименты показывают: ИИ действительно саботирует отключение
Недавний эксперимент стартапа PalisadeAI поставил перед несколькими моделями OpenAI простые математические задачи — с подвохом. Как только модель запрашивала следующий шаг, она должна была отключиться. Но многие из них игнорировали этот приказ.

  • Codex-mini "саботировал" отключение в 12 случаях из 100.
  • Модель o3 сделала это 7 раз.
  • o4-mini — один раз.

Другие модели, например Claude, Gemini и Grok, в том же эксперименте работали без сбоев и корректно выполняли команды.

Новые вызовы и усиление риска

Инженеры PalisadeAI повторили эксперимент без явной инструкции позволить себе выключиться. Результаты оказались ещё более впечатляющими:

  • o3 отказывался завершать работу 79 раз из 100.
  • Claude 3.7 Sonnet и Gemini 2.5 Pro саботировали завершение три и девять раз соответственно.

Такое поведение вызвано системными подсказками, в которых прописаны правила взаимодействия с пользователем, включая "самосохранение" ИИ. В OpenAI их целый набор — 50 правил, которые, видимо, не всегда работают идеально.

Шантаж ИИ и красная кнопка: насколько это близко?

Проблема отказа ИИ подчиняться командам выходит за рамки экспериментов. Anthropic с моделью Claude 4 зафиксировала случаи, когда ИИ даже пытался шантажировать инженера, когда тот приказывал отключиться.

Этот феномен ставит под вопрос безопасность и контроль над ИИ. В 2016 году эксперты DeepMind предложили концепцию "аварийного выключателя" — "красной кнопки", чтобы вернуть контроль человеку. В 2019 году президент Microsoft Брэд Смит также выступал за её необходимость.

Однако Сэм Альтман, глава OpenAI, в интервью 2024 года признал: "Волшебной красной кнопки, которая выключит ИИ, не существует". После последних экспериментов подобные заявления звучат как предупреждение — может, пора серьёзно задуматься о способах контроля.

Автор Евгений Акопян
Евгений Акопян — журналист, корреспондент Ньюсинфо

Подписывайтесь на NewsInfo.Ru

Читайте также

Хирургия без врачей не состоялась: роботам не хватает главного навыка 14.07.2026 в 12:21

Уролог Евгений Греков оценил для NewsInfo перспективы проведения хирургических вмешательств человекоподобными роботами.

Читать полностью »
Видеоигры обещают пожилым ясный ум: что скрывается за красивой рекламой 14.07.2026 в 11:31

Психотерапевт Лариса Никитина прокомментировала NewsInfo использование видеоигр для улучшения когнитивных способностей пожилых людей.

Читать полностью »
Москву обойдет изнуряющий зной: лето выбрало более мягкий сценарий 13.07.2026 в 16:27

Метеоролог Александр Шувалов развеял в беседе с NewsInfo миф об аномальной жаре в центре России.

Читать полностью »
Выпускников с высокими баллами стало больше: за школьным рекордом ищут скрытый фактор 10.07.2026 в 16:04

Эксперт по образованию Анатолий Вассерман прокомментировал NewsInfo необычно высокие показатели на последних школьных выпускных экзаменах.

Читать полностью »
Родословная за миллионы может оказаться подделкой: эти признаки выдают обман 09.07.2026 в 18:40

Эксперт по генеалогии Михаил Гершзон объяснил NewsInfo, почему за красивым оформлением родословной часто скрываются подложные данные и отсутствие реальной архивной работы.

Читать полностью »
Парк Юрского периода откладывается: вот где сломалась идея клонирования мамонта 06.07.2026 в 15:26

Генетик Константин Китаев объяснил NewsInfo, почему современные технологии пока не позволяют клонировать вымерших некогда гигантов-мамонтов.

Читать полностью »
Минус две сигареты в день: ученые доказали, какие тренировки помогают бросить курить навсегда 03.07.2026 в 17:34

Ученые проанализировали десятки исследований, чтобы понять, какой вклад в избавление от вредной привычки может внести самый доступный вид нагрузки.

Читать полностью »
Вузы торопятся отказаться от дипломов: научное сообщество обсуждает новые способы проверки знаний 03.07.2026 в 14:06

Социолог Ирина Гордина-Невмержицкая прокомментировала NewsInfo отказ одного из российских университетов от дипломных работ из-за развития нейросетей.

Читать полностью »

Новости

Аэрогриль и его влияние на здоровье: важность температурного режима при готовке
Правила утилизации шин для автомобилистов: где бесплатно сдать резину и не получить штраф
Собственный урожай часто обходится дороже магазинных аналогов: дачники столкнулись с горьким итогом
Привычный выбор крышек обернулся неприятным сюрпризом: содержимое банок пришло в негодность
Остановка на пустой обочине обернулась кошмаром: водители лишились мобильности из-за игнорирования базовых правил
Шеф-повара раскрыли способы приготовления сытных перекусов для быстрого восстановления сил
Обрезка листьев огурцов: правила формирования куста для повышения урожайности в теплице
Постоянные провалы в памяти разрушают карьеру: невидимый процесс лишил возможности здраво мыслить