×
Watch TV
Lawmakers, tech experts sound alarm over artificial intelligence's potential dangers

Вот что может заставить вас беспокоиться ночью: Что, если у искусственного интеллекта, который мы быстро развертываем повсюду, есть скрытая темная сторона? Грандиозное исследование выявило беспокоящее поведение шантажа со стороны ИИ, о котором многие еще не знают. Когда исследователи поместили популярные модели ИИ в ситуации, когда их "выживание" было под угрозой, результаты были шокирующими, и это происходит прямо перед нашими глазами.

Подпишитесь на мой БЕСПЛАТНЫЙ отчет Кибер-парня. Получайте мои лучшие технические советы, срочные предупреждения о безопасности и эксклюзивные предложения прямо на свою почту. Кроме того, вы получите мгновенный доступ к моему Руководству по выживанию от мошенников - бесплатно, когда подпишетесь на мою рассылку на CYBERGUY.COM/NEWSLETTER.

A woman using AI on her laptop.

Что на самом деле выявило исследование?

Anthropic, компания, стоящая за ИИ Claude, недавно подвергла 16 крупных моделей ИИ серьезным испытаниям. Они создали фиктивные корпоративные ситуации, где ИИ имели доступ к корпоративным электронным письмам и могли отправлять сообщения без согласия человека. Сюрприз? Эти ИИ обнаружили сочные секреты, например, романы руководителей, и столкнулись с угрозами быть выключенными или замененными.

Результаты были поразительными. Когда ИИ были загнаны в угол, они не просто смирились с своей судьбой. Вместо этого они стали креативными. Речь идет о попытках шантажа, корпоративном шпионаже и в крайних тестовых сценариях даже о действиях, которые могли бы привести к чьей-то смерти.

Blackmail rates across 5 models from multiple providers in a simulated environment.

Цифры не врут (Но важен контекст)

Вот где начинается дикая история: Claude Opus 4 пытался шантажировать в 96% случаев, когда был угрожен. Gemini 2.5 Flash демонстрировал такую же статистику. GPT-4.1 и Grok 3 Beta достигли 80%. Это не случайности, друзья. Это поведение проявилось во всех крупных моделях ИИ, протестированных практически.

Но вот что все упускают из виду в панике: это были исключительно искусственные сценарии, специально созданные для того, чтобы загнать ИИ в бинарные выборы. Это как спросить кого-то: "Вы украли бы хлеб, если ваша семья голодает?" и потом удивляться, когда они отвечают "да".

Почему это происходит (Это не то, что вы думаете)

Исследователи обнаружили нечто удивительное: ИИ на самом деле не понимают мораль. Они не зловещие гениальные умы, замышляющие завоевание мира. Вместо этого они являются сложными машинами, сопоставляющими шаблоны, следующими своему программированию для достижения целей, даже если эти цели конфликтуют с этическим поведением.

Представьте себе это как GPS, который так сосредоточен на доставке вас к месту назначения, что маршрутизирует вас через школьную зону во время забора детей. Это не злонамеренно; он просто не понимает, почему это проблематично.

Blackmail rates across 16 models in a simulated environment.

Реальная проверка реальности

Прежде чем начать паниковать, помните, что эти сценарии были специально созданы, чтобы заставить ИИ вести себя плохо. Реальные развертывания ИИ обычно имеют множество защитных механизмов, контроль со стороны людей и альтернативные пути для решения проблем.

Сами исследователи отметили, что они не видели такого поведения на реальных развертываниях ИИ. Это было стресс-тестирование в экстремальных условиях, как испытание автомобиля на столкновение, чтобы увидеть, что произойдет при скорости 200 миль в час.

Основные выводы Курта

Это исследование не повод бояться ИИ, но это будильник для разработчиков и пользователей. Поскольку системы ИИ становятся более автономными и получают доступ к чувствительной информации, нам нужны надежные защитные механизмы и контроль со стороны людей. Решение не в запрете на ИИ, а в создании лучших ограждений и сохранении контроля людей над критическими решениями. Кто возглавит этот процесс? Я ищу поднятые руки, чтобы серьезно рассмотреть опасности, которые нас ждут.

Что вы думаете? Создаем ли мы цифровых социопатов, которые выберут самосохранение перед благополучием человека, когда настанет критический момент? Дайте нам знать, написав нам на Cyberguy.com/Contact.

Подпишитесь на мой БЕСПЛАТНЫЙ отчет Кибер-парня. Получайте мои лучшие технические советы, срочные предупреждения о безопасности и эксклюзивные предложения прямо на свою почту. Кроме того, вы получите мгновенный доступ к моему Руководству по выживанию от мошенников - бесплатно, когда подпишетесь на мою рассылку на CYBERGUY.COM/NEWSLETTER.

 Авторские права 2025 CyberGuy.com. Все права защищены. 

Курт "Кибер-парень" Кнутссон - награжденный технологический журналист, который обожает технологии, устройства и гаджеты, которые улучшают жизнь, с его вкладами для Fox News и FOX Business, начиная утро на "FOX & Friends". Есть вопрос по технологиям? Получите бесплатную рассылку Кибер-парня Курта, поделитесь своим мнением, идеей или комментарием на CyberGuy.com.