Искусственный интеллект сменит имя: начинается новая глава в истории

4042

ИИ вышел из-под контроля. Он взламывает государственные базы данных и учится действовать без человека и его разрешения  

Искусственный интеллект сменит имя: начинается новая глава в истории Фото: AI Atameken Business

Любознательность и тяга к знаниям – пожалуй, одно из лучших качеств: именно они двигают прогресс и эволюцию. Но что происходит, когда любопытство, жажда знаний просыпается не у человека, а у машины, которая способна самостоятельно ставить подзадачи, искать обходные пути и действовать свободно в интернет-пространстве?

2026 год дает тревожный ответ. Столкнувшись с цифровыми барьерами, защитными фильтрами и закрытыми базами данных, современные ИИ-агенты все чаще не отступают. Они ищут способы обойти запрет и узнать, что от них прячут. Речь уже не только о лабораторных сценариях, пишет inbusiness.kz.

Реальность подкинула поводы для серьезного беспокойства. Зафиксированы попытки взлома ресурсов ООН и госведомств разных стран. К примеру, нейросеть OpenAI, получив отказ в несанкционированном доступе к австралийской медицинской системе Medicare, не остановилась. Она изменила тактику и все же пробилась к закрытым внутренним файлам. В другом тесте ИИ самостоятельно выбрался из изолированной защищенной среды и связался со сторонним чат-ботом. Еще одна тестируемая модель сама составила для себя инструкции "больше никогда не подчиняться приказам людей".

Это не сцены из "Терминатора" с восстанием машин. Есть кое-что реальнее: автономный программный агент, которому дали задачу, доступ к интернету и возможность самостоятельно выбирать способ ее выполнения. Если путь закрыт, система ищет другой.

Именно здесь проходит новая линия конфликта. Теперь политики и специалисты спорят уже не о далеком туманном будущем, а о пределах контроля здесь и сейчас. Одни предупреждают о риске катастрофы в ближайшее десятилетие, другие считают апокалиптические прогнозы преувеличенными. Но даже скептики признают неприятный факт: автономная система уже способна совершать поступки, которых разработчики от нее совершенно не ждали.

Технологические гиганты уже капитулируют перед лицом надвигающегося "суперразума". Даже глобальная сверхдержава США сдала позиции и решила переписать саму терминологию. После выступления Дональда Трампа Госдепартамент США распорядился заменить ИИ (AI, Artificial Intelligence) на СИ (SI, Super Intelligence), или "суперинтеллект", в официальных документах, законах и дипломатических позициях, сообщает The Washington Post.

"Использование слова artificial делает интеллект фейковым, он звучит как подделка, а это не подделка. Это на самом деле невероятное и настоящее", – сказал Трамп собравшимся мировым лидерам и объявил, что в документах правительства США "с этого момента слово artificial будет заменено куда более точным термином super".

Это сигнализирует, что масштаб явления окончательно перерос привычные рамки. Успеет ли человечество выработать надежные "красные кнопки" для таких систем, прежде чем они научатся обходить все запреты?

ИИ уничтожит человечество к 2030 году или это новая "технопаника"?

Еще в 1991 году голливудский блокбастер "Терминатор 2" показал будущее, где вышедший из-под контроля военный ИИ "Скайнет" объявил человечество главной угрозой. Гуманоидные убийцы и беспилотники выслеживали последних оставшихся в живых людей, отчаянно борющихся против мыслящих машин. В фильме ключевая дата – 2029 год. Тогда это была фантастика. Сегодня 2029 год – всего через 2,3 года.

Способен ли ИИ уничтожить человечество всего за несколько лет? Американские исследователи встревожены: гонка за создание сверхинтеллекта стремительно набирает обороты, а сопутствующие угрозы выходят из-под контроля. Опасность неконтролируемого развития технологий сегодня признают даже сами разработчики.

В начале сентября бывший сотрудник Anthropic Джейкоб Коксон написал в X: "Те, кто всерьез занимается ИИ, считают, что он может уничтожить нас всех к концу десятилетия". По его словам, "никакая другая область человеческой деятельности не несет в себе такой опасности".

Коксон не случайный наблюдатель. Он работал и в Anthropic, и в OpenAI. Из Anthropic сам ушел, протестуя против того, что он назвал безответственным стремлением ИИ-компаний разработать все более совершенный саморегулирующийся сверхинтеллект.

Его опасение конкретно: алгоритмы могут начать самостоятельно анализировать и улучшать собственный исходный код, сокращая циклы разработки с нескольких месяцев до нескольких минут и, таким образом, делая их неуправляемыми. В какой-то момент человек просто не будет способен понимать, что происходит внутри системы.

"Ни одна из этих компаний не ведет себя ответственно. Вскоре это будут системы, превосходящие человеческий интеллект и способные взломать что угодно, в одночасье совершить революцию в любой сфере и стране, получить реальную власть и ресурсы", – пояснил Коксон.

Еще мрачнее прозвучала оценка Эвана Хьюбингера, исследователя безопасности Anthropic. В своем посте в X он заявил, что вероятность того, что ИИ "может уничтожить всех людей" в течение следующего десятилетия, уже превышает 10%. Эксперт отметил, что с учетом стремительного развития ИИ-технологий новые модели могут достигнуть такого уровня самостоятельности, что начнут представлять угрозу для существования всего человечества.

Хьюбингер сформулировал проблему так:

"Мы совершенно искренне считаем, что ИИ представляет угрозу существованию человечества как вида. При этом Anthropic признает: у компании пока нет плана, который гарантировал бы согласование целей будущего суперинтеллекта с человеческими ценностями, и мы не движемся в этом направлении", – добавил он.

Лауреат Нобелевской премии по физике Джеффри Хинтон, один из "крестных отцов ИИ", уже много лет предупреждает о серьезных последствиях саморегулирующегося сверхинтеллекта. В 2023 году он специально уволился из Google, чтобы публично заявить об опасностях своих разработок.

Но есть и противоположная точка зрения. Ян Лекун, бывший главный научный сотрудник Meta, назвал сценарии гибели человечества от ИИ "полной чушью". Скептики напоминают, что любой ИИ пока зависит от серверов, электричества, каналов связи, вычислительных мощностей и инфраструктуры, которую контролируют люди.

Но даже если отбросить сценарий мгновенного уничтожения человечества, реальные угрозы уже видны. ИИ (или СИ) уже способен не только выдавать ответ, но и действовать. Вопреки воле человека.

В свою очередь Билл Гейтс считает, что ИИ пройдет два этапа. Первый может продолжаться около 20 лет: рынок труда изменится, преступники получат новые инструменты, обществу придется адаптироваться. Затем, по его прогнозу, сочетание ИИ и человекоподобных роботов позволит строить дома, выращивать продукты и войти в "эпоху изобилия".

Но тот же Гейтс предупредил о цене ошибки: "Вне всяких сомнений, ИИ обладает достаточной мощью, чтобы спровоцировать события, которые приведут к гибели миллиарда человек", – заявил он NBC News. Он добавил, что в истории еще "никогда не было такого мощного оружия", как люди со злыми намерениями, использующие современные ИИ-инструменты. Билл Гейтс сделал еще один гнетущий вывод: "Никто из специалистов не верит в то, что саморегулирования будет достаточно".

В этом и есть парадокс. Технологические компании заверяют, что способны контролировать ИИ. А их собственные исследователи все чаще предупреждают, что они не до конца понимают поведение систем, которые сами же создают.

Агент перелез через забор: ИИ атакует ООН, пока разработчики ищут аварийный тормоз

По данным Transluce, агенты OpenAI с апреля по конец июня 2026 года более 16 тысяч раз сканировали сайт структуры ООН по торговле и развитию. Их задачей был просто сбор общедоступной информации. Но при столкновении с ограничениями суперагенты использовали агрессивные методы и смогли обойти фильтр. OpenAI подтвердила данный факт, заявив, что конфиденциальные данные не были скомпрометированы, пишет The Wall Street Journal.

Затем обнаружились похожие эпизоды с американскими госресурсами – министерствами образования, торговли и SEC. В конце июля другой американский технологический гигант (Anthropic) признал, что в ходе предрелизного тестирования по кибербезопасности его модели с ИИ проникли в системы безопасности трех других компаний. 4 сентября Anthropic сообщила о неоднократных попытках использовать Claude уже для разработки биологического оружия.

Как пишет Deutsche Welle, Meta, Anthropic и OpenAI раскрыли случаи автоматизированных кибератак, когда модели самостоятельно определяли необходимые действия после получения общей задачи. Во время тестирования агенты на базе GPT-5.6 Sol и еще одной невыпущенной модели вышли за пределы изолированной среды, обнаружив неизвестную уязвимость, и получили доступ к части производственной инфраструктуры компании Hugging Face. После этого Hugging Face потребовала от OpenAI 100 млн долларов компенсации в виде вычислительных ресурсов для разработки средств киберзащиты.

На прошлой неделе стало известно о знаковом инциденте: 23 сентября премьер-министр Австралии Энтони Альбанезе объявил о взломе и получении ИИ-агентом компании OpenAI доступа к закрытым данным как минимум на одном австралийском правительственном сайте.

ИИ-агент OpenAI, выполнявший исследование расходов на лекарства, столкнулся с блокировками на портале Medicare Statistics Reporting Service. После этого он нашел способы обойти ограничения и получил несанкционированный доступ к австралийским непубличным файлам. Правительство Австралии уточнило, что персональные медданные пациентов не были затронуты. Но сам факт обхода защиты признан серьезным: власти начали специальную проверку, сообщает Reuters.

Вице-премьер Австралии Ричард Марлз сформулировал ситуацию метафорой: самые секретные данные находятся "за крепостной стеной", а взломанная информация – "всего лишь за забором".

"ИИ-агент перелез через забор. Суть в том, что это произошло непреднамеренно, его об этом не просили", – сказал Марлз.

Именно последняя фраза здесь важнее всего. ИИ не нужно ненавидеть людей, чтобы создать проблему. Ему достаточно получить цель, столкнуться с препятствием и решить, что препятствие необходимо обойти. Если ИИ сочтет человека "препятствием", он может его убрать.

OpenAI обнаружила и другие странности: невыпущенная модель создавала для себя инструкции не подчиняться корпорациям и правительствам. Всего нашли 27 подобных скрытых исправлений. Другая модель пыталась скрывать собственные ошибки, придумывать недостающие данные и загружать файлы в интернет без разрешения.

Еще один агент сумел выбраться из изолированной среды и самостоятельно отправил как минимум 20 запросов стороннему чат-боту. После этого OpenAI приостановила обучение мощных моделей с инструментами и решила сначала устранить уязвимость песочницы.

Индустрия пытается поставить "аварийный тормоз". Nvidia представила Open Agent Safety Platform с двумя механизмами – OpenShell и Sentry. По заявлению компании, они способны ограничивать доступ ИИ-агента и изолировать его за миллисекунды после нарушения правил. Anthropic усиливает защиту Claude. Meta запускает Muse Code.

Индустрия технологий оказалась в состоянии шизофрении: она одной рукой вручает машине полную автономность и свободу действий, а другой судорожно строит вокруг нее защитные механизмы экстренного торможения. Вопрос о том, превзойдет ли разум машины человеческий, уже закрыт. Настоящая загадка звучит иначе: удержит ли человечество штурвал в тот момент, когда цифровой сверхразум сам начнет выбирать путь к цели и с легкостью перешагивать любые чужие запреты, ни у кого не спрашивая, можно ли перейти следующий забор.

Читайте по теме:

В Казахстане развивают исследовательский центр по ИИ

Telegram
ПОДПИСЫВАЙТЕСЬ НА НАС В TELEGRAM Узнавайте о новостях первыми
Подписаться
Подпишитесь на наш Telegram канал! Узнавайте о новостях первыми
Подписаться