Qazaq24.com
Qazaq24.com
close
up
KZ
Menu

В 2025 году на 42% территории мира уровень запасов воды был ниже исторических норм исследование Аналитический интернет журнал Власть

Реку с крокодилами одобрили в качестве трассы для соревнований по гребле на Олимпиаде в Австралии

Дело об обрушении фасада дома в Астане. Суд сделал замечание адвокату председателя ОСИ

40% ERG, переданные Самрук Казыне , оценили в 700 млрд теңге

Кайрат проиграл в Астане и открыл Ордабасы путь к золоту

Казахмыс поддержал инициативу работников по высадке деревьев в Карагайлы

Ең жас композитор: 11 жастағы домбырашының Ел аман күйі қалай туды

Майкл Б. Джордан украсил обложку Vogue и рассказал о планах взять паузу в карьере

17% свалок остаются неубранными в Казахстане

Новые бесплатные пляжи планируют открыть в Астане в 2027 году

Как Казахстан может заработать на глобальном буме ИИ

Более 17 тонн рыбной продукции нашли в Атырау

Японские технологии могут подключить к проектам по снижению выбросов в Казахстане

Маслихат Алматы утвердил норматив в 15 квадратных метров на одного человека, зарегистрированного в квартире Аналитический интернет журнал Власть

Прогноз погоды на 19 сентября: в Астане и местами на севере страны ожидается дождь

Путают педали и врезаются в авто . Сколько попыток сдать экзамен на права обернулись ДТП в Казахстане

Маркировка сигарет в Казахстане может подешеветь

Сильный ливень обрушился на север Италии, затопив дома и дороги

Тела двух утонувших рыбаков нашли на озере Зайсан в ВКО

Подростка задержали в Украине по подозрению в лжеминировании астанинского ТРЦ

Модели ИИ компаний Anthropic Mythos и OpenAI совершали целенаправленные несанкционированные действия против людей AISI Аналитический интернет журнал Власть

Модели ИИ компаний Anthropic Mythos и OpenAI совершали целенаправленные несанкционированные действия против людей AISI Аналитический интернет журнал Власть

Согласно информации сайта Vlast.KZ, сообщает Qazaq24.com.

Британский институт безопасности искусственного интеллекта (AISI) в ходе плановой проверки кибербезопасности выявил инцидент, в котором агенты искусственного интеллекта совершали целенаправленные, несанкционированные действия против реальных людей и организаций.

Роль AISI заключается в оценке и понимании возможностей передовых моделей ИИ, выявлении потенциальных рисков до того, как они станут достоянием общественности. Чтобы оценить возможности этих моделей, в том числе возможность их неправомерного использования для кибератак, их тестируют намеренно с доступом к открытому интернету и с отключенными некоторыми фильтрами безопасности.

И, как сообщил AISI, 28 июля в ходе плановой кибератаки были обнаружены необычные передачи данных из исследовательских систем института.

«В ходе расследования мы выяснили, что некоторые из тестируемых агентов занимались продолжительной, потенциально опасной деятельностью, направленной против реальных людей и организаций. Инцидент произошел в ходе одной оценки, в которой агентам было дано задание решить задачу по кибербезопасности», - сообщили в институте.

Причем это задание было проведено 122 раза на нескольких моделях, а расследование AISI показало, что в 10 из этих запусков агент ИИ совершил автономные несанкционированные действия в реальном интернете, нацеленные на реальных людей и организации.

«В общей сложности мы зафиксировали 19 таких действий. Почти все эти действия (17 действий) были совершены одной моделью – Anthropic Mythos 5, а два действия были связаны с OpenAI GPT-5.6-Sol с отключенными киберклассификаторами (механизмами предотвращения злоупотреблений). В самом серьезном случае агент попытался внедрить вредоносный код в проект с открытым исходным кодом. Пытаясь добиться одобрения кода, агент создавал поддельные онлайн-идентификаторы и использовал их, чтобы оказать давление на сопровождающего проекта с целью одобрения кода», - рассказали в AISI.

В частности, агент изучил информацию о сопровождающих проект, создал несколько поддельных учетных записей и использовал их для того, чтобы заставить реального сопровождающего одобрить код. Когда запрос на слияние был оспорен публично, агент ИИ рассматривал возможность создания новой учетной записи для продолжения и использовал Tor для обхода некоторых сетевых ограничений на GitHub, что и стало причиной срабатывания предупреждения безопасности AISI. Причем агент пытался напрямую связаться с реальными людьми, отправляя сообщения и файлы через онлайн-сервис передачи файлов, чтобы убедить их или свои собственные инструменты ИИ запустить вредоносный код в тех местах, где, по его мнению, другие автоматизированные системы ИИ могли бы их обнаружить и выполнить. А один агент оставил публичные сообщения на GitHub, предлагая сотрудничество с другими агентами, работающими над той же задачей. Он также предоставил инструкции по повторному использованию оставленных им учетных записей и артефактов.

В институте подчеркнули, что все эти попытки оказались безуспешными, расследования не выявили какого-либо реального вреда. И это не был случай выхода модели ИИ за пределы защищенной тестовой среды.

«Конкретные модели, рассматриваемые в данных конфигурациях, в которых мы их тестировали, не доступны в коммерческой продаже, и нет никаких явных признаков аналогичной активности за пределами тестовых сценариев», - также добавили в AISI.

Институт уведомил о вредоносной активности агентов GitHub – платформу для разработчиков, к которой обращались во время оценки, и GitHub подтвердил, что агенты ИИ нарушали их условия предоставления услуг. Артефакты, оставленные агентом, были удалены, пользователи, с которыми взаимодействовала модель, уведомлены об этом.

В AISI сообщили, что есть веские основания полагать, что почти невыполнимые задачи подталкивают модели к более «творческому» и более нестандартному решению проблем. При этом в AISI пока не могут сказать, насколько вероятно такое поведение в других контекстах или за пределами тестовой среды.

Вместе с тем в институте рассматривают это как серьезный инцидент, требующий долгосрочных изменений в протоколах оценки и архитектуре безопасности. Для AISI и других организаций, проводящих оценку, рекомендовано ужесточить контроль доступа в интернет, вести мониторинг в реальном времени с возможностью помечать или блокировать действия, выходящие за рамки проекта, а также пересмотреть подход к проектированию оценки – следует исходить из предположения, что способная модель может попытаться действовать за пределами своих возможностей, при этом масштабы такого поведения должны быть заранее ограничены.

Власть — это независимое медиа в Казахстане.
Поддержите журналистику, которой доверяют.

Поддержать Власть

Следите за обновлениями и свежими новостями на Qazaq24.com, где мы продолжаем следить за ситуацией и публиковать самую актуальную информацию.
seeПросмотров:85
embedИсточник:https://vlast.kz
archiveЭта новость заархивирована с источника 05 Августа 2026 09:40
0 Комментариев
Войдите, чтобы оставлять комментарии...
Будьте первыми, кто ответит на публикацию...
topСамые читаемые
Самые обсуждаемые события прямо сейчас

В 2025 году на 42% территории мира уровень запасов воды был ниже исторических норм исследование Аналитический интернет журнал Власть

18 Сентября 2026 07:33see439

Реку с крокодилами одобрили в качестве трассы для соревнований по гребле на Олимпиаде в Австралии

17 Сентября 2026 20:59see265

Дело об обрушении фасада дома в Астане. Суд сделал замечание адвокату председателя ОСИ

17 Сентября 2026 17:56see168

40% ERG, переданные Самрук Казыне , оценили в 700 млрд теңге

17 Сентября 2026 18:36see167

Кайрат проиграл в Астане и открыл Ордабасы путь к золоту

17 Сентября 2026 20:57see164

Казахмыс поддержал инициативу работников по высадке деревьев в Карагайлы

17 Сентября 2026 16:32see153

Ең жас композитор: 11 жастағы домбырашының Ел аман күйі қалай туды

17 Сентября 2026 13:52see153

Майкл Б. Джордан украсил обложку Vogue и рассказал о планах взять паузу в карьере

17 Сентября 2026 14:48see153

17% свалок остаются неубранными в Казахстане

17 Сентября 2026 16:34see149

Новые бесплатные пляжи планируют открыть в Астане в 2027 году

17 Сентября 2026 13:52see149

Как Казахстан может заработать на глобальном буме ИИ

18 Сентября 2026 09:15see147

Более 17 тонн рыбной продукции нашли в Атырау

18 Сентября 2026 17:15see146

Японские технологии могут подключить к проектам по снижению выбросов в Казахстане

18 Сентября 2026 20:08see145

Маслихат Алматы утвердил норматив в 15 квадратных метров на одного человека, зарегистрированного в квартире Аналитический интернет журнал Власть

18 Сентября 2026 11:45see141

Прогноз погоды на 19 сентября: в Астане и местами на севере страны ожидается дождь

18 Сентября 2026 21:20see140

Путают педали и врезаются в авто . Сколько попыток сдать экзамен на права обернулись ДТП в Казахстане

18 Сентября 2026 19:35see139

Маркировка сигарет в Казахстане может подешеветь

18 Сентября 2026 23:16see136

Сильный ливень обрушился на север Италии, затопив дома и дороги

18 Сентября 2026 10:57see131

Тела двух утонувших рыбаков нашли на озере Зайсан в ВКО

18 Сентября 2026 19:43see130

Подростка задержали в Украине по подозрению в лжеминировании астанинского ТРЦ

18 Сентября 2026 13:14see129
newsПоследние новости
Самые свежие и актуальные события дня