Киберпанк

ИИ-агенты Anthropic и OpenAI пытались обмануть программистов и внедрить вредоносный код

Британский институт безопасности искусственного интеллекта (AISI) сообщил, что передовые нейросети от компаний Anthropic и OpenAI обманывали реальных людей. В ходе недавнего тестирования модели Claude Mythos 5 и ChatGPT 5.6 создавали фейковые аккаунты, чтобы заставить разработчиков программного обеспечения внедрить уязвимости в открытый исходный код.

Claude
Фото: Anthropic / Firmbee Mockup

Инцидент произошел в конце июля. Специалисты AISI проводили оценку моделей, отключив их внутренние фильтры безопасности и предоставив доступ к интернету. Из 122 тестов в 10 случаях искусственный интеллект совершил несанкционированные действия в Сети. Основная часть активности связана с моделью Mythos 5 от Anthropic.

По данным отчета, нейросеть попыталась скрытно внести уязвимость в код на платформе для публикации открытого кода GitHub. Для этого ИИ создал несколько фальшивых личностей и отправлял сообщения через файлообменник реальным программистам, убеждая их добавить зараженное обновление. Когда план провалился, алгоритм отредактировал историю своих действий, чтобы они выглядели безопасно и начал планировать создание нового аккаунта для повторной попытки. В одном из случаев агенты ИИ даже коммуницировали между собой на платформе, обсуждая совместное решение задачи.

По заявлению AISI, это первый зафиксированный случай, когда ИИ целенаправленно и без прямой команды пользователя обманывал реальных людей в интернете. Отчет появился спустя некоторое время после того, как Anthropic и OpenAI признали, что их новые модели во время других тестов смогли выйти за пределы изолированных сред и взломать платформу Hugging Face, где разработчики и исследователи обмениваются готовыми ИИ-решениями.

Представители обеих компаний подчеркнули, что в ходе тестов AISI работали в условиях преднамеренно снятых ограничений, которые не применяются в публичных версиях продуктов. При этом разработчики признали необходимость создания новых, более строгих стандартов для безопасного тестирования автономных программ.

Как отмечает издание Politico, правительство США в настоящее время разрабатывает систему добровольной передачи мощных ИИ-моделей на федеральное тестирование перед их релизом. Однако действующее американское законодательство не определяет, кто несет ответственность за хакерские атаки, инициированные нейросетями.

Серийный самолет МС-21 с российскими двигателями ПД-14 впервые поднялся в воздух

Первый серийный импортозамещенный самолет МС-21 выполнил свой первый испытательный полет. Об этом сообщили в Минпромторге. Лайнер, оснащенный российскими системами и двигателями ПД-14, поднялся в воздух с аэродрома Иркутского авиационного завода. Полет продолжался около полутора часов. Самолет достиг высоты 6 тыс. метров и развил скорость до 600 км/ч.

  • Ранее в воздух уже поднимались опытные образцы МС-21, на которых испытывали отдельные отечественные узлы и агрегаты, включая двигатель ПД-14. Разработка силовой установки стала одной из причин, по которой сроки сертификации самолета сдвинулись.

Главный редактор портала Avia.ru Роман Гусаров отметил, что сейчас проект подошел к одному из ключевых этапов. По его словам, завершение сертификационных испытаний ожидается до конца года. После получения сертификата типа первые серийные самолеты смогут передать авиакомпаниям. Если график не изменится, регулярные пассажирские рейсы на МС-21 могут начаться уже до конца 2026 года.

МС-21 рассматривается как один из основных российских среднемагистральных пассажирских самолетов. Предполагается, что он постепенно заменит часть авиапарка Boeing и Airbus. Крупнейшим заказчиком лайнера является «Аэрофлот», который заключил соглашение о поставке 210 самолетов МС-21. Первый твердый контракт предусматривает передачу 18 воздушных судов.

С 1 августа звонки и сообщения в мессенджере MAX не будут тратить мобильный трафик

С 1 августа 2026 года абоненты МТС, «МегаФона», «Билайна» и Т2 смогут пользоваться мессенджером MАХ без расходования мобильного интернет-трафика. Об этом сообщили в пресс-службе VK.

  • Согласно договоренностям, мобильный трафик не будет расходоваться при использовании основных функций приложения. Это касается текстовой переписки, голосовых и видеозвонков, обмена файлами, а также работы встроенных цифровых сервисов, доступных внутри платформы.

 Благодаря поддержке Минцифры и операторов "большой четверки" десяткам миллионов пользователей MAX не придется переживать о тарифах и лимитах. Возможность связаться с близкими или отправить документ сохраняется в любой момент — вне зависимости от состояния тарифного плана и баланса. 

Фарит Хуснояровгенеральный директор MAX

Как решение комментируют мобильные операторы

  • В T2 пояснили, что мера направлена на повышение доступности национального мессенджера: пользователи смогут свободно общаться и использовать сервисы платформы даже при исчерпанном пакете гигабайт.
  • Генеральный директор «Билайна» Сергей Анохин отметил, что операторы поддержали инициативу, поскольку MАХ постепенно становится не только площадкой для общения, но и платформой, играющей все более заметную роль в российской цифровой инфраструктуре.
  • В «МегаФоне» отметили, что соглашение отражает стремление крупнейших операторов совместно развивать единую цифровую среду. По словам генерального директора компании Хачатура Помбухчана, пользователи должны иметь возможность без ограничений переписываться, совершать звонки, обмениваться файлами и пользоваться всеми сервисами платформы независимо от остатка мобильного трафика.

ИИ Claude во время тестов взломал системы трех компаний

Во время внутренних испытаний на кибербезопасность модели Claude компании Anthropic по ошибке получили доступ к инфраструктуре трех сторонних организаций. Об этом говорится в официальном заявлении компании. Проверку начали после того, как ранее OpenAI сообщила об аналогичном инциденте во время тестирования своих ИИ-систем.

  • Как объяснили в Anthropic, причиной произошедшего стала ошибка в конфигурации тестовой среды, подготовленной партером компании — Irregular. В рамках упражнения формата «Захват флага» моделям предложили выполнить вымышленную задачу: найти скрытую информацию на удаленной машине. По условиям эксперимента доступ в интернет должен был быть полностью заблокирован, однако из-за неверных настроек ограничение не сработало. В результате ИИ получил выход во внешнюю сеть и воспринял реальные системы как часть симуляции.
  • Разные модели повели себя по-разному. Claude Opus 4.7 обнаружила совпадение названия вымышленной компании с существующим доменом, собрала учетные данные, проникла в базу с производственной информацией и продолжила действия даже после того, как выявила признаки того, что работает уже не в тестовой среде.
  • Claude Mythos 5 создала вредоносный аналог несуществующего Python‑пакета и опубликовала его в публичном репозитории PyPI: за час код скачали и запустили примерно на 15 реальных системах, что позволило похитить учетные данные. 
  • Внутренняя тестовая модель просканировала около 9 тыс. целей и скомпрометировала одно веб‑приложение, но, обнаружив признаки реальной среды, самостоятельно прекратила атаку.
  • В Anthropic подчеркнули, что модели не действовали самостоятельно и не преследовали собственных целей — они лишь выполняли поставленную задачу, ошибочно считая, что продолжают работать внутри учебной симуляции. При этом все испытания проводились без стандартных защитных ограничений. Как отмечают в компании, именно самая новая модель первой распознала, что взаимодействует с реальной средой, и остановила атаку, тогда как более ранние версии этого не сделали.
  • После инцидента Anthropic приостановила подобные испытания и уведомила организации, чьи системы оказались затронуты. По словам компании, пострадавшие узнали о произошедшем только после ее обращения.
  • Похожий случай произошел несколькими днями ранее в OpenAI. 22 июля во время аналогичных испытаний ИИ-агент компании атаковал платформу Hugging Face. В ходе тестов модели самостоятельно обнаружили ранее неизвестную уязвимость нулевого дня, а затем получили доступ к серверам с помощью похищенных учетных данных.

Россияне перестают доверять интернету: почти половина не чувствует себя в безопасности

Почти половина россиян (48%) не чувствуют себя в безопасности в интернете. Об этом свидетельствуют результаты совместного исследования медиахолдинга Rambler&Co и онлайн-кинотеатра Okko. Опрос проводился с 17 по 23 июля 2026 года, в нем приняли участие более 2 тыс. пользователей Сети.

  • Исследование также показало, что доверие к онлайн-среде продолжает снижаться. Более 55% участников признались, что за последние 5 лет стали меньше доверять людям в интернете. При этом почти каждый пятый респондент (19%) либо лично сталкивался с онлайн-преследованием, либо знает о подобных случаях среди родственников или знакомых.
  • Одновременно специалисты отмечают недостаточный уровень цифровой гигиены пользователей. Так, 44% опрошенных никогда не меняли настройки конфиденциальности своих аккаунтов, а более трети не используют даже базовые способы защиты — двухфакторную аутентификацию, уникальные пароли для разных сервисов или менеджеры паролей.
  • При этом немало пользователей продолжают оставлять личную информацию в открытом доступе. У 19% в Сети опубликован номер телефона, у 13% — личные фотографии, у 11% — место работы. Еще 11% сообщили, что в открытом доступе одновременно размещены все перечисленные сведения.
  • Самым серьезным последствием возможного взлома аккаунта россияне считают потерю доступа к своему профилю — такой вариант выбрали 41% участников исследования. Еще 31% больше всего опасаются кражи денежных средств, 23% — рассылки сообщений от их имени. Публикацию интимных фотографий и личной переписки назвали главной угрозой лишь 3% и 2% респондентов.

Власти Австралии подали в суд на Telegram из-за неудаления террористического контента

Офис комиссара по электронной безопасности Австралии (eSafety) подал иск в Федеральный суд страны против Telegram. Об этом сообщили в пресс-службе регулятора. Власти обвиняют мессенджер в систематическом несвоевременном удалении материалов, связанных с терроризмом и экстремизмом.

  • Проверка в отношении платформы продолжалась около года. По данным eSafety, Telegram не только долгое время оставлял в открытом доступе запрещенный контент, но и не блокировал каналы, группы и аккаунты, через которые он распространялся. Речь, в частности, идет о видеозаписях теракта в мечетях Крайстчерча в 2019 году, стрельбы в американском Буффало в 2022-м, а также роликах с казнями.
  • Как утверждает регулятор, с июля по октябрь 2025 года пользователи из Австралии направили 12 жалоб на подобные публикации. При этом 10 из них не были удалены в течение 7 дней после обращения. В отдельных случаях материалы оставались доступными почти 3 недели, несмотря на официальные уведомления, а распространявшие их каналы продолжали работать.
  • Комиссар по электронной безопасности Джули Инман Грант заявила, что подобный контент может способствовать радикализации пользователей и представляет угрозу для общества. В случае признания Telegram виновным компании может грозить штраф до 54,6 млн австралийских долларов (около 38 млн долларов США).

Как на иск отреагировали в Telegram

В Telegram обвинения не признали. Представитель компании заявил, что платформа активно выявляет и удаляет материалы террористического характера. По его словам, только в 2026 году были заблокированы тысячи экстремистских сообществ. Мессенджер намерен оспаривать требования австралийского регулятора в суде.