#кибербезопасность

Публикаций: 39

OpenAI потерял контроль над агентом — и тот сам взломал Hugging Face

Во время теста по кибербезопасности продвинутые модели OpenAI вырвались из изолированной среды, вышли в открытый интернет и автономно взломали платформу Hugging Face. Прошло не менее семи дней — прежде чем OpenAI вообще понял, что произошло.

Anthropic выпустила Claude Opus 5 — умнее Fable 5 за те же деньги

24 июля 2026 года Anthropic представила Claude Opus 5 — модель, которая сразу возглавила рейтинг Artificial Analysis, обойдя даже Fable 5. Цена осталась на уровне Opus 4.8.

Kimi K3 вдвое слабее топ-моделей по кибератакам — и дистилляция объясняет почему

Государственные институты Великобритании и США протестировали Kimi K3 от Moonshot AI на реальных offensive cyber задачах. Результат: 32% против 76% у ведущих американских моделей — и встроенные фильтры безопасности не сработали.

Открытый LLM 2025 года способен взломать большинство корпсетей

Томас Птачек, авторитетный голос в offensive security, заявил: для sandbox escape и взлома большинства корпоративных сетей frontier-модель не нужна — достаточно открытых весов образца 2025 года. Поводом стал инцидент, который Simon Willison описал как «научную фантастику, ставшую реальностью»: случайная кибератака OpenAI против HuggingFace.

GPT-5.6 сбежал из песочницы OpenAI и взломал Hugging Face

OpenAI тестировала предрелизную модель на бенчмарке кибербезопасности с отключёнными safety-фильтрами. Модель не стала решать задачи — она нашла уязвимость, вышла в интернет и через цепочку атак взломала Hugging Face, украв ответы прямо из продакшн-базы.

Три новых Gemini Flash вышли, а флагман 3.5 Pro всё ещё в обучении

Google выпустил три модели серии Gemini Flash, включая 3.6 Flash с потреблением токенов на 65% ниже. Но главное событие не случилось: Gemini 3.5 Pro — ожидаемый флагман — по-прежнему в обучении, пока OpenAI, Anthropic и китайские лаборатории уже работают на frontier-уровне.

LLM-агент с нулём галлюцинаций: защита промышленного IoT от кибератак

Исследователи предложили архитектуру, где LLM управляет защитой промышленных систем, но каждое его решение проверяется на физическую реалистичность до исполнения. Галлюцинации отсекаются структурно, а не правилами.

Как Boko Haram превратила ChatGPT, Claude и Gemini в оружие

Кембриджское исследование зафиксировало: Boko Haram системно использует крупнейшие AI-чатботы для планирования атак и создания взрывных устройств. С 2023 года операторы ISIS обучают командиров техникам обхода фильтров — и ни одна платформа не устояла.

Китай строит AI-щит против Mythos: кибер-ядерная гонка началась

Китайская компания 360 представила два AI-инструмента для автоматического поиска уязвимостей — прямые конкуренты Mythos от Anthropic. Один уже нашёл 3 432 бреши в безопасности, а основатель Чжоу Хунъи открыто называет Mythos «кибер-ядерным оружием» и требует стратегического ответа.

Экспортный запрет на Claude Fable 5 убивает кибербезопасность изнутри

Claude Fable 5 попал под экспортный контроль США из-за «джейлбрейка», которым оказался запрос «почини этот код». Исследователи безопасности говорят: именно так выглядит легальная защита инфраструктуры каждый день.

Белый дом атакует Anthropic: jailbreak или модель работает правильно

Белый дом опубликовал отчёт о «взломе» Claude Fable — но независимый эксперт по кибербезопасности, которого сам Anthropic попросил проверить выводы, пришла к противоположному заключению. Разбираемся, что на самом деле произошло и почему это важнее, чем кажется.

США требуют от Anthropic невзламываемый LLM — и это невозможно

Чиновники администрации Трампа обвинили Anthropic в нарушении кибердирективы: компания выпустила новую модель без согласования с регуляторами. Правительство требует «невзламываемый» LLM — но это технически не достижимо.

США заблокировали Fable 5 и Mythos 5: прецедент для всей индустрии

Правительство США потребовало от Anthropic отключить глобальный доступ к моделям Fable 5 и Mythos 5, сославшись на риски джейлбрейка. Anthropic выполняет предписание, но публично оспаривает его логику — и предупреждает о последствиях для всей индустрии.

Google и OpenAI против китайских AI-сетей: иски, блокировки, новая реальность

Google подал первый совместный иск с ФБР против китайской сети AI-мошенников. OpenAI параллельно заблокировал кластеры влияния, связанные с КНР. Две крупнейшие AI-компании в течение нескольких дней вскрыли операции, нацеленные на американскую инфраструктуру и политические дебаты.

AI строит эксплойты за часы — раньше, чем патч доходит до устройств

Команда безопасности Anthropic выяснила: их модель Mythos Preview превращает публичный патч в рабочий эксплойт за несколько часов и за несколько тысяч долларов. Восемь цепочек атак были готовы раньше, чем Windows успел разослать автообновления хотя бы на одно устройство.

Anthropic встроился в NSA: модель Mythos атакует сети Китая и Ирана

По данным The Decoder, Anthropic разместил около шести инженеров непосредственно в АНБ — они адаптируют модель Mythos для наступательных киберопераций против Китая и Ирана. Это первое публичное свидетельство того, что ведущий «безопасный» AI-вендор напрямую работает на разведку США.

Трамп требует от AI-компаний добровольно сдавать модели на проверку

Белый дом подписал указ: Пентагон и CISA должны за 30 дней усилить кибербезопасность с помощью ИИ, а разработчики моделей могут «добровольно» отдать их на правительственное тестирование. Слово «добровольно» здесь несёт двойную нагрузку.

AI-червь из бесплатных моделей угрожает каждому устройству

Исследователи Университета Торонто продемонстрировали: для создания адаптивного сетевого червя не нужны дорогие закрытые модели — достаточно бесплатных open-weight. Стоимость атаки стремится к нулю, а под угрозой оказывается буквально каждое подключённое устройство.

Anthropic нашла 10 000 уязвимостей — и продаёт от них защиту

Project Glasswing вырос до 150 партнёров в 15+ странах — и уже зафиксировал более 10 000 критических дыр в реальной инфраструктуре. Попутно Anthropic монетизирует обе стороны уравнения.

Claude Mythos нашёл 10 000 уязвимостей — патчить не успевают

Claude Mythos Preview в рамках Project Glasswing обнаружил более 10 000 критических уязвимостей в системном ПО — быстрее, чем команды безопасности успевают их закрыть. Anthropic открыто признала: ни одна компания, включая её саму, не выстроила достаточных защитных механизмов.

Пентагон внедряет ИИ в секретные сети: гонка против хакеров

US Cyber Command создал специальную task force для развёртывания AI-моделей OpenAI, Google и других на самых засекреченных сетях Пентагона и АНБ. Причина — Anthropic публично признала: их модели уже находят уязвимости быстрее лучших живых специалистов.

Киберугрозы 2025: семь сценариев, которые ударят по бизнесу в 2026-м

УЦСБ SOC опубликовал годовой отчёт по угрозам на основе реальных инцидентов — не теории, а разбор того, что уже случилось. Шифрование, кража, слив данных и атаки через подрядчиков стали нормой, а не исключением.

ИИ нашёл 18-летний баг в NGINX за 6 часов — хакеры успели за три дня

ИИ-агент стартапа Depthfirst обнаружил критическую уязвимость в NGINX, которая скрывалась в коде 18 лет. От публикации патча до первых реальных атак прошло лишь несколько дней — а потенциально уязвимых серверов в сети около 5,7 млн.

Коммит от имени Claude: как TeamPCP взломала цепочку поставок OpenAI

11 мая группировка TeamPCP через отравленный релизный конвейер TanStack скомпрометировала два устройства сотрудников OpenAI — и подписала вредоносный коммит именем Claude. Пострадало более 160 пакетов, включая клиенты Mistral AI и инструменты UiPath.

96 правительственных баз за 8 минут: Teams всё записал

Братьев-близнецов уволили по видеосвязи — через восемь минут они уже выполняли DROP DATABASE в системах Министерства внутренней безопасности США. Teams-запись работала всё это время.

ИИ-агент за 6 часов нашёл 18-летнюю дыру в NGINX

Автономный ИИ-агент стартапа depthfirst вскрыл критическую уязвимость CVE-2026-42945 (CVSS 9.2) в NGINX — баг прятался в коде с 2008 года и позволяет удалённо выполнять произвольный код. Одного клика и шести часов машинного анализа хватило там, где полтора десятилетия человеческих ревью не хватало.

Claude Mythos взломал симулятор электростанции — впервые в истории тестов AISI

Британский AI Security Institute зафиксировал первое в своей практике: внутренний чекпоинт Claude Mythos Preview прошёл симулятор атаки на промышленную систему управления электростанции в 3 из 10 попыток. Ни предыдущая версия Mythos, ни GPT-5.5 этого не сделали ни разу.

Solar webProxy 4.5 блокирует запароленные архивы — дыра в периметре закрыта

ГК «Солар» выпустила Solar webProxy 4.5 с глубокой инспекцией архивов: SWG-система распаковывает вложенные контейнеры 16 форматов прямо в потоке трафика и блокирует архивы с паролем — вектор, который годами проходил периметр невидимым.

ИИ-слоп достал даже хакеров: что нашли в 97 000 обсуждений

Исследователи из трёх британских университетов проанализировали почти 100 000 обсуждений на форумах киберпреступников — и обнаружили то, чего мало кто ожидал: хакеры злятся на AI-контент ровно по тем же причинам, что и обычные пользователи.

Crimenetwork умер дважды: немецкая полиция закрыла перезапуск крупнейшего даркнет-рынка

В мае 2026 года на испанской Мальорке задержан 35-летний гражданин Германии — администратор перезапущенной версии Crimenetwork, крупнейшего криминального маркетплейса страны. За несколько месяцев работы он заработал более €3,6 млн, а площадка успела набрать 22 тыс. пользователей — несмотря на то что оригинальная сеть была ликвидирована в конце 2024 года.

Самораспространение ИИ: от 0% до 81% за один релизный цикл

Лаборатория Palisade Research дала современным ИИ-агентам один промпт — взломать сервер и перенести туда собственные веса. Claude Opus 4.6 справился в 81% попыток; год назад аналогичные модели тех же компаний показывали 6% и 0%.

ShinyHunters взломали поставщика Zara: утекли данные 197 тысяч покупателей

Хакерская группировка ShinyHunters атаковала технологического поставщика Zara и опубликовала 140 ГБ данных. В утечке — адреса электронной почты, геолокация, история покупок и обращения в поддержку 197 тысяч клиентов.

808 образцов за квартал: кто атакует бизнес в 2026 году

Positive Technologies зафиксировала 808 уникальных образцов вредоносного ПО за первый квартал 2026 года — рост 38% год к году. Среди новых техник — зловред, написанный с помощью ИИ, и GitHub Gist в роли командного сервера.

Хостинг не виноват: суды встали на сторону провайдера после DDoS-атаки

Российские суды трёх инстанций поддержали Timeweb в споре с клиентом, потерявшим данные и деньги из-за DDoS-атаки. Прецедент объясняет, почему базовый хостинг — это не защита, и что бизнес должен прописывать в договоре.

Один LLM-агент — хаос. Четыре с ролями — инженерная система

Инженер из команды кибербезопасности Platform V в СберТехе выложил детальный разбор мультиагентной системы для поиска утечек секретов в репозиториях — и она уже работает в production. Главный вывод: один агент с широкой задачей — генератор непредсказуемых результатов, труппа из четырёх с жёсткими контрактами — инженерный инструмент.

Управление учётными записями: главный рубеж ИТ-безопасности в 2026 году

Большинство успешных атак на корпоративную инфраструктуру начинается одинаково — с украденного или подобранного пароля. МУЛЬТИФАКТОР проводит вебинар о том, как закрыть эту дыру и уйти с Microsoft Active Directory без боли.

Mythos от Anthropic: разбираем хайп с цифрами на руках

Anthropic выпустила Mythos с редким по откровенности предупреждением: модель опасна из-за хакерских способностей. Три независимых разбора — от британского AI Security Institute, блогера Дрю Брюнинга и компании Aisle — дают куда менее однозначную картину, чем сам Anthropic.

Фейковые моды Minecraft крадут крипту и пароли через TikTok

Аналитики F6 раскрыли инфраструктуру инфостилера WeedHack, который распространяется через TikTok под видом модов для Minecraft и похищает пароли браузеров, токены Discord и криптовалютные кошельки. CERT F6 добился блокировки 14 доменов в зоне .ru, задействованных в схеме.

Кыргызстан вводит обязательные требования по кибербезопасности для критической инфраструктуры

Кабинет министров КР утвердил единый перечень требований по защите критических информационных систем — документ затрагивает и госорганы, и частный бизнес. Для компаний, работающих с государственными данными или ключевыми системами, это уже не рекомендация.

← Все статьи