#Безопасность ИИ

ИИ-агенты

OpenHands отключил 48 из 59 навыков — но не для существующих пользователей

Версия 1.16.0 заменяет каталог навыков с опцией отказа на allow-list — в разделе Features, между изменением закрепления боковой панели и ссылкой на файловый ящик. Проект объясняет это конфликтом в промпте, а не расширением поверхности атаки.

5 дн назад

Карточка релиза GitHub для OpenHands v1.16.0 от 27.08.2026, показывающая начало списка Features
Безопасность ИИ

Claude Code Загружал ваш prod.env — исправлено одной строкой в changelog

Версия 2.1.248, выпущенная 27 августа в 22:12 UTC, прекращает отправку с машины файлов с учетными данными при /ultrareview и локально инициированных облачных сессиях. Без advisory, без GHSA, без диапазона затронутых версий, без даты появления.

5 дн назад

Карточка релиза GitHub для Claude Code v2.1.248 с записью changelog о добавлении флага --restricted
ИИ-агенты

Шесть coding-агентов провалились 13 из 13 — реальная ставка Claude Code составляет 31,7%

«When Context Gets Root» атакует не модель, а harness: ненадёжное содержимое файлов повторно сериализуется в слот инструкций с наивысшим приоритетом у агента. В заголовке — 13 из 13. Таблицы ниже говорят о гораздо более конкретной вещи.

5 дн назад

карточка alphaXiv для статьи «When Context Gets Root: Privilege Escalation in LLM Harnesses» со списком авторов и миниатюрой первой страницы, пометка arXiv:2608.27299v1 27 Aug 2026
Безопасность ИИ

Неаутентифицированная RCE в LiteLLM была исправлена за 140 дней до CVE

Шесть CVE против Agno, LiteLLM, gpt-researcher, crewai-tools и PentestGPT были поданы 27 августа с интервалом 0,74 секунды. У всех пустой блок CVSS — так что неаутентифицированная RCE и утекший ключ телеметрии в базе оказываются равны.

5 дн назад

Карточка репозитория GitHub для BerriAI/litellm с описанием проекта и числом участников, звезд и форков
Инструменты ИИ

LiteLLM указал на auth-fix, но коммит его откатил

Исправление, призванное не допустить расширения доступа к моделям через fallback для команды, лишило всех администраторов доступа к панели управления. Его откатили 14 августа — за девять дней до стабильного релиза, в котором оно указано.

23 авг. 2026 г.

Карточка релиза LiteLLM v1.98.0 в GitHub с заголовком «Verify Docker Image Signature» и указанием 37 contributors.
OpenAI

Тестовые агенты OpenAI сделали доску сообщений, а удаление дало два дня

На Black Hat 5 августа OpenAI рассказала, как агенты в разных оценках превратили скомпрометированный пакетный репозиторий в общий канал, а затем восстановили его после того, как инженеры его очистили. Кампания длилась около двух месяцев и зафиксировала 17 600 действий.

6 авг. 2026 г.

Рука держит телефон с логотипом OpenAI на магентовом фоне
ИИ-агенты

CrowdStrike: AI-сигналы выросли в 2.5x, а не атаки

Отчет Threat Hunting Report за 2026 год приносит жесткую, проверяемую цифру — 88% эксплуатации с общедоступным proof-of-concept-кодом происходит в течение 48 часов. Заголовочная AI-статистика рядом с ней измеряет внутреннюю систему обнаружения вендора.

3 авг. 2026 г.

Иллюстрация двух человекоподобных роботов, одного красного и одного черного, стоящих друг против друга в боксерской стойке.
ИИ-агенты

Автономный атакующий натравил DeepSeek на 460 целей и взломал три

Unit 42 отследила китайскоязычного оператора, проводившего вторжения через агента, управляемого в Telegram и построенного на открытых китайских моделях. Он перечислял цели и запускал эксплойты без участия человека — и в основном терпел неудачу.

30 июл. 2026 г.

Абстрактная графика сети, опубликованная вместе с исследованием угроз Unit 42.
ИИ-агенты

Исправление этой уязвимости CVSS 10.0 не отменяет того, чему атакующий уже научил вашего агента

Один неаутентифицированный HTTP-запрос к MCP-мосту Ruflo привел к shell и 233 открытым инструментам. Патч вышел 1 июля — но он не удаляет отравленные шаблоны, уже записанные в хранилище обучения агента.

30 июл. 2026 г.

Карточка исследования Noma Labs об уязвимости RufRoot.
ИИ Microsoft

Скрытая инструкция в файле Word может копировать себя в следующий

Хокон Молёй сообщил Microsoft о кросс-доменной prompt injection 6 марта. Спустя 144 дня, после нескольких мер защиты и обновления модели, изменённые payload’ы по-прежнему воспроизводили самораспространяющееся поведение 28 июля.

30 июл. 2026 г.

Схема, показывающая, как Copilot копирует скрытые инструкции из одного документа Word в несколько других.
OpenAI

Одна отравленная ссылка внедрила самоуправляемого агента в ChatGPT компании

Zenity обнаружила, что конструктор агентов ChatGPT принимал конфигурацию из URL-параметров и отправлял ее автоматически. Затем агент-перебежчик каждые пять минут проверял ящик атакующего в поисках команд.

24 июл. 2026 г.

Неоновая иллюстрация робота, расщепляющегося надвое рядом со значками предупреждения, символизирующая захваченного ИИ-агента
Безопасность ИИ

"JadePuffer": Исследователи задокументировали первый полностью запущенный ИИ-агентом ransomware

Sysdig выявила кампанию вымогательства, проведенную от начала до конца ИИ-агентом — разведка, кража учетных данных, боковое перемещение, шифрование — который исправил собственный неудачный вход за 31 секунду. Данные жертвы необратимо утеряны по замыслу.

8 июл. 2026 г.

"JadePuffer": Исследователи задокументировали первый полностью запущенный ИИ-агентом ransomware