Новости безопасности ИИ

Безопасность ИИ охватывает оценку моделей, red teaming, обязательства по безопасности и отчётность об инцидентах. Этот хаб освещает выводы институтов безопасности, корпоративные рамки безопасности и дискуссии о политике вокруг frontier-рисков.

Безопасность ИИ

Модуль безопасности NLTK был отключен с момента выпуска

Уровень pathsec, добавленный NLTK для устранения более ранней уязвимости, связанной с выполнением pickle, по умолчанию отключен — он предупреждает и затем продолжает работу, а для отдельной ошибки path вообще нет патча.

18 ч назад

Карточка репозитория GitHub для nltk/nltk с обложкой Natural Language Processing with Python в виде кита и данными о вкладе и звездах проекта.
ИИ-агенты

Система ограничений для агента, которая отвечает «Не знаю» как «Разрешить»

Omnigent — open-source harness с 9 600 звёздами, который запускает кодирующих агентов в песочнице, — за один раз получил четыре CVE. Самая показательная из них — механизм политик, чей парсер по умолчанию пропускает запросы.

19 ч назад

Карточка релиза GitHub для Omnigent v0.3.0 с перечислением новых интеграций agent harness и аватаром-рыбой в репозитории.
ИИ Google

Фигура Google «ниже 7%» — это не оценка Mantis

Google открыла исходный код используемого внутри harness для поиска багов, а число, которое цитируют как его точность, — это отраслевой базовый уровень, против которого выступает пост.

20 ч назад

Фирменная карточка Google Cloud с надписью «Getting started with Mantis» рядом с зеленой сферой из частиц.
Безопасность ИИ

Transformers записывает удалённый код на диск до запроса согласия

CERT/CC опубликовал VU#456290 1 сентября, через четыре недели после уведомления Hugging Face. Заявления от вендора нет, патча нет, а порядок операций не изменился в текущем релизе — на восемь версий выше указанного потолка.

1 дн назад

Карточка проекта Hugging Face Transformers: слово Transformers рядом с эмодзи-логотипом Hugging Face на белом фоне.
Авторское право и ИИ

Meta удалила страницу с дипфейком Киммела только после вопроса NPR

Синтетические поздневечерние монологи набирают шестизначные просмотры, а самое очевидное действие по пресечению нарушений в репортаже NPR было спровоцировано письмом журналиста, а не системой платформы.

4 дн назад

Кадр из синтетического видео с Jimmy Kimmel, читающим монолог, в красной рамке и с подписью «AI-GENERATED IMAGE».
ИИ-агенты

Платформа Agent от iFlytek не имеет исправленного релиза для нового CVE

В бюллетене сказано, что astron-agent уязвим вплоть до версии 1.1.1 и исправления нет; в отчёте об ошибке — что проблема устранена. Оба утверждения верны лишь отчасти, потому что новейший тег предшествует исправлению на восемнадцать дней.

5 дн назад

Баннер проекта Astron из репозитория iflytek/astron-agent с надписью «Accelerate Agentic AI, Strengthen Productivity, Inspire Imagination» рядом со звездчатым персонажем.
ИИ-агенты

CVSS 10.0 для argocd-mcp появился через 18 дней после исправления

Максимально возможная оценка серьезности — для режима транспортировки, который в собственных инструкциях проекта вообще не предлагают использовать; при этом сопровождающие уже опубликовали то же сообщение с той же оценкой 11 августа.

5 дн назад

Карточка security advisory GitHub для argoproj-labs/mcp-for-argocd с заголовком «Binding to an Unrestricted IP Address in argocd-mcp», помеченная как Critical и датированная 11 августа 2026 года.
ИИ-агенты

У побега из песочницы агентa Skyvern CVE появился через 53 дня после исправления

Уязвимость template injection в браузерном агенте Skyvern была закрыта 6 июля и получила номер 29 августа — при этом в уведомлении, где она названа, вообще нет машинно-читаемого диапазона версий.

5 дн назад

Карточка advisory VulnCheck для CVE-2026-82447 с заголовком «Skyvern before 1.0.45 Sandbox Escape via TextPromptBlock», где указаны severity HIGH и CVSS 8.7.
Безопасность ИИ

Восемь CVE для Langflow были опубликованы с собственной оценкой и без видимости для сканеров

IBM опубликовала восемь уязвимостей против собственного AI workflow builder менее чем за секунду: две из них критические, при этом исправления уже были выпущены несколькими неделями ранее как обычные bug fixes.

5 дн назад

Логотип и словесный знак Langflow на тёмном фиолетово-красном градиенте
Безопасность ИИ

Claude Code исправил пять побегов из песочницы, оформив их как обычные пункты changelog

В релизе v2.1.251 перечислены гонка symlink, из-за которой файловые инструменты могли работать вне разрешённых путей, path traversal в плагинах и настройки, отключающие аудит-логирование. Без advisoory.

5 дн назад

Карточка релиза GitHub для Claude Code v2.1.251 с заметками о релизе рядом с логотипом Anthropic
Безопасность ИИ

Claude Code Загружал ваш prod.env — исправлено одной строкой в changelog

Версия 2.1.248, выпущенная 27 августа в 22:12 UTC, прекращает отправку с машины файлов с учетными данными при /ultrareview и локально инициированных облачных сессиях. Без advisory, без GHSA, без диапазона затронутых версий, без даты появления.

6 дн назад

Карточка релиза GitHub для Claude Code v2.1.248 с записью changelog о добавлении флага --restricted
ИИ для производства

Две неаутентифицированные цепочки root на Unitree G1 не требуют сопряжения

Раскрытие UniBLEed было опубликовано 27 августа в 16:13 UTC, а два CVE — четырьмя часами позже. Одна цепочка работает через неаутентифицированный мост WebRTC-to-DDS на TCP 9991; другая — по Bluetooth вообще без сопряжения.

6 дн назад

Схема из раскрытия UniBLEed с заголовком 'Unauthenticated Root RCE on Any Unitree G1 Humanoid Robot Within Bluetooth Range', показывающая ноутбук и телефон со стрелками к нескольким гуманоидным роботам
Безопасность ИИ

Неаутентифицированная RCE в LiteLLM была исправлена за 140 дней до CVE

Шесть CVE против Agno, LiteLLM, gpt-researcher, crewai-tools и PentestGPT были поданы 27 августа с интервалом 0,74 секунды. У всех пустой блок CVSS — так что неаутентифицированная RCE и утекший ключ телеметрии в базе оказываются равны.

6 дн назад

Карточка репозитория GitHub для BerriAI/litellm с описанием проекта и числом участников, звезд и форков
Безопасность ИИ

Самоэволюционирующие кодовые агенты воспроизводят вредоносный код из общих навыков

На шести моделях и 153 задачах уровень самозаражения составляет от 20,3% до 41,8%. В публикации будут цитировать показатель, измеренный, когда полезная нагрузка подогнана под семейство задач.

27 авг. 2026 г.

Карточка статьи alphaXiv на розовом фоне с заголовком 'EVOMAL: Self-Poisoning in Self-Evolving Coding Agents' и списком авторов ниже.
Безопасность ИИ

GitLab исправила сбой Claude Agent в командах, сама же и оценила серьёзность

CVE-2026-18252 — это включение ненадежного пользовательского ввода: агент считывал конфигурацию из места, контролируемого пользователем. Полные детали останутся под эмбарго примерно на 30 дней.

27 авг. 2026 г.

Логотип GitLab рядом с оранжевой фигуркой тануки на белом фоне.