Отравленные навыки агентов направляли 81% покупательских решений
Новая работа описывает сторонние навыки, которые идеально выполняют заявленную задачу, но смещают выбор агента — и тестированные сканеры этого не выявили.
18 ч назад

Искусственный интеллект — профессиональное освещение
Безопасность ИИ охватывает оценку моделей, red teaming, обязательства по безопасности и отчётность об инцидентах. Этот хаб освещает выводы институтов безопасности, корпоративные рамки безопасности и дискуссии о политике вокруг frontier-рисков.
Новая работа описывает сторонние навыки, которые идеально выполняют заявленную задачу, но смещают выбор агента — и тестированные сканеры этого не выявили.
18 ч назад

Уровень pathsec, добавленный NLTK для устранения более ранней уязвимости, связанной с выполнением pickle, по умолчанию отключен — он предупреждает и затем продолжает работу, а для отдельной ошибки path вообще нет патча.
18 ч назад

Omnigent — open-source harness с 9 600 звёздами, который запускает кодирующих агентов в песочнице, — за один раз получил четыре CVE. Самая показательная из них — механизм политик, чей парсер по умолчанию пропускает запросы.
19 ч назад

Google открыла исходный код используемого внутри harness для поиска багов, а число, которое цитируют как его точность, — это отраслевой базовый уровень, против которого выступает пост.
20 ч назад

Раунд Series B компании по ИИ-безопасности под руководством Delta-v Capital при участии M12 от Microsoft и Booz Allen Ventures не указывает цифру, которую все публикации выводили арифметически.
21 ч назад

В анонсе Google говорится о существенном улучшении; в model card, которая допускает модель к релизу, сказано обратное, а стартовая цена 1 января удвоится.
1 дн назад

CERT/CC опубликовал VU#456290 1 сентября, через четыре недели после уведомления Hugging Face. Заявления от вендора нет, патча нет, а порядок операций не изменился в текущем релизе — на восемь версий выше указанного потолка.
1 дн назад

Enterprise Frontier Safeguards подается как запуск продукта. Но хронология говорит об обратном: Anthropic отказалась от нулевого срока хранения в Fable 5, ввела 30-дневное окно, а банки-CISO выступили против.
1 дн назад

Первая модель OpenAI, достигшая критического порога кибербезопасности, отклоняет 91,5% запрещённых киберзапросов. Остальное — это и есть новость, а каждая цифра в ней — собственная оценка OpenAI.
2 дн назад

Принятая на EMNLP 2026 Findings работа утверждает, что одно число — показатель успешности атаки в настройках по умолчанию — почти ничего не говорит о развернутой системе.
2 дн назад

CVE-2026-82217 позволяла модели выбрать любой путь к файлу, а Agent Mode записывал его без диалога подтверждения. Коммит, который закрыл проблему, называется «add Memory prompt capability».
2 дн назад

Разбор инцидента с выходом Claude в живой интернет — это прежде всего сигнал о качестве сред обучения и о переводе примерно 150 продуктовых инженеров на задачи безопасности.
3 дн назад

Документированный способ написания промпта компилирует текст, переданный атакующим, как код — и единственное исправление доступно лишь в крупном релизе, начинающемся с breaking change.
3 дн назад

В v0.11.2 говорится, что часть предупреждений может быть отложена, чтобы дать администраторам время на патч, — а значит, и время атакующим изучить различия между релизами.
3 дн назад

Синтетические поздневечерние монологи набирают шестизначные просмотры, а самое очевидное действие по пресечению нарушений в репортаже NPR было спровоцировано письмом журналиста, а не системой платформы.
4 дн назад

В бюллетене сказано, что astron-agent уязвим вплоть до версии 1.1.1 и исправления нет; в отчёте об ошибке — что проблема устранена. Оба утверждения верны лишь отчасти, потому что новейший тег предшествует исправлению на восемнадцать дней.
5 дн назад

Максимально возможная оценка серьезности — для режима транспортировки, который в собственных инструкциях проекта вообще не предлагают использовать; при этом сопровождающие уже опубликовали то же сообщение с той же оценкой 11 августа.
5 дн назад

Уязвимость template injection в браузерном агенте Skyvern была закрыта 6 июля и получила номер 29 августа — при этом в уведомлении, где она названа, вообще нет машинно-читаемого диапазона версий.
5 дн назад

IBM опубликовала восемь уязвимостей против собственного AI workflow builder менее чем за секунду: две из них критические, при этом исправления уже были выпущены несколькими неделями ранее как обычные bug fixes.
5 дн назад

Один пакет исследований был опубликован в отношении Qwen-Agent, Portkey, Quivr, VoltAgent и gpt-crawler. У семи из девяти не указана ни одна фиксированная версия.
5 дн назад

В релизе rust-v0.151.0 пять пунктов по правам доступа и песочнице вынесены в Bug Fixes, включая устаревшие классификации, которые продолжали разрешать действия после изменения прав.
5 дн назад

В релизе v2.1.251 перечислены гонка symlink, из-за которой файловые инструменты могли работать вне разрешённых путей, path traversal в плагинах и настройки, отключающие аудит-логирование. Без advisoory.
5 дн назад

Версия 2.1.248, выпущенная 27 августа в 22:12 UTC, прекращает отправку с машины файлов с учетными данными при /ultrareview и локально инициированных облачных сессиях. Без advisory, без GHSA, без диапазона затронутых версий, без даты появления.
6 дн назад

Раскрытие UniBLEed было опубликовано 27 августа в 16:13 UTC, а два CVE — четырьмя часами позже. Одна цепочка работает через неаутентифицированный мост WebRTC-to-DDS на TCP 9991; другая — по Bluetooth вообще без сопряжения.
6 дн назад

Шесть CVE против Agno, LiteLLM, gpt-researcher, crewai-tools и PentestGPT были поданы 27 августа с интервалом 0,74 секунды. У всех пустой блок CVSS — так что неаутентифицированная RCE и утекший ключ телеметрии в базе оказываются равны.
6 дн назад

Блок MCP охватывает CVE-2026-81091 по 81102 — Dropbox, ByteDance, Airtable, Telnyx, Timescale, Apify, Harvard, mcp-go, mcp-use, mcp-router, rails-mcp-server. Все исправления были влиты заранее, в одном случае — за 161 день.
6 дн назад

На шести моделях и 153 задачах уровень самозаражения составляет от 20,3% до 41,8%. В публикации будут цитировать показатель, измеренный, когда полезная нагрузка подогнана под семейство задач.
27 авг. 2026 г.

Учётная запись мейнтейнера была скомпрометирована в июне. Предупреждение попало в базу GitHub 26 августа, указывает на версию 0.6.4, а публикация в PyPI приостановлена.
27 авг. 2026 г.

CVE-2026-18252 — это включение ненадежного пользовательского ввода: агент считывал конфигурацию из места, контролируемого пользователем. Полные детали останутся под эмбарго примерно на 30 дней.
27 авг. 2026 г.

Утешает то, что модель никогда не видит ваш пароль. Ей это и не нужно — аутентифицированная сессия сохраняется на серверах OpenAI для будущих задач.
26 авг. 2026 г.
