18 авг. 2026 г.Ежедневный ИИ-брифинг
AI News Today.

Искусственный интеллект — профессиональное освещение

#interpretability

Безопасность ИИ

Опечатки и перефразирование накапливаются: двое исследователей направляли frontier-модели невидимыми подсказками

По отдельности бессмысленные варианты промпта складываются почти аддитивно. Добавьте достаточно таких элементов — и вы управляете ответом; тот же промпт работает и на моделях, под которые его никогда не настраивали.

2 ч назад

Карточка предпросмотра alphaXiv с названием статьи 'Model Hypnosis: Strong control of AI via additive subliminal effects' by Enric Boix-Adsera and Benedict Tessler, рядом с первой страницей статьи