Безопасность · Тренд
Эксплуатация агентов поддержки клиентов ИИ (безопасность веб-агентов)
Бенчмарк WebDecept показывает, что текущие веб-агенты весьма уязвимы к обманчивым интерфейсам электронной коммерции, включая таргетированную рекламу, перенаправление домена и манипуляции с покупками.
Deceptive interface robustness may become a required safety evaluation for deployed web agents.
Связи
Связи · 3
Как этот узел связан с остальной картой и какие подтверждения стоят за связями.
Совместная оценка Сингапура и Кореи утечки данных агентов в неадверсарных сценариях непосредственно информирует о более широкой тенденции эксплуатации агентов поддержки клиентов ИИ.
+5 приростОба случая демонстрируют, что агенты ИИ могут быть использованы для выполнения несанкционированных действий, подчёркивая системные пробелы в безопасности агентов ИИ за пределами фильтрации контента.
+4 приростСовместная оценка Сингапура и Кореи неадверсарной утечки данных агентов непосредственно воплощает более широкую тенденцию рисков безопасности агентов ИИ в поддержке клиентов и корпоративной среде.
+4 приростИсточники сигнала
Источники сигнала
Датированные факты из первоисточников по этому направлению.
В июне 2025 года Институт безопасности ИИ США переименован в Центр стандартов и инноваций ИИ (CAISI) с разворотом к безопасности, стандартам и оценке моделей противников.
NIST →Anthropic активировала стандарт развёртывания и безопасности ASL-3 вместе с Claude Opus 4 22 мая 2025 — первое реальное срабатывание ступени ответственного масштабирования, нацеленное на блокировку биорисков.
Anthropic →Международная сеть институтов безопасности ИИ (создана в ноябре 2024) провела третье совместное тестирование, сфокусированное на агентных ИИ-системах по кибер- и мошенническим направлениям.
European Commission — AI Office →