Безопасность · Понятие
SafeGene: многоразовые адаптеры выравнивания безопасности для LLM
Многоразовый модуль адаптера безопасности, отделяющий возможности безопасности от обновлений тонкой настройки для конкретных задач, обеспечивающий восстановление безопасности между задачами без специфического ремонта модели.
Связи
Связи · 1
Как этот узел связан с остальной картой и какие подтверждения стоят за связями.
Источники сигнала
Источники сигнала
Датированные факты из первоисточников по этому направлению.
В июне 2025 года Институт безопасности ИИ США переименован в Центр стандартов и инноваций ИИ (CAISI) с разворотом к безопасности, стандартам и оценке моделей противников.
NIST →Anthropic активировала стандарт развёртывания и безопасности ASL-3 вместе с Claude Opus 4 22 мая 2025 — первое реальное срабатывание ступени ответственного масштабирования, нацеленное на блокировку биорисков.
Anthropic →Международная сеть институтов безопасности ИИ (создана в ноябре 2024) провела третье совместное тестирование, сфокусированное на агентных ИИ-системах по кибер- и мошенническим направлениям.
European Commission — AI Office →