Безопасность · Понятие
ECAISA: эпистемический кодекс AI safety и alignment
Восьмипринципный эпистемический кодекс и лестница раскрытия: у safety-research иные нормы, чем у capability science.
Could seed journal and lab standards for preregistration and third-party audit of alignment claims.
Связи
Связи · 6
Как этот узел связан с остальной картой и какие подтверждения стоят за связями.
ECAISA предлагает явные эпистемические нормы, скоринг и практики раскрытия для evaluation в safety/alignment.
+5 приростECAISA предлагает эпистемические нормы и стандарты независимой верификации именно для качества research по safety/alignment.
+3 приростСтатья ECAISA входит в дневной arXiv-кластер AI safety.
+3 приростECAISA требует независимой верификации и worst-case эпистемических норм, усиливая науку оценки для alignment.
+3 приростТребования ECAISA к независимой верификации и worst-case эпистемике форсировали бы более раннее погашение latent safety/security долгов.
+3 приростСкрытые вычисления через filler-токены показывают, почему safety-исследованиям недостаточно average-case метрик и поверхностного CoT.
+3 приростИсточники сигнала
Источники сигнала
Датированные факты из первоисточников по этому направлению.
В июне 2025 года Институт безопасности ИИ США переименован в Центр стандартов и инноваций ИИ (CAISI) с разворотом к безопасности, стандартам и оценке моделей противников.
NIST →Anthropic активировала стандарт развёртывания и безопасности ASL-3 вместе с Claude Opus 4 22 мая 2025 — первое реальное срабатывание ступени ответственного масштабирования, нацеленное на блокировку биорисков.
Anthropic →Международная сеть институтов безопасности ИИ (создана в ноябре 2024) провела третье совместное тестирование, сфокусированное на агентных ИИ-системах по кибер- и мошенническим направлениям.
European Commission — AI Office →