Способности · Участник
Claude Fable 5 / Claude Mythos 5 / Claude Opus 4.8 (Anthropic)
Семейство моделей Claude Anthropic, включая возвращённый Fable 5 в линейке середины 2026 года.
Cyber safeguard details and jailbreak framework may set precedent for future model deployment governance.
Связи
Связи · 7
Как этот узел связан с остальной картой и какие подтверждения стоят за связями.
Anthropic разработала и развернула Fable 5 и Mythos 5 как передовые модели.
+4 приростCogManip оценивает передовые модели, включая GPT-5.4 и DeepSeek-V3.2; модели класса Claude входят в область применения таких бенчмарков манипуляций.
+3 приростДиректива правительства США об экспортном контроле приостановила доступ к Fable 5 и Mythos 5.
+3 приростФреймворк HackAgent применялся для оценки устойчивости к атакам Fable 5 и Opus 4.8.
+3 приростСистема оценки серьёзности взломов была предложена одновременно с повторным развёртыванием Fable 5 и его киберзащитой.
+3 приростUST применяет модели Claude в задачах физического ИИ, расширяя семейство моделей Anthropic в робототехнику и промышленность.
+3 приростOpus 5 расширяет флагманскую линейку Claude для агентного и coding-применения.
+3 приростИсточники сигнала
Источники сигнала
Датированные факты из первоисточников по этому направлению.
Длина программных задач, которые ИИ-агенты выполняют автономно с надёжностью 50%, удваивается примерно каждые 7 месяцев, а с 2024 года — ближе к ~3 месяцам.
METR →За год баллы выросли на 18.8, 48.9 и 67.3 пункта на MMMU, GPQA и SWE-bench; решаемость реальных программных задач подскочила с 4.4% до 71.7%.
Stanford HAI — AI Index 2025 →На SWE-bench Verified (500 реальных issue с GitHub) автономные кодовые агенты достигли ~80–86% к концу 2025 года против менее 50% в начале 2025.
Epoch AI →