Способности · Участник
Anthropic
Передовая ИИ-компания с обновлениями Claude, корпоративными партнёрствами и кадровыми решениями по глобальной политике.
Industry-wide jailbreak severity framework with Amazon, Microsoft, Google could become a de facto standard.
Связи
Связи · 12
Как этот узел связан с остальной картой и какие подтверждения стоят за связями.
Anthropic представила Claude Sonnet 5, обеспечивающую производительность переднего края в области программирования, агентов и профессиональной работы.
+8 приростAnthropic предложила отраслевую систему оценки серьёзности взломов совместно с Amazon, Microsoft, Google и партнёрами Glasswing.
+8 приростNewsroom Anthropic представляет Claude Opus 5 для долгоживущих агентов и pro-work.
+8 приростAnthropic запустила Claude Science как настраиваемую рабочую среду ИИ для учёных.
+7 приростКейс Anthropic описывает внедрение Claude в physical AI силами UST.
+7 приростВ продуктовой линейке Anthropic есть Claude for Teachers.
+7 приростAnthropic разработала инструмент «линза Якобиана», обеспечивающий наиболее чёткое на сегодняшний день представление о том, что происходит внутри LLM.
+5 приростAnthropic разработала и развернула Fable 5 и Mythos 5 как передовые модели.
+4 приростAnthropic открыл офис в Сеуле и объявил о новых партнёрствах в корейской экосистеме ИИ.
+4 приростClaude-Opus-4.6 был одной из четырёх фронтирных моделей, протестированных в исследовании саботажа при написании кода ИИ.
+3 приростФронтирные модели, включая модели Anthropic, были оценены в бенчмарке CogManip на предмет риска манипуляций.
+3 приростNewsroom Anthropic отмечает внедрение Claude в physical AI вместе с UST.
+3 приростИсточники сигнала
Источники сигнала
Датированные факты из первоисточников по этому направлению.
Длина программных задач, которые ИИ-агенты выполняют автономно с надёжностью 50%, удваивается примерно каждые 7 месяцев, а с 2024 года — ближе к ~3 месяцам.
METR →За год баллы выросли на 18.8, 48.9 и 67.3 пункта на MMMU, GPQA и SWE-bench; решаемость реальных программных задач подскочила с 4.4% до 71.7%.
Stanford HAI — AI Index 2025 →На SWE-bench Verified (500 реальных issue с GitHub) автономные кодовые агенты достигли ~80–86% к концу 2025 года против менее 50% в начале 2025.
Epoch AI →