← К карте трендов

Способности · Тренд

Рассуждения LLM как сопоставление с образцом

Тест DeFAb показывает, что передовые LLM достигают лишь 65% точности в задачах опровержимой абдукции, решаемых основанными на правилах решателями менее чем за 50 микросекунд, подтверждая ограничения рассуждений.

Сила тренда 6/10
Импульс +6/кв
Уверенность средняя
Статус новое
Горизонт прогноза

Shared human-LLM reasoning failure modes challenge assumptions about abstract world models in both AI and cognitive science.

Связи

Связи · 2

Как этот узел связан с остальной картой и какие подтверждения стоят за связями.

Источники сигнала

Источники сигнала

Датированные факты из первоисточников по этому направлению.