#интерпретируемость
-
Канонический базис: как повернуть LLM, чтобы заглянуть ей внутрь
Исследователь предложил обратимое преобразование координат трансформера, которое не меняет его поведения, но делает каждую скрытую ось измеримой и управляемой по отдельности.
-
Латентные рассуждения ИИ оказались понятнее, чем считалось
Исследователи из COLM 2026 показали, что модели со скрытыми рассуждениями либо почти не пользуются ими, либо прячут внутри вполне читаемые математические шаги.