Популярно

Zeguan Wu

1 статей · 5 соавторов · последняя: 2026-01-11

Почему нейросети похожи на чёрные дыры: урок «лысых» моделей

Внутри языковых моделей, таких как LLaMA, скрыты запутанные узоры, сила которых зависит от способа обучения. Но для внешнего наблюдателя модель всегда выдаёт один и тот же результат — совсем как чёрная дыра, которая «забывает» все детали попавшей материи. Это объясняет, почему простые методы дообуче
arXiv:2601.06788 · 2026-01-11