Мейнстрим растит модели масштабом. Мы меряем ортогональное: можно ли растить компетентность маленькой модели без роста весов — через верифицированную память и локальное обучение, с жёстким потолком ресурсов (бытовая GPU 12 GB). Читать далее
Можно ли научить маленькую LLM учиться без роста весов? Замеры, баги и честная статистика
Это краткое изложение. Полный текст материала доступен на сайте источника.