
Менші моделі проти гігантів: як MIT навчило LLM думати розумніше – і платити менше
MIT представило спосіб, що навчає LLM самостійно дозувати «обчислювальний час» залежно від труднощі запиту. Завдяки каліброваним PRM моделі досягають зіставної точності, витрачаючи до половини ресурсів – і це відкриває шлях для менших моделей.










