Sebastian Raschka: Ako LLM-y kontrolujú intenzítu uvažovania — nízke, stredné a vysoké úsilie
Raschka publikóval rozsiahly technický priezkum o tom, ako moderné reasoning LLM-y implementujú viaceré úrovne výpočtového úsilia a ako sa tieto režimy trénujú pomocou RLVR a penalizácie dľžky tokenov.