Preprint
Aug 2026
MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning
Experimental results demonstrate that the proposed knowledge-guided hybrid reward framework significantly outperforms existing baselines in both reasoning accuracy and generalization capability, validating the effectiveness and applicability in safety-critical domains.
Haotian Wang, Lian Yan, Xingzhi Yao et al.
· 1 citation