SummaryAI generated
2026 年 9 月 6 日,arXiv cs.CV 发表研究论文《Separating Capability from Confidence: Grounded Dual-State Calibration for GRPO-Trained Medical Vision-Language Models》。该研究提出了一种针对通过 GRPO(Group Relative Policy Optimization)训练的医学视觉 - 语言模型的新型校准方法。该方法旨在将模型的“能力”与其“置信度”分离开来,并引入基于数据的“双态校准”机制。这一技术改进有助于提升模型在医疗场景下的可靠性与准确性,解决了传统模型中能力评估与置信度输出不一致的问题。
Related eventsRELATED EVENTS
Key entitiesKEY ENTITIES
CCG-AUCDualReadGRPO
Coverage · reports per dayLANGUAGE SPLIT
Entity relations
SignalsSIGNALS
Keyword heat