Mitigating Overconfidence in Large Language Models: A Behavioral Lens on Confidence Estimation and Calibration
Behavioral analysis and mitigation strategies for overconfidence in large language models.
•
1 min read
Read more
Behavioral analysis and mitigation strategies for overconfidence in large language models.
Characterizing LLM abstention behavior in science QA with context perturbations.
Demonstrating that open-weight models can match ChatGPT in low-resource, laboratory-scale AI deployments.
A generative model for animal motion synthesis under limited data constraints.
Cross-class query network for partially labeled organ segmentation in medical images.
Learning metrics for evaluating recommendation explanations.