Better Calibration Without Demonstrated Safety Gains: Risk-Calibrated Semantic Navigation Under Distribution Shift
Question. Does converting calibrated semantic perception uncertainty into navigation cost improve closed-loop robot outcomes under controlled distribution shift?
A preregistered ROS 2 and Gazebo benchmark testing whether converting calibrated semantic uncertainty into navigation cost makes a Nav2 robot safer under controlled distribution shift. Calibration improved; navigation safety did not.
Calibration improved substantially and clean-route efficiency was preserved, but the preregistered collision-reduction and severity-interaction hypotheses did not pass. Better component calibration did not establish safer navigation.
- Embodied AI
- Autonomous Systems
- Computer Vision
- Uncertainty Calibration


