FairMedFM Fairness benchmarking for medical imaging foundation models. MedVLMBench Evaluation benchmark for medical vision-language models. RVCBench Robustness evaluation for modern voice-cloning models.