Publications

Auditing Pairwise Equivalence Judgments: Self-Critique Effects and Diversity Measurement in Multi-Agent Hypothesis Generation
NeurIPS 2026 AgenticLS Workshop



Cataract Detection from Small Datasets: Fine-Tuning Approaches and Real-World Validation under Data Shifts
2026in preparation



