arxivcs.LGcs.AI2026-07-10
Uncertainty-Aware Trust Estimation for Multi-LLM Systems via Structured Expert Judgement
Large Language Model (LLM) ensembles are increasingly used to improve reliability by combining predictions from multiple LLMs. However, existing aggregation methods typically assume that all models are equally trustworthy, overlooking differences in uncertainty quality. This assu…