Resources


Database Credentialed Access

MIMIC-III-Ext-VeriFact-BHC: Labeled Propositions From Brief Hospital Course Summaries for Long-form Clinical Text Evaluation

Philip Chung, Akshay Swaminathan, Alex Goodell, et al.

A clinician-labeled dataset for fact-checking long-form clinical text against patient EHRs. The dataset contains LLM-written and human-written Brief Hospital Course summaries decomposed to atomic claim and sentence propositions with annotations.

natural language processing clinical informatics formal logic chart review clinical notes text embedding electronic health records artificial intelligence brief hospital course long-form text llm evaluation logical atomism retrieval-augmented generation text reranking clinical medicine atomic claim fact verification hybrid retrieval llm-as-a-judge large language models

Published: Aug. 27, 2026. Version: 1.1.0