Scholay

学术搜索 · AI 审稿 · LaTeX 协作

LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation

作者:Ming Zhang, Yujiong Shen, Z. Li, Huayu Sha, Binze Hu, Yuhui Wang, Chenhao Huang, Shichun Liu, Jingqi Tong, Changhao Jiang, Mingxu Chai, Zhiheng Xi, Shihan Dou, Tao Gui, Qi Zhang, Xuanjing Huang · 年份:2025 · DOI:10.18653/v1/2025.findings-emnlp.263 · 被引用次数:4 · 研究领域:Artificial Intelligence in Healthcare and Education、Machine Learning in Healthcare、Biomedical Text Mining and Ontologies

Ming Zhang, Yujiong Shen, Zelin Li, Huayu Sha, Binze Hu, Yuhui Wang, Chenhao Huang, Shichun Liu, Jingqi Tong, Changhao Jiang, Mingxu Chai, Zhiheng Xi, Shihan Dou, Tao Gui, Qi Zhang, Xuanjing Huang. Findings of the Association for Computational Linguistics: EMNLP 2025. 2025.