Large Language Models Are Poor Clinical Decision-Makers: A Comprehensive Benchmark
作者:Fenglin Liu, Zheng Li, Hongjian Zhou, Qingyu Yin, Jingfeng Yang, Xianfeng Tang, Chen Luo, Ming Zeng, Haoming Jiang, Yifan Gao, Priyanka Nigam, Sreyashi Nag, Bing Yin, Yining Hua, Xuan Zhou, Omid Rohanian, Anshul Thakur, Lei Clifton, David A. Clifton · 年份:2024 · DOI:10.18653/v1/2024.emnlp-main.759 · 被引用次数:12 · 研究领域:Artificial Intelligence in Healthcare and Education
Fenglin Liu, Zheng Li, Hongjian Zhou, Qingyu Yin, Jingfeng Yang, Xianfeng Tang, Chen Luo, Ming Zeng, Haoming Jiang, Yifan Gao, Priyanka Nigam, Sreyashi Nag, Bing Yin, Yining Hua, Xuan Zhou, Omid Rohanian, Anshul Thakur, Lei Clifton, David A. Clifton. Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing. 2024.