CASET: a cascaded attention-based framework for semantic explainability of toxicity in large language models
作者:C. L. Philip Chen, Hanyang Xia, Weidong Zhou, Chunhe Xia, Mengyao Liu, Rui Hao, Tianbo Wang · 发表于:Applied Intelligence · 年份:2026 · DOI:10.1007/s10489-026-07102-7 · 被引用次数:10 · 研究领域:Explainable Artificial Intelligence (XAI)、Topic Modeling、Hate Speech and Cyberbullying Detection