AIDC
DC AI 热点

全部 AI 动态

9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 68/10012:00

基于DistilBERT-BiLSTM-Attention的可解释仇恨言论检测框架

针对社交媒体仇恨言论检测多局限于二分类、单数据集评估且缺乏决策可解释性的问题,该研究提出了一种多层级且具备可解释性的仇恨言论检测框架。该框架融合了DistilBERT、双向长短期记忆网络(BiLSTM)与注意力机制,旨在同时支持二分类与多类别分类任务,并增强模型预测推理过程的透明度与实际应用价值,助力内容审查系统的部署。

阅读原文 ↗推荐理由:提出结合轻量化预训练模型与注意力机制的新架构,兼顾多类别分类性能与模型可解释性,契合内容安全治理需求。# 仇恨言论检测# 可解释AI# DistilBERT# BiLSTM# 安全