UO-FIE:结合精确标签监督与分级效用的中文事实性推理系统
针对FIE2026中文事实性推理评估任务中的类别严重不平衡(单类别占64.1%)及兼顾精确度与邻近区间惩罚的评价机制,研究人员提出UO-FIE系统。实验发现mDeBERTa分类模型易偏向多数类,而Huber回归基线虽能落在相近区间但精确匹配率低。UO-FIE采用参数高效架构,综合精确标签监督与分级效用设计,改善了九分类有序事实性区间的推断表现。
针对FIE2026中文事实性推理评估任务中的类别严重不平衡(单类别占64.1%)及兼顾精确度与邻近区间惩罚的评价机制,研究人员提出UO-FIE系统。实验发现mDeBERTa分类模型易偏向多数类,而Huber回归基线虽能落在相近区间但精确匹配率低。UO-FIE采用参数高效架构,综合精确标签监督与分级效用设计,改善了九分类有序事实性区间的推断表现。