DCAI
DC AI 热点

精选

当前热点完整榜单 →
1微软发布新版Copilot超级应用:整合聊天、编程与智能体能力85 热度 ⌁2Anthropic 与 Akamai 达成 116 亿美元云算力协议,年内算力支出承诺已超 5000 亿美元82 热度 ⌁3马斯克披露AI算力布局:Colossus集群拟部署超百万张英伟达GB300芯片81 热度 ⌁4谷歌启动Project Suncatcher:计划下周开展首个太空轨道数据中心测试81 热度 ⌁5微软正式推出新版 Copilot“超级应用”,整合聊天、代码与智能体能力79 热度 ⌁
9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 72/10012:00

大语言模型辩论行为基准测试:针对人身攻击防御能力的研究

该研究聚焦于大语言模型在说服性对话中作为辩论智能体的表现,重点评估其在面对人身攻击(诉诸人身论证)时的应对能力。在政治等说服性对话场景中,人格可信度与命题内容同样关键。研究通过分析自然语言政治对话语料库,探究现代大模型能否复现人类在策略性运用和防御人身攻击方面的辩论水准,旨在系统评估模型在复杂对话情境中的辩论与说服能力。

阅读原文 ↗推荐理由:系统评估了大模型在复杂政治辩论中应对与使用人身攻击策略的能力,拓展了模型说服力与论辩基准的研究边界。# 大模型# 辩论智能体# 评测# 人身攻击# 说服性对话