arXiv ID:
2606.10307
arXiv 提交日期: 2026-06-09
早期标记置信度预测多智能体大语言模型辩论中的推理质量 / Early-Token Confidence Predicts Reasoning Quality in Multi-Agent LLM Debate
1️⃣ 一句话总结
本研究提出利用大语言模型生成文本时前几个词的置信度(即解码概率),来有效预测多智能体辩论中推理质量的高低,该方法比分析整段文本更轻量且准确,尤其适用于没有标准答案的开放任务。