开学前的好消息:一篇论文被 EMNLP 2026 主会接收!一作是课题组博士生安浩。
Teaching LLMs to Abstain via Fine-Grained Semantic Confidence Reward (FiSCoRe)
论文从去年海量的「强化学习微调 + 改善大模型幻觉」的“严酷”竞争中出来真的不容易。我们的核心贡献“结合正确性和语义熵不确定性来联合微调模型”仍有长期价值!
Arxiv:https://arxiv.org/abs/2510.24020
预祝布达佩斯旅途愉快!