← 返回资讯
大模型 HuggingFace Daily Papers

面向技能原生LLM:技能熵用于长时程推理评测与训练

长时程推理要求模型在推理链中切换不同技能。现有基准缺乏衡量技能切换能力的原则性方法,技能熵从评测和训练两端解决这一空白。

查看原文
解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。