← 返回资讯
大模型 HuggingFace Daily Papers

SpecFirst:智能体编程合成中的行为规范优先方法

LLM智能体在有上下文支撑的软件工程任务中表现出色,但从零构建程序仍是难题。ProgramBench等基准测试显示,即使前沿模型在仅依靠自然语言文档和可执行二进制的情况下,成功率也不足1%。现有框架将文档阅读、行为探索与代码合成为单一流程,导致探索不足、行为意图随上下文漂移而丢失。

查看原文
解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。