DeepSWE v1.1
一款通过强化学习训练、用于自动完成软件开发(编程)任务的开源AI智能体模型的更新版本
简单来说
DeepSWE v1.1是一款AI智能体模型,经过训练后能够自主阅读代码、修复漏洞、编写新功能。它不是靠人类逐一告知正确答案来学习,而是通过实际运行代码,根据问题是否被解决来获得奖励,并反复重复这一过程(强化学习)来提升能力。
打个比方,这就像一个学生每做完一道编程测验题,只被告知分数,然后自己反思、调整下次解题的方式。不是把答案背下来,而是通过反复试错积累实战经验。名字里的"v1.1"表示这是对之前版本进行修订后推出的更新版。
这类模型常常被放到基准测试中,用来衡量它们在真实软件代码库中处理修复漏洞等任务的能力,并与其他模型的表现进行比较。
