星光澄海 | BLOG

Cognition让Devin靠GPT-6 Astra自测,工程师能少审代码?

之前Devin写完代码,自测环节总差口气——要么漏了边界情况,要么找不出逻辑漏洞。现在Cognition给它加了个GPT-6 Astra的帮手。

这次更新做了什么?

Cognition的AI软件工程师Devin,现在用GPT-6 Astra来做自我测试和功能验证。Devin写完代码后,会把代码和对应的需求说明转给GPT-6 Astra,让后者模拟实际运行场景,检查代码有没有bug,是不是真的实现了要做的功能。这相当于给Devin装了个更厉害的“内部质检员”。

核心是AI测AI的闭环优化

之前Devin的测试依赖自身的工具链,现在换成GPT-6 Astra后,测试的覆盖度和准确度都提了一档。不用让工程师再盯着Devin的代码当人肉测试员,Devin自己就能先过一遍更严格的测试关卡。整个流程的目标很明确:减少工程师要审核的代码量,让团队能交付更多项目。

对软件从业者来说,这意味着什么?

对一线工程师来说,这省了不少重复劳动。之前你可能要花一半精力,检查Devin写的代码里的小错误,或者补全它没覆盖到的测试场景;现在Devin自己就能用GPT-6 Astra把大部分测试做完,你只需要确认核心逻辑有没有符合需求就行。
对AI软件这个领域来说,这是Devin在自我迭代上的小突破。毕竟自测越靠谱,上线前出问题的概率越低,项目的交付效率也能跟着提。

目前看,这是AI软件工程师在测试环节的优化,但会不会让工程师彻底不用管Devin的自测结果?或者说,当AI能自己测自己的工作,是不是离全自动化软件交付更近了一步?


素材来源:OpenAI News · AI情报、大模型、AI应用落地
查看报道原文

发表第一条评论吧

支持 Markdown