首位“AI软件工程师”亮相引爆科技圈

发布时间:2025-01-10 21:52:49 来源: sp20250110

  【科技创新世界潮】(317)

  ◎本报记者 张梦然

  一家成立不到两个月但拥有十名天才工程师的初创公司Cognition,搞了一个引爆科技圈的大动作。

  他们推出了一款名为Devin的人工智能(AI)助手,可以协助人类软件工程师完成诸多开发任务。Devin不同于现有其他AI编码者,它可以从零构建网站、自行部署应用、修复漏洞、学习新技术等,人类只需扮演一个下指令和监督的角色。

  这是第一个真正意义上完全自主的AI软件工程师,一亮相即掀起轩然大波,因为人们担心:人类程序员是不是真要失业了?

  测试表现超越“同辈”

  据Cognition官网报道,Devin只需一句指令,即可端到端地处理整个开发项目。

  按照用户需求,Devin可以同时执行多步骤工作流程,人类工程师则可以实时观察其进度,发现错误时,跳出指令进行修正。这便于工程师们将大部分工作“外包”给AI,自己则可以潜心于创意性工作。

  在SWE-bench基准测试中,Devin的表现远超Claude 2、Llama、GPT-4等选手,能够完整正确地处理13.86%的问题。相较之下,GPT-4只能处理1.74%的问题。更重要的是,Devin在测试中没有得到任何帮助,而其他所有模型都需要帮助,即人们要准确告知模型需要编辑哪些文件。

  这一进展,标志着AI在自主理解和解决软件开发问题方面取得了显著进步。目前,Devin已经成功通过一家AI公司面试,并且在Upwork上完成了实际工作。

  运作几乎完全自主

  Devin的厉害之处,还在于可以规划和执行异常复杂的工程任务,这类任务通常需要数千个决策才能完成。在这之中,无论进行到任何一步,它都可以回调所有相关的上下文信息,保证任务的逻辑性,也便于随时校正。

  更让人震撼的是,Devin不仅能帮人们解决代码,还囊括了与之相关的整个工作流。

  譬如,当工程师需要设计一个网页游戏时,Devin首先能生成网页,接着还能完成服务端的部署,最后直接发布上线,省去了中间大量人工操作。甚至在发现漏洞之后,Devin还会回溯报错出现的位置及对应的数据,然后分析原因并给出解决方案。

  此外,作为一个AI全能助手,Devin还可以帮助人类训练和微调其他AI。对于一些常见的模型,你只需要提及模型的名称,Devin自己就知道要怎样去训练。

  那人们需要做什么呢?按设想,最终的Devin会让人类只需要发号施令,其他什么也不用做。

  对软件开发业影响深远

  初创公司Cognition虽然只有十名员工,但他们手中却握着十块IOI(国际信息学奥林匹克竞赛)金牌,核心创始团队为3名华人。

  Devin现处于内测阶段,有意用户可申请提前试用。目前,团队尚未透露更多核心技术细节,但他们表示,Devin源于其长期推理及规划研究的进展。编码只是第一步,这一AI助手其实可推广到更宽领域。

  Devin的出现,可能对软件开发行业产生深远影响,甚至可能减少对人类开发者的需求。但须注意到,该技术仍处于早期阶段,其成熟度和效果需要业界作进一步评估。

  就目前而言,Devin的成功可以说为当今软件开发人员带来更新更好的AI协作体验。人们从繁琐工作中“解放”,只需监督AI系统去处理,而自己将精力投入到创新性任务上,实现生产力的真正提高。(来源:科技日报) 【编辑:叶攀】

选择用户
全部人员 全选 撤消
谢志刚
李岩
李海涛
谢志强
李亚琴
潘潇潇
杨亚男
高荣新
郑文静
金琳
张银波
张欣
陈曦
刘涛
王长青
高广柱
孙圆
行政专员
付雪枫
张雪莲
张璐
刘相群
张明璇
李静
孙静
王晨
赵夏
马洪亮
张兰
黄莉
李潍伊
常恩宁
侯昭宇
韩岩峰
冯亚红
林洋
陈静
刘婧
魏保国
唐彦秀
张楠
刘瑞萍
付严明
荣伶
马建国
邓爱青
系统管理员